Skip to main content
全网优质资源汇总✨

Search: #语音克隆

  1. 浮云梦配音

    免费的在线文字转语音平台,集成文字转语音(140+语言/400+神经网络语音)、多人对话配音批量生成(单任务10万字)、语音克隆语音转换字幕生成等语音工具。无需注册、无广告,打开网页即可使用,生成内容可免费商用。

    点击访问

    #语音转文字
  2. 🎙 Voice-Pro
    📦 AI语音工具 | Windows | 开源项目


    ➤ 免费开源 Gradio 语音处理工具
    ➤ 支持 Whisper / Faster-Whisper 语音识别
    ➤ 支持 Edge-TTS、Kokoro、CosyVoice 文字转语音
    ➤ 支持 F5-TTS、E2-TTS、CosyVoice 声音克隆
    ➤ 支持 Demucs 人声分离
    ➤ 支持 YouTube 下载与音频处理
    ➤ 支持多语言翻译与 AI 配音
    ➤ 一站式完成转文字、翻译、重新配音


    📌 简单说:
    👉 Voice-Pro 是一款本地运行的全能 AI 语音工具,将语音识别、文字转语音、声音克隆、人声分离、视频翻译配音等功能整合在一起,适合视频创作者、播客制作和 AI 配音用户。

    🆕 主要功能:

    ➤ AI 语音识别(90+语言)
    ➤ AI 文字转语音(400+声音)
    ➤ 零样本声音克隆
    ➤ 人声与背景音乐分离
    ➤ 视频下载与字幕生成
    ➤ 多语言翻译配音
    ➤ 本地运行,支持离线使用

    ⚙️ 运行环境:

    ➤ 推荐 NVIDIA 显卡
    ➤ Windows 支持双击 start.bat 安装
    ➤ 免费使用,无订阅限制

    🔗 项目地址:

    https://github.com/abus-aikorea/voice-pro

    📂 #Windows #AI #语音工具 #声音克隆 #开源项目
  3. 🎙 Voice Clone Studio

    📦 AI语音工具 | 语音克隆 | 开源项目

    ➤ AI 语音克隆与生成工具
    ➤ 支持音频样本声音克隆
    ➤ 支持语音转换与声音生成
    ➤ 支持语音转文字(STT)
    ➤ 支持音效处理
    ➤ 支持多说话人模式
    ➤ 集成多种 TTS 与语音 AI 模型
    ➤ 支持 Qwen3-TTS、VibeVoice、Chatterbox、Fish Speech、LuxTTS 等模型
    ➤ 基于 Gradio 开发


    📌 简单说:
    👉 Voice Clone Studio 是一个开源 AI 语音处理平台,将语音克隆、TTS 生成、声音转换和语音识别等功能整合到一个界面中,适合 AI 配音、语音实验和创作使用。

    🔗 项目地址:
    https://github.com/FranckyB/Voice-Clone-Studio

    📂 #GitHub #AI语音 #TTS #语音克隆 #开源项目
  4. VoxCPM |基于连续表征的多语言语音合成、创意音色设计与高保真声音克隆

    一个无离散音频分词器(Tokenizer-Free)的语音合成系统,通过端到端的扩散自回归架构直接生成连续语音表征,绕过对音频的离散编码步骤,实现高度自然且富有表现力的语音合成。
    🌍 30种语言语音合成 — 直接输入原始文本即可合成(支持语言详见下文),无需额外语言标签
    🎨 音色设计 — 用自然语言描述(性别、年龄、音色、情绪、语速……)凭空创建全新音色,无需参考音频
    🎛 可控声音克隆 — 从参考音频片段克隆任意声音,可叠加风格指令控制情绪、语速和表现力,同时保持原始音色
    🎙 极致克隆 — 提供参考音频及其文本内容,模型接着参考音频进行无缝续写,从而精准还原声音细节特征(与 VoxCPM1.5 一致)
    🔊 48kHz 高质量音频 — 输入 16kHz 参考音频,通过 AudioVAE V2 的非对称编解码设计直接输出 48kHz 高质量音频,内置超分能力
    🧠 语境感知合成 — 根据文本内容自动推断合适的韵律和表现力
    ⚡️ 实时流式合成 — 在 NVIDIA RTX 4090 上 RTF 低至 ~0.3,通过 Nano-vLLM 或 vLLM-Omni(官方 vLLM 全模态服务,原生支持 VoxCPM2,提供 PagedAttention 与 OpenAI 兼容 API)加速后可达 ~0.13
    📜 完全开源,商用就绪 — 权重和代码基于 Apache-2.0 协议发布,免费商用


    项目地址

    #开源 #声音克隆 #AI语音 #本地部署 #VoxCPM #语音合成
  5. #语音克隆 #AI语音 #AI
    X Voice 一键 AI 语音克隆工具使用指南与功能介绍
    **X-Voice**是一款基于流程匹配的多语言文本转语音系统,使一名说话者能够使用30种语言。 环境依赖python,支持跨平台使用,优先N卡使用 ### **安装 X-Voice** 检查你的 ESpeak-ng 安装: 如果找不到,先运行 。 开源:https://github.com/sunnyxrxrx/X-Voice 网盘链接:https://pan.quark.cn/s/ecc563877898
    📢关注频道:@quanshoulu
    🎁访问主页: www.noisework.cn
  6. #VoxCPM2 #语音合成 #AI
    VoxCPM整合包
    VoxCPM 是一个支持中英文、零样本语音克隆、情感可控、音素/公式输入的统一端到端语音合成大模型。它不依赖传统 TTS 流水线(如文本分析 → 音素对齐 → 声码器),而是直接从文本生成高质量语音波形 新版本新增特性: 1.UI颠覆性重构,主要体现在:场景从"语音克隆"+"语音设计"分为"简单场景"+"复杂场景",复杂场景中均支持可控克隆和极致克隆两种方式,适用于不同诉求。特别注意的是Excel中模板根据不同场景拆分为两个,且字段含义不同。 2.新增了api调用及详细说明文档。 3.音色设计页面UI美化,并引入了文本替换 链接:https://pan.quark.cn/s/5ef0eeb56fba
    📢关注频道:@quanshoulu
    🎁访问主页: www.noisework.cn
  7. 🎙 悟声 AI:超拟真 AI 语音合成与瞬时克隆平台
    全球领先模型 · 极速声音克隆 · 创作有声内容
    📌 项目介绍:

    悟声 AI 是音频人工智能领域的先驱者,提供极度自然的 AI 语音克隆与配音合成技术。其 V3.1 大模型在世界权威语音模型盲测排行榜中名列前茅,致力于模糊真实与虚拟声音的边界。

    ⚙️ 核心亮点:

    拟真合成:支持多语种(中/英/日/韩/粤等)超拟真语音生成。
    瞬时克隆:仅需少量音频样本即可快速克隆任何角色声音。
    音色转换:支持将一段音频的音色完美转换为目标角色的声音。
    声音市场:内置丰富的社区与专业声音库,一键调用。
    开放平台:提供强大的 API 接口,支持开发者集成音频应用。

    🌐 资源链接:

    • 官方网站:https://www.wusound.cn/


    📢 频道 | 💬 群组 | 📬 投稿 | 📨 商务

    #AI配音 #语音克隆 #AI工具 #音频合成 #悟声AI