Skip to main content
全网优质资源汇总✨

Search: #语音工具

  1. 浮云梦配音

    免费的在线文字转语音平台,集成文字转语音(140+语言/400+神经网络语音)、多人对话配音批量生成(单任务10万字)、语音克隆语音转换字幕生成等语音工具。无需注册、无广告,打开网页即可使用,生成内容可免费商用。

    点击访问

    #语音转文字
  2. 🎙 Voice-Pro
    📦 AI语音工具 | Windows | 开源项目


    ➤ 免费开源 Gradio 语音处理工具
    ➤ 支持 Whisper / Faster-Whisper 语音识别
    ➤ 支持 Edge-TTS、Kokoro、CosyVoice 文字转语音
    ➤ 支持 F5-TTS、E2-TTS、CosyVoice 声音克隆
    ➤ 支持 Demucs 人声分离
    ➤ 支持 YouTube 下载与音频处理
    ➤ 支持多语言翻译与 AI 配音
    ➤ 一站式完成转文字、翻译、重新配音


    📌 简单说:
    👉 Voice-Pro 是一款本地运行的全能 AI 语音工具,将语音识别、文字转语音、声音克隆、人声分离、视频翻译配音等功能整合在一起,适合视频创作者、播客制作和 AI 配音用户。

    🆕 主要功能:

    ➤ AI 语音识别(90+语言)
    ➤ AI 文字转语音(400+声音)
    ➤ 零样本声音克隆
    ➤ 人声与背景音乐分离
    ➤ 视频下载与字幕生成
    ➤ 多语言翻译配音
    ➤ 本地运行,支持离线使用

    ⚙️ 运行环境:

    ➤ 推荐 NVIDIA 显卡
    ➤ Windows 支持双击 start.bat 安装
    ➤ 免费使用,无订阅限制

    🔗 项目地址:

    https://github.com/abus-aikorea/voice-pro

    📂 #Windows #AI #语音工具 #声音克隆 #开源项目
  3. 🎙 Voice Clone Studio

    📦 AI语音工具 | 语音克隆 | 开源项目

    ➤ AI 语音克隆与生成工具
    ➤ 支持音频样本声音克隆
    ➤ 支持语音转换与声音生成
    ➤ 支持语音转文字(STT)
    ➤ 支持音效处理
    ➤ 支持多说话人模式
    ➤ 集成多种 TTS 与语音 AI 模型
    ➤ 支持 Qwen3-TTS、VibeVoice、Chatterbox、Fish Speech、LuxTTS 等模型
    ➤ 基于 Gradio 开发


    📌 简单说:
    👉 Voice Clone Studio 是一个开源 AI 语音处理平台,将语音克隆、TTS 生成、声音转换和语音识别等功能整合到一个界面中,适合 AI 配音、语音实验和创作使用。

    🔗 项目地址:
    https://github.com/FranckyB/Voice-Clone-Studio

    📂 #GitHub #AI语音 #TTS #语音克隆 #开源项目
  4. 🤖 Vibe

    📦 AI 转录 | 本地工具 | 开源项目


    ➤ 音频、视频一键转换为文本
    ➤ 支持本地 Whisper 模型
    ➤ 支持 Nemotron 3.5 与 Parakeet TDT v3 模型
    ➤ 所有数据保存在本地电脑
    ➤ 注重隐私安全,无需上传文件
    ➤ 支持多说话人语音识别
    ➤ 自动生成文字转录结果
    ➤ 支持 SRT 字幕格式
    ➤ 支持 VTT、TXT、HTML、PDF
    ➤ 支持 JSON、DOCX 导出
    ➤ 支持 macOS、Windows、Linux
    ➤ 开源免费项目



    📌 简单说:
    👉 Vibe 是一款本地 AI 语音转文字工具,支持多种语音识别模型,可将音频和视频快速转换为字幕或文本文件,全程本地处理,保护隐私。

    🔗 项目地址:
    https://github.com/thewh1teagle/vibe

    📂 #AI #语音转文字 #Whisper #字幕工具 #开源项目
  5. #语音克隆 #AI语音 #AI
    X Voice 一键 AI 语音克隆工具使用指南与功能介绍
    **X-Voice**是一款基于流程匹配的多语言文本转语音系统,使一名说话者能够使用30种语言。 环境依赖python,支持跨平台使用,优先N卡使用 ### **安装 X-Voice** 检查你的 ESpeak-ng 安装: 如果找不到,先运行 。 开源:https://github.com/sunnyxrxrx/X-Voice 网盘链接:https://pan.quark.cn/s/ecc563877898
    📢关注频道:@quanshoulu
    🎁访问主页: www.noisework.cn
  6. 🔁 Voicebox
    📦 AI语音工具 | 本地语音转文字 | 开源项目


    ➤ 语音转文字|支持本地离线 ASR 识别
    ➤ 多模型支持|兼容 Whisper / Faster-Whisper
    ➤ 音频转录|支持 MP3 / WAV / M4A 等格式
    ➤ 字幕生成|自动生成 SRT 字幕文件
    ➤ 本地运行|注重隐私 无需上传云端
    ➤ 开源免费|跨平台桌面应用



    🌐 项目地址:
    https://github.com/jamiepine/voicebox

    📌 简单说:
    👉 一个开源的本地 AI 转录工具,可快速把音频视频转换成字幕与文本。

    ———— 商务合作————

    📂 #AI工具 #语音转文字 #Whisper #开源项目
    📁 Windows / AI工具
  7. 🔁 VibeVoice
    📦 开源项目 | GitHub | AI语音生成 + 识别


    ➤ 长音频识别|支持最长60分钟语音转文字(ASR)
    ➤ 结构化转录|自动识别说话人 + 时间戳 + 内容
    ➤ 多人语音生成|支持最多4人对话语音(TTS)
    ➤ 超长语音|可生成最长约90分钟连续音频
    ➤ 实时语音|支持低延迟流式TTS输出
    ➤ 多语言支持|覆盖50+语言识别能力
    ➤ 开源研究|适合开发与语音AI实验


    🌐 项目:
    https://github.com/microsoft/VibeVoice

    ———— 商务合作————

    📂 #AI工具 #语音AI #开源项目 #TTS #ASR
    📁 Windows / 开发工具
  8. 🎨 TryVoice - AI Agent 的免提语音运行环境
    解放双手 · 像聊天一样与 AI 编程助手对话

    📌 工具介绍:

    TryVoice 为 AI Agent(如 Claude Code、OpenClaw)提供了一层语音交互外壳。它支持唤醒词激活、实时流式响应及中断播放,让用户无需触碰键盘即可通过语音操控 AI 编程助手,实现真正的“动口不动手”。


    ⚡️ 核心特点:

    🛠 唤醒词激活:支持 OpenWakeWord,说出关键词即可开启对话。
    🔍 实时流式响应:边生成边播放,支持随时打断,交互体验极佳。
    ⚙️ 广泛适配:内置 Claude Code 与 OpenClaw 适配器,支持 SDK 扩展。


    🌐 项目地址:
    https://github‍.com/AaronZ021/tryvoice-oss

    #TryVoice #AIAgent #语音交互 #ClaudeCode #OpenClaw #开源项目 #效率工具
  9. 🎙 悟声 AI:超拟真 AI 语音合成与瞬时克隆平台
    全球领先模型 · 极速声音克隆 · 创作有声内容
    📌 项目介绍:

    悟声 AI 是音频人工智能领域的先驱者,提供极度自然的 AI 语音克隆与配音合成技术。其 V3.1 大模型在世界权威语音模型盲测排行榜中名列前茅,致力于模糊真实与虚拟声音的边界。

    ⚙️ 核心亮点:

    拟真合成:支持多语种(中/英/日/韩/粤等)超拟真语音生成。
    瞬时克隆:仅需少量音频样本即可快速克隆任何角色声音。
    音色转换:支持将一段音频的音色完美转换为目标角色的声音。
    声音市场:内置丰富的社区与专业声音库,一键调用。
    开放平台:提供强大的 API 接口,支持开发者集成音频应用。

    🌐 资源链接:

    • 官方网站:https://www.wusound.cn/


    📢 频道 | 💬 群组 | 📬 投稿 | 📨 商务

    #AI配音 #语音克隆 #AI工具 #音频合成 #悟声AI
  10. 💥 Ultimate TTS Studio|终极 TTS 语音合成软件
    推荐:一站式文本转语音解决方案,适合配音、旁白与内容创作。

    🟢 项目核心亮点:


    高质量 TTS: 🗣 将文本快速转换为自然语音
    多场景适用: 🎙 旁白、配音、有声内容制作
    操作简单: 🖱 界面直观,上手门槛低
    效率优先: ⚡️ 批量处理,节省时间
    创作者友好: 🎧 适合自媒体与内容生产


    想把文字变成声音,这是一个很省心的工具。

    🌐 项目链接:
    ❤️ 点击直达

    频道 | 💬 群组 | 📬 投稿 | 📨 商务

    #TTS #语音合成 #AI工具 #配音软件
  11. 🎙 LazyTyper | 懒人打字神器,基于 Whisper 的语音输入法

    🔥 还在为了打字手酸?这款体积仅几 MB 的小工具,利用 OpenAI Whisper 模型,让你的语音转文字快如闪电!

    💎 核心亮点:

    超高准确率: 🧠 基于强大的 Whisper 模型,识别准确率高达 90% 以上。
    多语言混输: 🌍 真正支持中、英、日、韩无缝混合说,再也不用手动切换语言。
    极致轻量化: 🪶 体积仅个位数 MB,内存占用极低,旧电脑也能跑得飞起。
    完全免费: 🆓 支持 Windows & macOS 双平台,无内购,无广告。

    📢 社区反馈:
    在 V2EX 论坛引起热议,网友评价极高,被称为“只有几M的生产力怪兽”。

    📥 官网下载 (Win/Mac)
    🔗 查看 V2EX 原帖讨论

    频道 | 💬 群组 | 📬 投稿 | 📨 商务

    #AI #语音输入 #效率工具 #Whisper #LazyTyper
  12. 🟠 RealDubbing - 在线文本转语音神器

    🟢 简介:
    一款免费的文本转语音工具,能生成自然流畅的音频,让内容创作变得轻松搞定。

    核心功能:
    海量声音选择: 提供上百种 AI 声音供你选择。
    高度自定义: 可以自定义生成的语音的语速和音高。
    AI 对话生成: 还支持 AI 对话生成功能。
    完全免费: 无需注册,即可无限次生成高品质语音。
    全球语言覆盖: 支持全球多种语言。

    🌐 网站地址:
    点击此处,立即访问

    频道 | 💬 群组 | 📬 投稿 | 📨 商务

    #语音转换 #网站 #TTS #AI工具
  13. #语音合成
    基于GPT-SoVITS的视频剪辑快捷配音工具
    该项目是一个拥有 GUI 悬浮窗界面的 GPT-SoVITS 推理程序,可以通过模拟操作系统的文件拖拽信号,将合成的语音直接拖拽至视频剪辑软件(如 Adobe Premiere)的时间轴,更加方便地实现视频的配音。
    项目地址:https://github.com/2DIPW/dub_genius
    推理核心源码基于 RVC-Boss/GPT-SoVITS 修改,GUI 界面基于 PySide6 实现,exe可执行文件由 PyStand 编译。
    📥 部署
    可以直接下载带有 exe 可执行文件的整合包,也可以自行部署依赖环境并从命令行运行。
    整合包
    整合包自带全部依赖和预训练模型,以及一个 Python 3.9.13 的嵌入式版本,可通过 exe 可执行文件独立运行。
    PyTorch版本 | 大小 | 下载地址
    ------------------------------
    CPU推理版本 | 2.2.1 | 989 MB | OneDrive(https://1drv.ms/u/s!ApF_M_PJgMjabK4tbMUTw5nFt-g?e=C3O0JN) | 百度网盘(https://pan.baidu.com/s/1sKlushysdxq1ce-IBHcJaw?pwd=nqwm)
    ------------------------------
    GPU推理版本 | 2.2.1+cu118 | 2.18 GB | OneDrive(https://1drv.ms/u/s!ApF_M_PJgMjabWCA4_s3fwxwi7M?e=nObvOo)…
    📡发布:https://noisevip.cn/17918.html
    📢关注频道:@quanshoulu
    💬频道社群:https://www.noisework.cn/qun/
    📬投稿bot:@noisewowbot
    📇搜索bot:@Efficiencysearchbot
    🎁访问主页: www.noisework.cn