Search: #语音工具
-
- 🎙 Voice-Pro
📦 AI语音工具 | Windows | 开源项目
📌 简单说:
👉 Voice-Pro 是一款本地运行的全能 AI 语音工具,将语音识别、文字转语音、声音克隆、人声分离、视频翻译配音等功能整合在一起,适合视频创作者、播客制作和 AI 配音用户。
🆕 主要功能:
➤ AI 语音识别(90+语言)
➤ AI 文字转语音(400+声音)
➤ 零样本声音克隆
➤ 人声与背景音乐分离
➤ 视频下载与字幕生成
➤ 多语言翻译配音
➤ 本地运行,支持离线使用
⚙️ 运行环境:
➤ 推荐 NVIDIA 显卡
➤ Windows 支持双击 start.bat 安装
➤ 免费使用,无订阅限制
🔗 项目地址:
https://github.com/abus-aikorea/voice-pro
📂 #Windows #AI #语音工具 #声音克隆 #开源项目 -
-
- #语音克隆 #AI语音 #AI
X Voice 一键 AI 语音克隆工具使用指南与功能介绍
**X-Voice**是一款基于流程匹配的多语言文本转语音系统,使一名说话者能够使用30种语言。 环境依赖python,支持跨平台使用,优先N卡使用 ### **安装 X-Voice** 检查你的 ESpeak-ng 安装: 如果找不到,先运行 。 开源:https://github.com/sunnyxrxrx/X-Voice 网盘链接:https://pan.quark.cn/s/ecc563877898
📢关注频道:@quanshoulu
🎁访问主页: www.noisework.cn -
- 🔁 Voicebox
📦 AI语音工具 | 本地语音转文字 | 开源项目➤ 语音转文字|支持本地离线 ASR 识别
➤ 多模型支持|兼容 Whisper / Faster-Whisper
➤ 音频转录|支持 MP3 / WAV / M4A 等格式
➤ 字幕生成|自动生成 SRT 字幕文件
➤ 本地运行|注重隐私 无需上传云端
➤ 开源免费|跨平台桌面应用
🌐 项目地址:
https://github.com/jamiepine/voicebox
📌 简单说:
👉 一个开源的本地 AI 转录工具,可快速把音频视频转换成字幕与文本。
———— 商务合作————
📂 #AI工具 #语音转文字 #Whisper #开源项目
📁 Windows / AI工具 -
-
-
-
-
- 🎨 TryVoice - AI Agent 的免提语音运行环境
解放双手 · 像聊天一样与 AI 编程助手对话
📌 工具介绍:TryVoice 为 AI Agent(如 Claude Code、OpenClaw)提供了一层语音交互外壳。它支持唤醒词激活、实时流式响应及中断播放,让用户无需触碰键盘即可通过语音操控 AI 编程助手,实现真正的“动口不动手”。
⚡️ 核心特点:• 🛠 唤醒词激活:支持 OpenWakeWord,说出关键词即可开启对话。
• 🔍 实时流式响应:边生成边播放,支持随时打断,交互体验极佳。
• ⚙️ 广泛适配:内置 Claude Code 与 OpenClaw 适配器,支持 SDK 扩展。
🌐 项目地址:
https://github.com/AaronZ021/tryvoice-oss
#TryVoice #AIAgent #语音交互 #ClaudeCode #OpenClaw #开源项目 #效率工具 -
- 两款免费的语音输入工具
比打字输入快四倍,支持自动优化口语表达、过滤杂词等,专为中文优化,完全免费~
https://shandianshuo.cn/
https://github.com/yan5xu/ququ
📖频道 | 📥投稿 |
商务
#Github #语音输入 -
- 🎙 LazyTyper | 懒人打字神器,基于 Whisper 的语音输入法
🔥 还在为了打字手酸?这款体积仅几 MB 的小工具,利用 OpenAI Whisper 模型,让你的语音转文字快如闪电!
💎 核心亮点:
✅ 超高准确率: 🧠 基于强大的 Whisper 模型,识别准确率高达 90% 以上。
✅ 多语言混输: 🌍 真正支持中、英、日、韩无缝混合说,再也不用手动切换语言。
✅ 极致轻量化: 🪶 体积仅个位数 MB,内存占用极低,旧电脑也能跑得飞起。
✅ 完全免费: 🆓 支持 Windows & macOS 双平台,无内购,无广告。
📢 社区反馈:
在 V2EX 论坛引起热议,网友评价极高,被称为“只有几M的生产力怪兽”。
→ 📥 官网下载 (Win/Mac)
→ 🔗 查看 V2EX 原帖讨论
频道 | 💬 群组 | 📬 投稿 | 📨 商务
#AI #语音输入 #效率工具 #Whisper #LazyTyper -
- #语音合成
基于GPT-SoVITS的视频剪辑快捷配音工具
该项目是一个拥有 GUI 悬浮窗界面的 GPT-SoVITS 推理程序,可以通过模拟操作系统的文件拖拽信号,将合成的语音直接拖拽至视频剪辑软件(如 Adobe Premiere)的时间轴,更加方便地实现视频的配音。
项目地址:https://github.com/2DIPW/dub_genius
推理核心源码基于 RVC-Boss/GPT-SoVITS 修改,GUI 界面基于 PySide6 实现,exe可执行文件由 PyStand 编译。
📥 部署
可以直接下载带有 exe 可执行文件的整合包,也可以自行部署依赖环境并从命令行运行。
整合包
整合包自带全部依赖和预训练模型,以及一个 Python 3.9.13 的嵌入式版本,可通过 exe 可执行文件独立运行。
PyTorch版本 | 大小 | 下载地址
------------------------------
CPU推理版本 | 2.2.1 | 989 MB | OneDrive(https://1drv.ms/u/s!ApF_M_PJgMjabK4tbMUTw5nFt-g?e=C3O0JN) | 百度网盘(https://pan.baidu.com/s/1sKlushysdxq1ce-IBHcJaw?pwd=nqwm)
------------------------------
GPU推理版本 | 2.2.1+cu118 | 2.18 GB | OneDrive(https://1drv.ms/u/s!ApF_M_PJgMjabWCA4_s3fwxwi7M?e=nObvOo)…
📡发布:https://noisevip.cn/17918.html
📢关注频道:@quanshoulu
💬频道社群:https://www.noisework.cn/qun/
📬投稿bot:@noisewowbot
📇搜索bot:@Efficiencysearchbot
🎁访问主页: www.noisework.cn -
- #开源 #语音合成
一个可以录制 Microsoft Edge 浏览器的语音合成(TTS)语音并输出为 .wav 音频的(windows平台)工具。
https://github.com/LuckyHookin/edge-TTS-record