Skip to main content
全网优质资源汇总✨

Search: #语音转文字

  1. 浮云梦配音

    免费的在线文字转语音平台,集成文字转语音(140+语言/400+神经网络语音)、多人对话配音批量生成(单任务10万字)、语音克隆语音转换字幕生成等语音工具。无需注册、无广告,打开网页即可使用,生成内容可免费商用。

    点击访问

    #语音转文字
  2. 🎙 Voice-Pro
    📦 AI语音工具 | Windows | 开源项目


    ➤ 免费开源 Gradio 语音处理工具
    ➤ 支持 Whisper / Faster-Whisper 语音识别
    ➤ 支持 Edge-TTS、Kokoro、CosyVoice 文字转语音
    ➤ 支持 F5-TTS、E2-TTS、CosyVoice 声音克隆
    ➤ 支持 Demucs 人声分离
    ➤ 支持 YouTube 下载与音频处理
    ➤ 支持多语言翻译与 AI 配音
    ➤ 一站式完成转文字、翻译、重新配音


    📌 简单说:
    👉 Voice-Pro 是一款本地运行的全能 AI 语音工具,将语音识别、文字转语音、声音克隆、人声分离、视频翻译配音等功能整合在一起,适合视频创作者、播客制作和 AI 配音用户。

    🆕 主要功能:

    ➤ AI 语音识别(90+语言)
    ➤ AI 文字转语音(400+声音)
    ➤ 零样本声音克隆
    ➤ 人声与背景音乐分离
    ➤ 视频下载与字幕生成
    ➤ 多语言翻译配音
    ➤ 本地运行,支持离线使用

    ⚙️ 运行环境:

    ➤ 推荐 NVIDIA 显卡
    ➤ Windows 支持双击 start.bat 安装
    ➤ 免费使用,无订阅限制

    🔗 项目地址:

    https://github.com/abus-aikorea/voice-pro

    📂 #Windows #AI #语音工具 #声音克隆 #开源项目
  3. 🎙 Voice Clone Studio

    📦 AI语音工具 | 语音克隆 | 开源项目

    ➤ AI 语音克隆与生成工具
    ➤ 支持音频样本声音克隆
    ➤ 支持语音转换与声音生成
    ➤ 支持语音转文字(STT)
    ➤ 支持音效处理
    ➤ 支持多说话人模式
    ➤ 集成多种 TTS 与语音 AI 模型
    ➤ 支持 Qwen3-TTS、VibeVoice、Chatterbox、Fish Speech、LuxTTS 等模型
    ➤ 基于 Gradio 开发


    📌 简单说:
    👉 Voice Clone Studio 是一个开源 AI 语音处理平台,将语音克隆、TTS 生成、声音转换和语音识别等功能整合到一个界面中,适合 AI 配音、语音实验和创作使用。

    🔗 项目地址:
    https://github.com/FranckyB/Voice-Clone-Studio

    📂 #GitHub #AI语音 #TTS #语音克隆 #开源项目
  4. 🤖 Vibe

    📦 AI 转录 | 本地工具 | 开源项目


    ➤ 音频、视频一键转换为文本
    ➤ 支持本地 Whisper 模型
    ➤ 支持 Nemotron 3.5 与 Parakeet TDT v3 模型
    ➤ 所有数据保存在本地电脑
    ➤ 注重隐私安全,无需上传文件
    ➤ 支持多说话人语音识别
    ➤ 自动生成文字转录结果
    ➤ 支持 SRT 字幕格式
    ➤ 支持 VTT、TXT、HTML、PDF
    ➤ 支持 JSON、DOCX 导出
    ➤ 支持 macOS、Windows、Linux
    ➤ 开源免费项目



    📌 简单说:
    👉 Vibe 是一款本地 AI 语音转文字工具,支持多种语音识别模型,可将音频和视频快速转换为字幕或文本文件,全程本地处理,保护隐私。

    🔗 项目地址:
    https://github.com/thewh1teagle/vibe

    📂 #AI #语音转文字 #Whisper #字幕工具 #开源项目
  5. 🔁 Voicebox
    📦 AI语音工具 | 本地语音转文字 | 开源项目


    语音转文字|支持本地离线 ASR 识别
    ➤ 多模型支持|兼容 Whisper / Faster-Whisper
    ➤ 音频转录|支持 MP3 / WAV / M4A 等格式
    ➤ 字幕生成|自动生成 SRT 字幕文件
    ➤ 本地运行|注重隐私 无需上传云端
    ➤ 开源免费|跨平台桌面应用



    🌐 项目地址:
    https://github.com/jamiepine/voicebox

    📌 简单说:
    👉 一个开源的本地 AI 转录工具,可快速把音频视频转换成字幕与文本。

    ———— 商务合作————

    📂 #AI工具 #语音转文字 #Whisper #开源项目
    📁 Windows / AI工具
  6. 🔁 VibeVoice
    📦 开源项目 | GitHub | AI语音生成 + 识别


    ➤ 长音频识别|支持最长60分钟语音转文字(ASR)
    ➤ 结构化转录|自动识别说话人 + 时间戳 + 内容
    ➤ 多人语音生成|支持最多4人对话语音(TTS)
    ➤ 超长语音|可生成最长约90分钟连续音频
    ➤ 实时语音|支持低延迟流式TTS输出
    ➤ 多语言支持|覆盖50+语言识别能力
    ➤ 开源研究|适合开发与语音AI实验


    🌐 项目:
    https://github.com/microsoft/VibeVoice

    ———— 商务合作————

    📂 #AI工具 #语音AI #开源项目 #TTS #ASR
    📁 Windows / 开发工具
  7. 💥 Ultimate TTS Studio|终极 TTS 语音合成软件
    推荐:一站式文本转语音解决方案,适合配音、旁白与内容创作。

    🟢 项目核心亮点:


    高质量 TTS: 🗣 将文本快速转换为自然语音
    多场景适用: 🎙 旁白、配音、有声内容制作
    操作简单: 🖱 界面直观,上手门槛低
    效率优先: ⚡️ 批量处理,节省时间
    创作者友好: 🎧 适合自媒体与内容生产


    想把文字变成声音,这是一个很省心的工具。

    🌐 项目链接:
    ❤️ 点击直达

    频道 | 💬 群组 | 📬 投稿 | 📨 商务

    #TTS #语音合成 #AI工具 #配音软件
  8. 🎙 LazyTyper | 懒人打字神器,基于 Whisper 的语音输入法

    🔥 还在为了打字手酸?这款体积仅几 MB 的小工具,利用 OpenAI Whisper 模型,让你的语音转文字快如闪电!

    💎 核心亮点:

    超高准确率: 🧠 基于强大的 Whisper 模型,识别准确率高达 90% 以上。
    多语言混输: 🌍 真正支持中、英、日、韩无缝混合说,再也不用手动切换语言。
    极致轻量化: 🪶 体积仅个位数 MB,内存占用极低,旧电脑也能跑得飞起。
    完全免费: 🆓 支持 Windows & macOS 双平台,无内购,无广告。

    📢 社区反馈:
    在 V2EX 论坛引起热议,网友评价极高,被称为“只有几M的生产力怪兽”。

    📥 官网下载 (Win/Mac)
    🔗 查看 V2EX 原帖讨论

    频道 | 💬 群组 | 📬 投稿 | 📨 商务

    #AI #语音输入 #效率工具 #Whisper #LazyTyper
  9. #语音转文字 #软件
    语音视频转字幕srt、txt软件
    使用必剪API,语音转字幕。
    支持输入视频文件自动提取音频(ffmpeg)
    支持拖动添加文件
    支持多视频/语音文件的一次性转录
    运行需要安装.NET 6 Runtime和ffmpeg
    下载:https://github.com/Forgot-Dream/STS-Bcut/releases
    蓝奏云:https://noise.lanzoul.com/irLuU0rwx36h
    📡发布:https://noisevip.cn/16116.html
    📢关注频道:@quanshoulu
    💬留言讨论:@Efficiencyfollow
    📬投稿bot:@noisewowbot
    📇搜索bot:@Efficiencysearchbot
    🎁访问主页: www.noisework.cn