Skip to main content
全网优质资源汇总✨

Search: #AI语音

  1. 🎬 Concat v0.2.1 — CapCut 开源免费替代品
    📦 视频编辑 | 开源项目 | 多平台


    ➤ 开源且完全免费
    ➤ 无水印,无需注册账户
    ➤ 完全本地处理,注重隐私
    ➤ 支持多层、多时间线编辑
    ➤ 支持视频剪切、分割、合并与变速
    ➤ 支持转场与关键帧
    ➤ 支持样式化文本与标题
    ➤ 支持本地自动字幕
    ➤ 支持文本转语音(TTS)
    ➤ 支持音频滤镜与模板
    ➤ 最高支持 4K 视频输出
    ➤ Windows / macOS / Linux
    ➤ Android / iOS / iPadOS
    ➤ 支持 ARM64 与 x86_64 架构

    📌 简单说:
    👉 Concat 是一款开源免费的跨平台视频编辑器,主打本地处理、无水印和无需账户,可作为 CapCut 的开源替代方案。

    ⚠️ 注意:
    ➤ 当前版本为 v0.2.1,项目仍处于 Beta 测试阶段,部分功能可能存在不稳定情况。

    🔗 GitHub:
    项目源码

    📥 下载:
    最新版本

    📂 #Concat #视频编辑 #CapCut #开源项目 #免费软件 #无水印 #视频剪辑 #AI字幕 #TTS
  2. 🎙️ Abogen — 免费开源 AI 文本转语音工具
    📦 TTS | AI语音 | 开源项目

    ➤ 免费且开源
    ➤ 使用 KokoroTTS 模型进行语音合成
    ➤ 可将多页文本快速转换为音频文件
    ➤ 支持多种语言
    ➤ 支持创建自定义语音
    ➤ 安装简单,配置方便
    ➤ 源代码完全公开
    ➤ 全部功能免费使用
    ➤ 适合学习英语
    ➤ 适合制作播客及有声内容


    📌 简单说:
    👉 Abogen 是一款基于 KokoroTTS 的免费开源文本转语音工具,可以快速将长篇文本转换成音频,并支持多语言与自定义语音。

    🔗 GitHub:
    项目源码

    📂 #Abogen #TTS #AI语音 #文本转语音 #KokoroTTS #开源项目 #播客 #英语学习
  3. 🦆 Duck.ai — 免费且注重隐私的 AI 助手
    📦 AI 助手 | 在线工具 | 隐私保护

    ➤ 无需注册账号
    ➤ 无需登录
    ➤ 支持 AI 聊天
    ➤ 支持网页搜索
    ➤ 支持 GPT-5.6 Luna
    ➤ 支持 GPT Image 2 AI 生图
    ➤ 支持 AI 语音聊天
    ➤ 可用于提问、搜索与研究
    ➤ 支持图像创作
    ➤ 注重用户隐私

    📌 简单说:
    👉 Duck.ai 是一个无需注册即可使用的在线 AI 工具,集 AI 对话、网页搜索、图像生成和语音聊天等功能于一体,适合想快速体验多种 AI 能力并注重隐私的用户。

    🌐 网站:
    Duck.ai

    📂 #DuckAI #AI 助手 #GPT #AI 生图 #AI 语音 #网页搜索 #隐私 #AI 工具 #TOOLS
  4. 🔥 50 个免费 AI Provider — 免费使用 Claude Code、Codex、Pi 等
    📦 AI工具 | 开源项目 | 免费资源


    ➤ 汇集 50 个免费 AI Provider
    ➤ 提供超过 13 亿个免费 Token
    ➤ 支持 Claude Code
    ➤ 支持 Codex、Pi、OpenCode 等工具
    ➤ 支持多种 AI 模型
    ➤ 可在终端中使用
    ➤ 支持 IDE 与应用程序
    ➤ 支持手机端使用
    ➤ 支持 OpenClaw
    ➤ 支持语音功能
    ➤ 项目遵循相关服务条款


    📌 简单说:
    👉 这是一个汇集免费 AI Provider 的开源项目,可为 Claude Code、Codex、Pi、OpenCode 等工具提供免费模型与 Token 资源,支持终端、IDE、应用及手机等多种使用方式。

    🔗 项目地址:
    GitHub

    📂 #ClaudeCode #Codex #OpenCode #Pi #AI #免费AI #开源项目 #AI工具
  5. 🤖 Autonomous OS — 让机器人真正拥有自主智能
    📦 机器人系统 | Agentic AI | 开源项目


    ➤ 开源机器人操作系统
    ➤ 视觉、听觉与决策能力本地运行
    ➤ 内置 Agentic 推理引擎
    ➤ 支持 Hermes、Claude Code 等运行时
    ➤ 支持模型、语音、主板和技能自由替换
    ROBOT.md / SOUL.md / SAFETY.md / SKILL.md 四文件定义机器人
    ➤ 自动学习并从历史对话中积累经验
    ➤ 支持创建和扩展自定义 Skills
    ➤ 提供 Skill Store 技能生态
    ➤ 支持人脸识别、跟随、情绪感知、智能家居控制等能力
    ➤ 支持 Autonomous Lamp、Reachy Mini、Intern 等机器人
    ➤ 支持多机器人协作与交互


    📌 简单说:
    👉 Autonomous OS 是一个面向机器人的开源 AI 操作系统,通过 Agentic AI 将视觉、听觉、推理和行动能力结合起来,让机器人能够自主完成任务,而不只是执行固定脚本或接受遥控。

    🔗 项目地址:
    GitHub

    📂 #AutonomousOS #AgenticAI #开源机器人 #自主智能 #AI原生硬件 #机器人
  6. 🎬 MoneyPrinterTurbo — AI 自动视频生成工具
    📦 AI工具 | 视频创作 | 开源项目


    ➤ 使用 AI 自动生成短视频内容
    ➤ 根据主题或关键词生成视频文案
    ➤ 自动选择并组合视频素材
    ➤ 自动生成字幕
    ➤ 支持文本转语音(TTS)
    ➤ 自动添加背景音乐
    ➤ 支持 9:16 竖屏视频格式
    ➤ 支持 16:9 横屏视频格式
    ➤ 支持批量生成多个视频
    ➤ 提供 WebUI 和 API 接口
    ➤ 支持 Windows、macOS、Linux、Docker 和 Google Colab


    📌 简单说:
    👉 MoneyPrinterTurbo 是一个开源 AI 视频生成项目,只需输入主题或关键词,即可自动完成文案、素材、字幕、配音和音乐生成,快速制作适合社交平台发布的短视频。

    🔗 项目地址:
    GitHub

    ⬇️ 版本下载:
    Releases

    📂 #MoneyPrinterTurbo #AI视频 #AIGC #视频生成 #开源项目
  7. 🔥 热门 GitHub 开源项目精选
    📦 开源项目 | GitHub | 工具合集


    OpenCut|开源视频编辑器
    ➤ CapCut 替代方案,无需账号即可编辑视频
    84K | TypeScript
    🔗 github.com/OpenCut-app/OpenCut

    Immich|自托管照片管理平台
    ➤ Google 相册替代方案,支持照片视频存储、智能搜索、人脸识别
    111K | TypeScript
    🔗 github.com/immich-app/immich

    MoneyPrinterTurbo|AI 自动生成短视频
    ➤ 输入主题即可生成包含文字、音频、图片和字幕的视频
    107K | Python
    🔗 github.com/harry0703/MoneyPrinterTurbo

    Career Ops|AI 求职助手
    ➤ 聚合招聘信息,并通过 AI 匹配技能与岗位
    65K | JavaScript
    🔗 github.com/santifer/career-ops

    Motrix|开源下载工具
    ➤ 支持 BT、HTTP、FTP、Magnet 等多种协议
    53K | TypeScript
    🔗 github.com/agalwood/Motrix

    llmfit|本地 AI 模型检测工具
    ➤ 一条命令检测哪些 AI 模型适合你的硬件运行
    32.5K
    🔗 github.com/AlexsJones/llmfit

    Soup|轻量模型微调工具
    ➤ 使用 YAML 配置即可微调语言模型
    1.8K | Python
    🔗 github.com/MakazhanAlpamys/Soup

    CLI-Anything|AI 控制桌面软件工具
    ➤ 将 GIMP、LibreOffice、Blender 等转换为 AI 可调用 CLI
    47.6K | Python
    🔗 github.com/HKUDS/CLI-Anything

    Spec Kit|规范驱动开发工具
    ➤ GitHub 官方推出,帮助 AI 根据详细规范编写代码
    129K | Python
    🔗 github.com/github/spec-kit

    Nautilus Trader|算法交易引擎
    ➤ Rust 开发的高性能事件驱动交易框架
    26K
    🔗 github.com/nautechsystems/nautilus_trader

    Public APIs|免费 API 集合
    ➤ 收录天气、货币、电影、新闻等大量 API 资源
    462K | Python
    🔗 github.com/public-apis/public-apis


    📌 简单说:
    👉 本期精选 11 个热门 GitHub 项目,覆盖 AI、视频编辑、照片管理、自动化、下载工具、本地模型、开发工具和数据 API 等领域,适合开发者和科技爱好者收藏。

    📂 #GitHub #开源项目 #AI工具 #开发工具 #软件推荐 #技术资源
  8. 🎙 Voice-Pro
    📦 AI语音工具 | Windows | 开源项目


    ➤ 免费开源 Gradio 语音处理工具
    ➤ 支持 Whisper / Faster-Whisper 语音识别
    ➤ 支持 Edge-TTS、Kokoro、CosyVoice 文字转语音
    ➤ 支持 F5-TTS、E2-TTS、CosyVoice 声音克隆
    ➤ 支持 Demucs 人声分离
    ➤ 支持 YouTube 下载与音频处理
    ➤ 支持多语言翻译与 AI 配音
    ➤ 一站式完成转文字、翻译、重新配音


    📌 简单说:
    👉 Voice-Pro 是一款本地运行的全能 AI 语音工具,将语音识别、文字转语音、声音克隆、人声分离、视频翻译配音等功能整合在一起,适合视频创作者、播客制作和 AI 配音用户。

    🆕 主要功能:

    ➤ AI 语音识别(90+语言)
    ➤ AI 文字转语音(400+声音)
    ➤ 零样本声音克隆
    ➤ 人声与背景音乐分离
    ➤ 视频下载与字幕生成
    ➤ 多语言翻译配音
    ➤ 本地运行,支持离线使用

    ⚙️ 运行环境:

    ➤ 推荐 NVIDIA 显卡
    ➤ Windows 支持双击 start.bat 安装
    ➤ 免费使用,无订阅限制

    🔗 项目地址:

    https://github.com/abus-aikorea/voice-pro

    📂 #Windows #AI #语音工具 #声音克隆 #开源项目
  9. 🎙 Voice Clone Studio

    📦 AI语音工具 | 语音克隆 | 开源项目

    ➤ AI 语音克隆与生成工具
    ➤ 支持音频样本声音克隆
    ➤ 支持语音转换与声音生成
    ➤ 支持语音转文字(STT)
    ➤ 支持音效处理
    ➤ 支持多说话人模式
    ➤ 集成多种 TTS 与语音 AI 模型
    ➤ 支持 Qwen3-TTS、VibeVoice、Chatterbox、Fish Speech、LuxTTS 等模型
    ➤ 基于 Gradio 开发


    📌 简单说:
    👉 Voice Clone Studio 是一个开源 AI 语音处理平台,将语音克隆、TTS 生成、声音转换和语音识别等功能整合到一个界面中,适合 AI 配音、语音实验和创作使用。

    🔗 项目地址:
    https://github.com/FranckyB/Voice-Clone-Studio

    📂 #GitHub #AI语音 #TTS #语音克隆 #开源项目
  10. 🤖 ChatGPT Premium v1.2026.202(25)

    📦 AI助手 | Android | 高级版

    ➤ 高级功能已解锁
    ➤ 支持多种 AI 模型
    ➤ 高级语音模式
    ➤ AI 图像生成功能
    ➤ 支持文件上传功能
    ➤ 无限畅聊体验
    ➤ 广告已移除
    ➤ 优化资源加载
    ➤ 移除调试信息
    ➤ 支持 arm64v8a / armeabi-v7a 架构


    ⚠️ 使用提示:
    👉 首次使用建议先从 Google Play 安装官方版本并完成登录。
    👉 登录成功后卸载官方版本,再安装此高级版 APK。
    👉 如遇其他问题,请看这期说明 https://t.me/pgkj666/3509

    👉 资源获取:BPS下载站

    📌 简单说:
    👉 ChatGPT Android 高级版,提供 AI 智能对话、语音交流、图像生成、文件分析等功能,优化使用体验,支持多设备运行。

    📂 #Android #AI #ChatGPT #GPT #高级版
  11. 🎙 LivDub

    📦 AI配音工具 | 浏览器扩展 | AI翻译

    ➤ 实时翻译并配音浏览器视频
    ➤ 基于 Chromium 扩展运行
    ➤ 使用 Gemini Live 实现实时语音翻译
    ➤ 支持 78+ 种语言
    ➤ 支持 YouTube、课程、采访、直播等场景
    ➤ 边看视频边听目标语言配音
    ➤ 支持 Android 浏览器扩展使用


    📌 简单说:
    👉 LivDub 是一款 AI 实时配音工具,可以将浏览器中的外语视频实时翻译并生成语音,让你无需看字幕也能听懂国外视频内容。

    🌐 支持浏览器:
    ➤ Cromite
    ➤ Helium Browser
    ➤ Ultimatum
    ➤ Quetta Browser
    ➤ Yandex Browser

    ⚙️ 使用方式:
    👉 安装支持扩展的 Chromium 浏览器
    👉 安装 LivDub 扩展
    👉 配置 Gemini API Key
    👉 打开外语视频即可实时翻译配音

    🔗 官网:
    https://livdub.com/

    🔗 Chrome 扩展:
    https://chromewebstore.google.com/detail/egoacpkbpnnjfebaadejafadmocfhenp

    🔑 Gemini API:
    https://aistudio.google.com/api-keys

    📂 #AI #Gemini #翻译工具 #AI配音 #浏览器插件 #开源工具
  12. Duo Translator

    AI驱动的翻译和写作助手。支持网页翻译、划词翻译、写作增强等。
    网页翻译:

    1. 双语排版格式,更好的理解原文内容,提升阅读体验。
    2. 通过悬浮球、快捷键、右键菜单快速翻译和恢复页面。
    3. 支持检测页面语言,自动翻译。
    4. 定义译文样式,支持背景颜色,字体颜色,边框样式、边框颜色。

    双语对照高亮:

    1. 原文和译文逐句对照高亮,更好的理解长文本,快速定位复杂难懂和翻译失真的句子。
    2. 光标移动到原文或译文上即可触发。
    3. 定义高亮样式,支持边框样式、边框颜色、背景颜色,字体颜色。

    段落翻译和划词翻译

    1. 无需手动选择整段文字,快速翻译任意段落。
    2. 划词翻译支持原文和译文的发音和快捷复制。
    3. 双击Ctrl/Alt、快捷键、右键菜单即可触发。

    AI 写作

    1. 输入框中快速完成语法纠错、润色、翻译等操作。
    2. 支持白名单模式,只在您需要的网站上启用。
    3. 通过打开单独的AI工作台,更方便的编辑长文本,检查输出内容。

    视频字幕
    1. YouTube 双语字幕。
    2. 自定义字幕样式。

    接入多种翻译和AI服务

    1. 内置了翻译服务Microsoft、Google、DeepL。
    2. AI服务支持OpenAI、DeepSeek、Gemini、OpenRouter、Claude、Ollama、自定义。


    项目地址 | Chrome 应用商店 | Edge 扩展

    #开源 #浏览器扩展 #AI翻译
  13. 🤖 FreeCut

    📦 视频编辑 | AI 工具 | 开源项目


    ➤ 浏览器即可使用,无需安装
    ➤ 专业多轨时间轴编辑
    ➤ 支持视频、音频、字幕、图片、形状与蒙版
    ➤ GPU 加速视觉特效
    ➤ 提供多种专业转场效果
    ➤ 支持关键帧动画与曲线编辑
    ➤ 内置音频编辑工具
    ➤ 本地 AI 自动生成字幕
    ➤ AI 自动场景检测
    ➤ AI 文本转语音(TTS)
    ➤ AI 音乐生成
    ➤ 支持 MP4、WebM、MOV、MKV 导出
    ➤ 所有文件本地处理,保护隐私
    ➤ 支持安装为桌面 /PWA 应用
    ➤ 完全免费开源



    📌 简单说:
    👉 FreeCut 是一款开源 AI 视频编辑器,无需下载安装即可在浏览器中使用,支持多轨剪辑、AI 字幕、自动场景检测、AI 配音、AI 音乐生成等功能,所有数据均在本地处理,兼顾专业剪辑与隐私安全。

    ⚠️ 注意:
    ➤ 当前仍处于 Beta 测试阶段  
    ➤ 部分功能可能存在 Bug 或持续优化中  

    🔗 官方网站:
    https://freecut.net

    🔗 项目地址:
    https://github.com/walterlow/freecut

    📂 #AI #视频编辑 #FreeCut #AI 字幕 #开源项目
  14. 📢导航站收录更新通知!
    #AI·音乐 #AI新时代
    站点名称: AI歌曲生成器
    描述: Songvora是一款AI音乐生成工具,可根据用户提供的名字、回忆和讯息,创作出个性化的完整歌曲,支持多语言及多种音乐风格。
    链接: https://songvora.com/
    前往导航: www.noisedh.cnwww.noisedh.link
  15. 🤖 CapSlap

    📦 AI 字幕 | 视频工具 | 开源项目


    ➤ AI 自动识别语音并生成字幕
    ➤ 自动将字幕嵌入视频画面
    ➤ 支持本地 Whisper 模型离线运行
    ➤ 无需联网或 API Key
    ➤ 可选接入 OpenAI API
    ➤ 支持多语言字幕识别
    ➤ 适用于短视频、Reels、音乐视频等场景
    ➤ 自动处理 FFmpeg(macOS)
    ➤ 开源免费,无广告
    ➤ 数据可本地处理,保护隐私



    📌 简单说:
    👉 CapSlap 是一款开源 AI 自动字幕工具,可利用本地 Whisper 模型离线识别语音,并将字幕直接烧录到视频中,非常适合制作短视频、Instagram Reels、TikTok 等平台内容。

    ⚙️ 注意事项:
    ➤ 当前暂无现成安装包  
    ➤ 需通过源码编译安装(Rust + Bun) 
    ➤ 更适合有一定开发基础的用户  

    🔗 项目地址:
    https://github.com/riseandignite/capslap

    🌐 官方网站:
    https://capslapapp.com

    📂 #AI 字幕 #Whisper #视频编辑 #开源项目 #自动字幕
  16. 🤖 Vibe

    📦 AI 转录 | 本地工具 | 开源项目


    ➤ 音频、视频一键转换为文本
    ➤ 支持本地 Whisper 模型
    ➤ 支持 Nemotron 3.5 与 Parakeet TDT v3 模型
    ➤ 所有数据保存在本地电脑
    ➤ 注重隐私安全,无需上传文件
    ➤ 支持多说话人语音识别
    ➤ 自动生成文字转录结果
    ➤ 支持 SRT 字幕格式
    ➤ 支持 VTT、TXT、HTML、PDF
    ➤ 支持 JSON、DOCX 导出
    ➤ 支持 macOS、Windows、Linux
    ➤ 开源免费项目



    📌 简单说:
    👉 Vibe 是一款本地 AI 语音转文字工具,支持多种语音识别模型,可将音频和视频快速转换为字幕或文本文件,全程本地处理,保护隐私。

    🔗 项目地址:
    https://github.com/thewh1teagle/vibe

    📂 #AI #语音转文字 #Whisper #字幕工具 #开源项目
  17. 🤖 Audiblez

    📦 AI 有声书 | 电子书转换 | 开源项目


    ➤ 一键将电子书转换为有声书
    ➤ 支持 EPUB 格式电子书
    ➤ 自动生成 M4B 有声书文件
    ➤ 使用 Kokoro-82M AI 语音合成模型
    ➤ 支持多种语言和自然语音效果
    ➤ 支持中文、英文、日文等语言
    ➤ 支持多种 AI 配音声音选择
    ➤ 支持章节自动拆分
    ➤ 支持 CUDA GPU 加速
    ➤ 提供命令行和图形界面版本
    ➤ 支持 Windows、macOS、Linux
    ➤ MIT 开源协议,免费使用


    📌 简单说:
    👉 Audiblez 是一款 AI 电子书转有声书工具,可以将 EPUB 书籍自动转换为带章节的 M4B 音频文件,利用 AI 语音生成自然朗读效果,让普通电子书变成可收听的有声书。

    🔗 项目地址:
    https://github.com/santinic/audiblez

    📂 #AI #有声书 #TTS #电子书 #开源项目
  18. AI Agent Skills 技能

    243 个 AI Agent 技能,包括 182 个官方技能与 61 个本地技能,覆盖内容创作、视频生成、语音合成、文档处理、数据分析、安全审计、机器学习、云服务等 14 大分类。本地技能中包含多智能体协作的视频创作、智能内容系统、音色克隆、PPT/Excel/Word/PDF 全套处理等高频实用工具;官方技能则由 Anthropic、Trail of Bits、Hugging Face、Vercel、Cloudflare、Sentry 等顶级团队提供,涵盖从安全审计到模型训练、React/Next.js 最佳实践、云服务与代码审查等专业能力,是一个覆盖广泛、结构清晰的 AI 技能大全。

    点击浏览

    #skills #AI技能
  19. 🤖 🔁 Awesome LLM Apps

    📦 AI应用合集 | AI Agent | RAG


    ➤ 收录 100+ 开源 AI 项目
    ➤ 包含 AI Agent、RAG、MCP、语音 AI
    ➤ 支持 Claude、Gemini、OpenAI、Qwen、Llama 等模型
    ➤ 提供完整源码与部署示例
    ➤ 免费开源,持续更新

    🌐 GitHub:
    https://github.com/Shubhamsaboo/awesome-llm-apps

    📌 简单说:
    👉 一个高质量的 AI Agent 与 RAG 项目合集,适合学习、开发和快速搭建自己的 LLM 应用。

    📂 #AI #LLM #Agent #RAG #MCP #开源
  20. 🤖 🔁 Claude v1.260618.10

    📦 AI聊天 | Android | 高级版

    ➤ 已解锁长期订阅
    ➤ 支持扩展思考(Extended Thinking)
    ➤ 支持 AI 语音聊天
    ➤ 支持 Claude Sonnet、Haiku 系列模型
    ➤ 已禁用分析、崩溃报告及广告
    ➤ 优化 APK,兼容新版 Android

    ⚠️ 注意:

    ➤ 使用邮箱登录
    ➤ 部分高级功能由服务器控制,可能无法使用
    ➤ 第三方修改版,请自行甄别安全性与来源


    👉 资源获取:BPS下载站

    📌 简单说:
    👉 Claude Android 高级修改版,已解锁部分高级功能,支持扩展思考、语音聊天及最新 Claude 模型。

    📂 #Android #Claude #AI #高级版
  21. 📢导航站收录更新通知!
    #AI·视频 #AI新时代
    站点名称: Mivid AI 文本转视频生成器
    描述: Mivid AI 是一个一站式AI视频与图像创作平台,支持从脚本、图像、语音到视频的全流程生成,帮助用户快速制作高质量短视频并实现变现。
    链接: https://www.mivid.ai/
    前往导航: www.noisedh.cnwww.noisedh.link
  22. 📢导航站收录更新通知!
    #AI·模型+平台 #AI新时代
    站点名称: Atlas Cloud 全模态 AI 平台
    描述: Atlas Cloud 为开发者提供对话、图像、视频、语音等统一 API,支持 Seedance、HappyHorse 等最新模型,速度翻倍成本减半。
    链接: https://www.atlascloud.ai?ref=CMGHPV
    前往导航: www.noisedh.cnwww.noisedh.link 400+ AI Models, One API for Image, Video, Audio and Chat | Atlas Cloud
  23. 📢导航站收录更新通知!
    #AI·视频 #AI新时代
    站点名称: AI唇形同步视频生成器
    描述: 免费在线AI工具,上传照片或视频并添加音频,两分钟内自动生成唇形同步的说话视频,支持30多种语言且无水印。
    链接: https://lipsyncvideo.studio/
    前往导航: www.noisedh.cnwww.noisedh.link Lip Sync Video Generator | Free Online AI Tool
  24. VoxCPM |基于连续表征的多语言语音合成、创意音色设计与高保真声音克隆

    一个无离散音频分词器(Tokenizer-Free)的语音合成系统,通过端到端的扩散自回归架构直接生成连续语音表征,绕过对音频的离散编码步骤,实现高度自然且富有表现力的语音合成。
    🌍 30种语言语音合成 — 直接输入原始文本即可合成(支持语言详见下文),无需额外语言标签
    🎨 音色设计 — 用自然语言描述(性别、年龄、音色、情绪、语速……)凭空创建全新音色,无需参考音频
    🎛 可控声音克隆 — 从参考音频片段克隆任意声音,可叠加风格指令控制情绪、语速和表现力,同时保持原始音色
    🎙 极致克隆 — 提供参考音频及其文本内容,模型接着参考音频进行无缝续写,从而精准还原声音细节特征(与 VoxCPM1.5 一致)
    🔊 48kHz 高质量音频 — 输入 16kHz 参考音频,通过 AudioVAE V2 的非对称编解码设计直接输出 48kHz 高质量音频,内置超分能力
    🧠 语境感知合成 — 根据文本内容自动推断合适的韵律和表现力
    ⚡️ 实时流式合成 — 在 NVIDIA RTX 4090 上 RTF 低至 ~0.3,通过 Nano-vLLM 或 vLLM-Omni(官方 vLLM 全模态服务,原生支持 VoxCPM2,提供 PagedAttention 与 OpenAI 兼容 API)加速后可达 ~0.13
    📜 完全开源,商用就绪 — 权重和代码基于 Apache-2.0 协议发布,免费商用


    项目地址

    #开源 #声音克隆 #AI语音 #本地部署 #VoxCPM #语音合成
  25. #语音克隆 #AI语音 #AI
    X Voice 一键 AI 语音克隆工具使用指南与功能介绍
    **X-Voice**是一款基于流程匹配的多语言文本转语音系统,使一名说话者能够使用30种语言。 环境依赖python,支持跨平台使用,优先N卡使用 ### **安装 X-Voice** 检查你的 ESpeak-ng 安装: 如果找不到,先运行 。 开源:https://github.com/sunnyxrxrx/X-Voice 网盘链接:https://pan.quark.cn/s/ecc563877898
    📢关注频道:@quanshoulu
    🎁访问主页: www.noisework.cn
  26. #VoxCPM2 #语音合成 #AI
    VoxCPM整合包
    VoxCPM 是一个支持中英文、零样本语音克隆、情感可控、音素/公式输入的统一端到端语音合成大模型。它不依赖传统 TTS 流水线(如文本分析 → 音素对齐 → 声码器),而是直接从文本生成高质量语音波形 新版本新增特性: 1.UI颠覆性重构,主要体现在:场景从"语音克隆"+"语音设计"分为"简单场景"+"复杂场景",复杂场景中均支持可控克隆和极致克隆两种方式,适用于不同诉求。特别注意的是Excel中模板根据不同场景拆分为两个,且字段含义不同。 2.新增了api调用及详细说明文档。 3.音色设计页面UI美化,并引入了文本替换 链接:https://pan.quark.cn/s/5ef0eeb56fba
    📢关注频道:@quanshoulu
    🎁访问主页: www.noisework.cn
  27. 📢导航站收录更新通知!
    #AI·视频 #AI新时代
    站点名称: A2E AI
    描述: A2E AI提供免费的AI视频工具集,包括图片转视频、换脸、换头、唇形同步、语音克隆和AI虚拟形象,无需信用卡即可使用。
    链接: https://a2e.ai/
    前往导航: www.noisedh.cnwww.noisedh.link A2E Free, Personal AI Videos
  28. 📢导航站收录更新通知!
    #AI·工具集 #AI新时代
    站点名称: 妙趣 OpenClaw
    描述: 全网最好玩的 OpenClaw 玩法指南。浏览器自动化、语音唤醒、Canvas 创意、多平台消息同步,让你的 AI Agent 真正动起来!
    链接: https://miaoquai.com/
    前往导航: www.noisedh.cnwww.noisedh.link
  29. AIGCPanel

    一款简单易用的一站式AI数字人系统,即使是小白用户也能轻松上手。它集成了视频合成、语音合成、语音克隆等核心功能,大大简化了本地AI模型的管理流程,支持一键导入和使用各种AI模型,让AI创作变得触手可及。
    视频数字人合成:支持视频画面与声音的精准换口型匹配,打造逼真数字人效果
    语音处理:提供语音合成、语音克隆、视频声音替换功能,支持多种声音参数自定义设置
    模型管理:支持多模型导入、一键启动、模型配置、日志查看等便捷操作
    国际化支持:内置简体中文和英语界面,满足不同用户需求
    一键启动包:提供多种模型的一键启动包,快速部署和使用


    点击访问

    #开源 #AI数字人 #电脑软件 #AI直播
  30. 📢导航站收录更新通知!
    #AI·音乐 #AI新时代
    站点名称: ACE Studio 2.0 - AI音乐制作工具包 | AI歌声合成与智能编曲
    描述: 最强大的AI音乐创作工具。AI歌声合成、智能乐器、生成式编曲套件,140+免版税音色,支持8种语言,专为音乐制作人打造。
    链接: https://acestudio.ai/zh/
    前往导航: www.noisedh.cnwww.noisedh.link
  31. 📢导航站收录更新通知!
    #AI·视频 #AI新时代
    站点名称: Wav2Lip
    描述: 使用Wav2Lip生成逼真的对嘴视频,确保准确的口型同步。尝试免费的Wav2Lip在线工具,打造完美的语音转口型动画。
    链接: https://www.wav2lip.org/zh
    前往导航: www.noisedh.cnwww.noisedh.link Wav2Lip:免费的真实口型同步工具
  32. 📢导航站收录更新通知!
    #AI·视频 #AI新时代
    站点名称: Video to Article
    描述: 只需粘贴 YouTube 链接或上传视频/音频文件,即可在线生成任意语言的即用型文章——一键操作,无需写作,无需编辑,无需任何配置。
    链接: https://videotoarticle.org/zh
    前往导航: www.noisedh.cnwww.noisedh.link 视频转文章工具 - 用 AI 将 YouTube 视频转为博客文章 | 免费试用
  33. 短视频工厂

    一个开源的桌面端应用,旨在通过AI技术简化短视频的制作流程。用户可以通过简单的提示词文本+视频分镜素材,快速且自动的剪辑出高质量的产品营销和泛内容短视频。该项目集成了AI驱动的文案生成、语音合成、视频剪辑、字幕特效等功能,旨在为用户提供开箱即用的短视频制作体验。

    点击访问

    #电脑软件 #短视频工厂 #AI短视频 #自动剪辑 #批量生成 #文案生成 #语音合成 #开源
  34. Super Agent Party |一款拥有无限可能的3D版AI桌宠!

    无处不在的AI桌面女友!可接入QQ、飞书、telegram、discord、b站、YouTube、twitch、Dify、 Home Assistant、MCP、A2A、Comfyui、酒馆角色卡、Cluade code等生态!
    无缝能力增强:无需代码改造即可实现LLM API企业级升级,为现有模型接口无缝集成知识库、实时联网、永久记忆、代码执行、多模态能力(视觉/绘图/听觉/语音)、自动化能力(控制智能家居、控制浏览器)、深度思考控制与研究等模块化功能,打造可插拔的LLM增强中台。
    全渠道一键部署:支持将智能体配置快速部署至多类终端,已兼容经典聊天界面、QQ官方机器人、B站直播互动、VRM虚拟桌宠等场景,开箱即用。
    生态工具互联:可自由接入第三方智能体与工作流作为工具链(已适配ComfyUI/MCP/A2A等系统),通过agent-party架构实现跨平台能力聚合。
    标准化接口开放:提供OpenAI API兼容接口及MCP协议支持,便于开发者直接对接外部系统,实现智能体能力的快速转接与二次开发。
    全平台兼容适配:覆盖Windows/macOS/Linux原生运行环境,支持Docker容器化部署与Web端云服务,满足多场景技术栈需求。


    点击访问

    #电脑软件 #开源 #AI桌面伴侣
  35. FlyCut Caption - 智能视频字幕裁剪工具

    一个强大的 AI 驱动的视频字幕编辑工具,专注于智能字幕生成、编辑和视频裁剪
    智能语音识别:基于 Whisper 模型的高精度语音转文字,支持多种语言
    可视化字幕编辑:直观的字幕片段选择和删除界面
    实时视频预览:与字幕同步的视频播放器,支持区间播放
    多格式导出:支持 SRT、JSON 字幕格式以及视频文件导出
    字幕样式定制:自定义字幕字体、颜色、位置等样式
    国际化支持:组件化国际化设计,支持中文、英文、自定义语言包(如日语示例)


    项目地址 在线试用

    Ken有话说:对做自媒体的帮孩子很多,从YouTube搬运视频用这个转中文字幕简直无敌


    #开源 #AI字幕 #字幕生成
  36. 文案提取工具,做短视频常用!

    抖音文案
    直接用豆包,它认抖音链接,别的平台不支持


    视频号文案
    微信里搜“元宝”加好友,视频号是主打


    油管文案
    用Google AI Studio,英文、中文、双语视频都能处理


    B站、小红书、西瓜视频等
    用Get笔记,全平台通用,每天免费5次



    📖频道 | 📥投稿 | 商务

    #短视频 #AI
  37. Chaterm

    一款开源的AI 智能终端工具与 SSH 客户端,支持使用自然语言或语音输入执行命令,并提供智能补全、全局语法高亮、可视化编辑、命令别名管理等功能。它能够理解错误信息、分析系统日志、并可跨多个主机并行执行任务,适合运维、SRE 和云资源管理。安全方面整合零信任架构、身份与权限管理、端到端加密、操作审计等企业级保障机制。软件跨平台支持 Windows、macOS 及 Linux

    访问官网

    #跨平台软件 #智能终端 #AI运维
  38. AI Short Video Factory(短视频工厂)

    一款由 YILS-LIN 发起的开源桌面应用,旨在利用 AI 技术简化短视频制作流程。用户只需提供提示词和素材,软件即可自动生成具备营销或泛内容风格的短视频,集成了文案生成、语音合成、视频剪辑、字幕特效等功能,支持 Windows、macOS 和 Linux 平台,操作界面简洁,开箱即用,同时所有处理在本地执行,保障用户数据安全

    项目地址

    #AI短视频 #自动剪辑 #开源 #跨平台软件 #本地运行
  39. Intent

    一款免费的AI增强版Telegram客户端,能在群组与频道内实时精准翻译86种语言。在聊天框中上划,即可由AI根据上下文自动生成回复或精准转录语音;长按消息则可一键调用AI进行智能查询。应用内置了可自由切换的GPT-4o、Claude 3.7及Gemini 2等多种AI模型,并为所有用户提供免费额度,即刻前往官网便可下载安卓与苹果版本体验。

    点击访问 点击访问

    #Intent #AI #Telegram #手机软件
  40. WeClone

    从聊天记录创造数字分身的一站式解决方案 使用微信聊天记录微调大语言模型,让大模型有“那味儿”,并绑定到聊天机器人,实现自己的数字分身。 数字克隆/数字分身/数字永生/声音克隆/LLM/大语言模型/微信聊天机器人/LoRA
    涵盖打造数字分身的全链路方案,包括聊天数据导出、预处理、模型训练、部署

    使用微信聊天记录微调LLM,让大模型有"那味儿"
    绑定到微信、QQ、Telegram、企微、飞书机器人,实现自己的数字分身
    隐私信息过滤,本地化微调部署,数据安全可控

    【项目链接在评论区】

    #开源 #大模型训练 #Ai机器人
  41. Krillin AI

    一款全能型音视频本地化与增强解决方案。这款简约而强大的工具,集音视频翻译、配音、语音克隆于一身,支持横竖屏格式输出,确保在所有主流平台(哔哩哔哩,小红书,抖音,视频号,快手,YouTube,TikTok等)都能完美呈现。通过端到端的工作流程,Krillin AI 仅需点击几次,就能将原始素材转化为精美即用的跨平台内容。

    【下载见评论区】

    #电脑软件 #开源 #Ai #视频配音
  42. AI导航中心

    自部署Ai工具导航页,功能持续增加。目前有写作助手、AI导航聚合页、八字算卦提示词、openai语音生成

    【链接在评论区】

    #Ai
  43. Siri Ultra

    一个能在 iPhone 上使用的 AI 聊天快捷指令,无需下载任何 App,即可体验到最新的大模型。
    通过 Siri 实时语音对话,也可以直接运行快捷指令进行文字对话
    兼容各种大模型,包括 OpenAI、Gemini、DeepSeek 等
    支持联网搜索(需单独配置搜索 key)
    支持网页总结 (链接发给快捷指令即可)

    【链接在评论区】

    #Ai #Deepseek@txwl666 #iOS #开源