Search: #AI字幕生成
-
-
- 🎙 Voice-Pro
📦 AI语音工具 | Windows | 开源项目
📌 简单说:
👉 Voice-Pro 是一款本地运行的全能 AI 语音工具,将语音识别、文字转语音、声音克隆、人声分离、视频翻译配音等功能整合在一起,适合视频创作者、播客制作和 AI 配音用户。
🆕 主要功能:
➤ AI 语音识别(90+语言)
➤ AI 文字转语音(400+声音)
➤ 零样本声音克隆
➤ 人声与背景音乐分离
➤ 视频下载与字幕生成
➤ 多语言翻译配音
➤ 本地运行,支持离线使用
⚙️ 运行环境:
➤ 推荐 NVIDIA 显卡
➤ Windows 支持双击 start.bat 安装
➤ 免费使用,无订阅限制
🔗 项目地址:
https://github.com/abus-aikorea/voice-pro
📂 #Windows #AI #语音工具 #声音克隆 #开源项目 - 🎙 LivDub
📦 AI配音工具 | 浏览器扩展 | AI翻译
📌 简单说:
👉 LivDub 是一款 AI 实时配音工具,可以将浏览器中的外语视频实时翻译并生成语音,让你无需看字幕也能听懂国外视频内容。
🌐 支持浏览器:
➤ Cromite
➤ Helium Browser
➤ Ultimatum
➤ Quetta Browser
➤ Yandex Browser
⚙️ 使用方式:
👉 安装支持扩展的 Chromium 浏览器
👉 安装 LivDub 扩展
👉 配置 Gemini API Key
👉 打开外语视频即可实时翻译配音
🔗 官网:
https://livdub.com/
🔗 Chrome 扩展:
https://chromewebstore.google.com/detail/egoacpkbpnnjfebaadejafadmocfhenp
🔑 Gemini API:
https://aistudio.google.com/api-keys
📂 #AI #Gemini #翻译工具 #AI配音 #浏览器插件 #开源工具 - 🤖 FreeCut
📦 视频编辑 | AI 工具 | 开源项目
📌 简单说:
👉 FreeCut 是一款开源 AI 视频编辑器,无需下载安装即可在浏览器中使用,支持多轨剪辑、AI 字幕、自动场景检测、AI 配音、AI 音乐生成等功能,所有数据均在本地处理,兼顾专业剪辑与隐私安全。
⚠️ 注意:
➤ 当前仍处于 Beta 测试阶段
➤ 部分功能可能存在 Bug 或持续优化中
🔗 官方网站:
https://freecut.net
🔗 项目地址:
https://github.com/walterlow/freecut
📂 #AI #视频编辑 #FreeCut #AI 字幕 #开源项目 - 🤖 CapSlap
📦 AI 字幕 | 视频工具 | 开源项目
📌 简单说:
👉 CapSlap 是一款开源 AI 自动字幕工具,可利用本地 Whisper 模型离线识别语音,并将字幕直接烧录到视频中,非常适合制作短视频、Instagram Reels、TikTok 等平台内容。
⚙️ 注意事项:
➤ 当前暂无现成安装包
➤ 需通过源码编译安装(Rust + Bun)
➤ 更适合有一定开发基础的用户
🔗 项目地址:
https://github.com/riseandignite/capslap
🌐 官方网站:
https://capslapapp.com
📂 #AI 字幕 #Whisper #视频编辑 #开源项目 #自动字幕 - 📢导航站收录更新通知!
#AI·SKILL #AI新时代
站点名称: kbcut
描述: 基于FFmpeg、Whisper和HyperFrames的开源AI剪辑工作流,专为知识博主自动完成口播粗剪、竖屏动态字幕包装和封面生成。
链接: https://github.com/starboom/kbcut
前往导航: www.noisedh.cn 或 www.noisedh.link -
- 📢导航站收录更新通知!
#AI·SKILL #AI新时代
站点名称: tiktok-agent-skills
描述: 利用Codex和KSS MCP,通过自然语言实现TikTok Shop商品选品、店铺分析、爆款视频发现、达人匹配、字幕提取及行动方案生成,支持商品运营、账号增长和内容获客三条运营闭环。
链接: https://github.com/aronhy/tiktok-agent-skills
前往导航: www.noisedh.cn 或 www.noisedh.link - 📢导航站收录更新通知!
#AI·视频 #AI新时代
站点名称: NemoVideo-专业AI视频编辑代理
描述: NemoVideo是一款专业的AI视频编辑代理工具,用户可通过聊天描述创意或上传媒体来快速生成视频,提供爆款模板、智能音频、一键字幕等功能,助力内容创作者制作高传播率的短视频。
链接: https://www.nemovideo.com/zh-CN
前往导航: www.noisedh.cn 或 www.noisedh.link - 📢导航站收录更新通知!
#AI·SKILL #AI新时代
站点名称: 写稿口播自动剪辑Skill
描述: 面向中文写稿口播的Agent剪辑Skill,自动审查重复重录、口误、语气词等,生成精剪时间线并完成字幕、动画、响度处理。
链接: https://github.com/duyi2076/duyi-scripted-video-edit
前往导航: www.noisedh.cn 或 www.noisedh.link - 🎬 🔁 Y2A-Auto
📦 视频自动化搬运 | AI字幕处理 | 多平台发布工具
🌐 GitHub:
https://github.com/fqscfqj/Y2A-Auto
🤖 Telegram Bot:
https://t.me/Y2AAuto_bot
📌 简单说:
👉 Y2A-Auto 是一个 YouTube 自动化内容分发系统,可以完成视频下载、AI字幕生成、翻译、审核、转码以及自动上传到 AcFun 和 bilibili,适合内容创作者和视频运营使用。
⚠️ 注意:
➤ 使用前请确认视频版权和平台规则
➤ 自动搬运内容可能涉及版权问题
➤ 建议用于自己拥有授权或允许转载的视频资源
📂 #AI工具 #视频搬运 #自动化 #YouTube #Bilibili #开源项目 -
-
-
- 🤖 🔁 AI Free Forever
📦 免费AI平台 | 多工具集合 | AI创作工具箱
🌐 官网:
https://aifreeforever.com/zh
📌 简单说:
👉 AI Free Forever 是一个主打“永久免费AI工具”的在线平台,集合了聊天、图像生成、语音处理、转录等多种AI功能,无需注册即可使用部分工具。
📂 #AI工具 #FreeAI #AI生成 #工具合集 #AIFreeForever
📁 AI工具 - 🎬 AI 视频制作智能体
📌 基于 Next.js 的 AI 视频创作工作台
输入一句主题或需求描述,即可自动生成完整视频草稿。
🌐 项目链接:
https://github.com/xuanyuanzhifeng/ai-video-agent
📁 #AI视频 #创作工具 #Nextjs #自动化视频 - 🔁 OpenReel
📦 视频编辑器 | CapCut替代 | 本地离线剪辑
🌐 官网:
https://app.openreel.video/
📌 简单说:
👉 一个开源免费的在线视频编辑器,可直接在浏览器中运行,无需安装软件。支持 AI 自动字幕、文本转语音、本地视频编辑等功能,是 CapCut 的离线替代方案之一。
📂 #视频剪辑 #AI字幕 #CapCut替代 #开源工具
📁 Windows / Mac / Linux / 在线工具 - 🔁 SubStudio
📦 AI字幕生成 | 视频字幕 | 自动转录
🌐 官网:
https://www.usesubstudio.com/
🔑 API Key(如需要):
https://api.together.ai/settings/api-keys
📌 简单说:
👉 一款 AI 视频字幕工具,可自动识别视频语音并生成字幕,适合视频创作者、自媒体和课程制作等场景使用。
📂 #字幕生成 #AI字幕 #视频工具 #Subtitle
📁 在线工具 -
- 🔁 Violin
📦 AI视频翻译 | 自动配音 | 开源工具
➤ 自动翻译视频|识别字幕 + AI翻译 + 配音
➤ 多语言支持|支持 33 种语言
➤ 自选模型|兼容 Whisper / GPT / DeepSeek 等
➤ 自动生成字幕|支持 SRT 输出
➤ 本地部署|支持 Web 与 CLI
➤ 开源免费|适合课程与教程本地化
🌐 GitHub:
https://github.com/shang-zhu/violin
📌 简单说:
👉 一个开源 AI 视频翻译工具,可自动完成字幕识别、翻译、AI 配音与视频合成,适合做教程、课程与视频本地化。
📂 #AI视频 #视频翻译 #Whisper #AI工具
📁 Windows / AI工具 - 🔁 MoneyPrinterTurbo
📦 AI短视频生成 | 自动剪辑 | 一键生成视频
➤ AI生成视频|输入主题即可自动生成短视频
➤ 自动配音|支持多种 TTS 语音合成
➤ 自动字幕|支持字幕生成与样式调整
➤ 多模型支持|兼容 OpenAI / Gemini / DeepSeek 等
➤ 多平台部署|支持 Windows / macOS / Linux / Docker
➤ WebUI界面|提供可视化操作与 API 接口
🌐 GitHub:
https://github.com/harry0703/MoneyPrinterTurbo
📌 简单说:
👉 一个热门开源 AI 短视频生成工具,只需输入关键词或主题,即可自动完成文案、配音、字幕、素材与视频合成。适合自媒体与短视频内容批量生产。
———— 商务合作————
📂 #AI视频 #短视频生成 #自动剪辑 #AI工具
📁 Windows / 创作工具 - 🔁 Voicebox
📦 AI语音工具 | 本地语音转文字 | 开源项目➤ 语音转文字|支持本地离线 ASR 识别
➤ 多模型支持|兼容 Whisper / Faster-Whisper
➤ 音频转录|支持 MP3 / WAV / M4A 等格式
➤ 字幕生成|自动生成 SRT 字幕文件
➤ 本地运行|注重隐私 无需上传云端
➤ 开源免费|跨平台桌面应用
🌐 项目地址:
https://github.com/jamiepine/voicebox
📌 简单说:
👉 一个开源的本地 AI 转录工具,可快速把音频视频转换成字幕与文本。
———— 商务合作————
📂 #AI工具 #语音转文字 #Whisper #开源项目
📁 Windows / AI工具 -
-
- #AI #开发 一个完全部署在本地的全自动 AI 视频代理系统。输入一句话,系统自动完成脚本策划 → 首帧图像生成 → TTS 配音 → 视频片段生成 → FFmpeg 拼接成片 → 字幕烧录,最终输出带字幕的 MP4 成品视频,并同步生成剪映草稿工程,供人类在剪映里进行最后 10% 的微调。
https://github.com/OpenDemon/Pilipili-AutoVideo?tab=readme-ov-file -
-
- 🎬 字幕黑科技|视频字幕终于可以“一键搞定”了
下载 → 转录 → 翻译 → 对齐 → 压制,全自动完成
💥 Gemini-Subtitle-Pro|真正的全流程字幕生成神器
🟢 项目亮点:
📥 一条龙流程: 直接从视频链接开始,自动完成字幕全流程
🧠 Gemini 驱动: 利用大模型做上下文理解,字幕翻译更自然
🎧 时间轴精准: 毫秒级对齐,支持多说话人场景
🌍 多语言支持: 自动翻译成多语字幕,适合出海与搬运
✨ 字幕可编辑: 支持 SRT / ASS,样式可定制
🔓 MIT 开源: 可自用、可改造、可集成
🚀 一句话:
这是一个把“做字幕”从技术活,直接变成“丢链接等结果”的 AI 工具。
📖 项目地址:
👉 https://github.com/corvo007/Gemini-Subtitle-Pro
📢 频道 | 💬 群组 | 📬 投稿 | 📨 商务
#开源项目 #字幕生成 #视频工具 #AI翻译 #自动化 #Gemini #GitHub - #AI #MCP 自动化的小说视频生成MCP工作流,能够将文本小说转换为带有音频、字幕和图像的视频内容
https://github.com/hulutech-web/novel-video-workflow -
- #AI 一键提取 B 站视频字幕、弹幕、评论及关键帧画面,通过 AI 多模态大模型生成深度总结、思维导图及舆情分析报告。
https://github.com/Xuuuuu04/BiliBiliSummary - 🔥 AI 创作圈大一统!ElevenLabs 发布“创世”级平台,集齐所有神龙!🔥
还在为视频、音频、图片在不同工具间来回折腾而烦恼吗?ElevenLabs 刚刚终结了这一切!
现在,这个以“声音克隆”闻名的巨头,将所有顶级 AI 模型全部整合进了一个平台!
🚀 在这里,你可以:
- 一句话生成视频: 调用 Sora 2, Kling 2.5, Veo 3.1 等所有最强视频模型!
- 一句话生成图片: 使用 Nano Banana, Flux 等顶级图像模型!
- 一键提升画质: 内置 Topaz,轻松输出 4K 大片!
- 从零到一,一站搞定: 生成视频、生成配音、生成配乐、添加字幕、精细剪辑... 所有操作,都在一个地方完成!
这不再是一个工具,这是一个完整的 AI 创意工作室。
→ 点击此处,体验真正的“All-in-One”
频道 | 💬 群组 | 📬 投稿 | 📨 商务
#人工智能 #AI #ElevenLabs #Sora #Kling #AIGC -
-
- #AI #剪辑
剪辑神器➕1-AutoClip智能视频切片器
🎬 AutoClip是基于AI的智能视频切片和合集推荐系统,支持从B站视频自动下载、字幕提取、智能切片和合集生成。
官网:https://zhouxiaoka.github.io/autoclip_intro/
开源:https://github.com/zhouxiaoka/autoclip_mvp
✨ 功能特性
- 🔥 智能视频切片:基于AI分析视频内容,自动生成高质量切片
- 📺 B站视频下载:支持B站视频自动下载和字幕提取
- 🎯 智能合集推荐:AI自动分析切片内容,推荐相关合集
- 🎨 手动合集编辑:支持拖拽排序、添加/删除切片
- 📦 一键打包下载:支持所有切片和合集的一键打包下载
- 🌐 现代化Web界面:React + TypeScript + Ant Design
- ⚡ 实时处理状态:实时显示处理进度和日志
环境要求
- Python 3.8+
- Node.js 16+
- 通义千问API密钥(用于AI分析)
安装步骤
克隆项目
git clone git@github.com:zhouxiaoka/autoclip_mvp.git
cd autoclip_mvp
提示:截止发文时间,项目中遗忘了uploads文件夹,你需要自行创建该文件夹或代码修改,位置如下图,创建:
mkdir -p uploads
安装后端依赖
# 创建虚拟环境…
📡发布:https://noisevip.cn/18772.html
🪧关注频道:@quanshoulu
💬频道社群:https://www.noisework.cn/qun/
📬投稿bot:@noisewowbot
📇搜索bot:@Efficiencysearchbot
🎁访问主页: www.noisework.cn - #AI
video2ppt-将任意视频智能转换为精美PPT
Video2PPT是一个免费的在线工具,可以将任意来源的视频转换为PPT演示文稿。无论是本地视频文件、在线视频链接还是实时录屏,我们都能帮您提取关键信息,生成精美的PPT文档。
在线体验地址:https://video2ppt.com
项目特点
- 多源支持: 支持本地视频文件、在线视频链接或实时录屏
- 实时提取: 边看视频边生成PPT,适合网络会议、研讨会、在线课程等多种场景
- 隐私安全: 所有处理均在本地完成,不会上传视频内容,保证数据隐私和安全
- 完全免费: 所有功能免费使用,无广告干扰
- 智能总结: 自动提取视频中的关键信息点,生成结构化的PPT内容
开源地址: https://github.com/Wangxs404/video2ppt
支持多种来源
本地视频、在线视频链接、YouTube、Bilibili等平台,一键导入,快速处理。
实时录屏提取
边开会边录制,自动识别屏幕内容,提取关键信息,高效记录会议要点。
智能内容提取
自动识别视频中的文字、图表、重点内容,生成结构化PPT,省时省力。
使用方法
上传或提供视频
上传本地视频文件,或提供在线视频链接,也可以选择直接录制屏幕。
智能处理分析
我们的AI系统自动分析视频内容,识别关键信息,提取重要画面和文字。
下载PPT文件
几分钟内完成处理,生成专业PPT文件,可直接下载使用或进一步编辑。
本地开发运行
安装步骤
1. 克隆仓库
git clone https://github.com/AxisIndie/video2ppt.git
cd video2ppt
2. 安装依赖
npm install
# 或
yarn install
# 或
pnpm install
3.…
📡发布:https://noisevip.cn/18720.html
🪧关注频道:@quanshoulu
💬频道社群:https://www.noisework.cn/qun/
📬投稿bot:@noisewowbot
📇搜索bot:@Efficiencysearchbot
🎁访问主页: www.noisework.cn - #AI 智能视频处理系统,能够实现视频音频提取、语音识别、字幕生成、多语言翻译、语音合成以及音视频合成等功能。系统采用模块化设计,支持单步或多步处理,方便用户根据需求灵活使用。
https://github.com/bushkarl/videoprocessor - #AI #笔记
NoteGen-一个跨平台AI笔记APP
NoteGen 是一个跨平台的笔记 APP,目前支持 Mac、Windows、Linux
开源地址:https://github.com/codexu/note-gen
软件安装完毕后,请先在设置页面配置 API Key 后即可正常使用。
Mac 用户需要配置屏幕录制权限,才可以使用截图记录功能。
同步和图床功能(可选),需要创建 Github 仓库,并配置好密钥,即可使用。
特征
在如今信息爆炸的时代,高效地记录和整理知识已成为许多用户的迫切需求。NoteGen 是一款创新性的笔记软件,能够大幅提升用户的记录与整理体验。无论是快速记忆灵感,还是系统化汇总信息,NoteGen 都能为用户提供灵活又高效的解决方案,让知识整理变得更加轻松、便捷。
工作流
记录
支持截图、插图和文本的多种记录方式,用户可以根据不同场景灵活选择最适合的记录形式。借助 ChatGPT 的强大功能,您无需担心记录的顺序和完整性,轻松捕捉灵感与信息,提升记录效率。
以下介绍三种不同的记录方式及对应的场景:
- 截图记录是 NoteGen 的核心功能。通过截图,用户可以快速捕捉和记录碎片化知识,尤其是在遇到无法进行文本复制的情况下。其原理是通过 OCR 识别图片中的文字,再使用 ChatGPT 进行总结。
- 文本记录,可以确保内容的准确性,但是需要将文本复制至软件中,稍微增加了操作的复杂度。
- 插图记录,可以在笔记生成时,自动插入到合适的位置。
为了区分不同的知识记录,支持了标签功能。用户可以创建的标签,以便更好地归类和区分不同的记录场景。在文章生成时,这些标签及其对应的记录将会被删除,从而保持内容的整洁和专注。
生成
NoteGen 自动将所有记录整理成一篇可读性高的笔记,有效节省了手动整理所需的时间。
- 支持输入个性化的需求。
- 支持多种语言。…
📡发布:https://noisevip.cn/18655.html
🪧关注频道:@quanshoulu
💬频道社群:https://www.noisework.cn/qun/
📬投稿bot:@noisewowbot
📇搜索bot:@Efficiencysearchbot
🎁访问主页: www.noisework.cn - #AI #脚本
达芬奇DaVinci Resolve生成AI驱动的字幕脚本
下面两个项目是近期新的DaVinci Resolve AI脚本,某种程度上缩小了这类软件在AI市场的差距,也让剪辑师开始重新审视DaVinci Resolve
✔️
一、autosubs-为 DaVinci Resolve 生成 AI 驱动的字幕
官网:https://tom-moroney.com/auto-subs/#how-it-works
GitHub:https://github.com/tmoroney/auto-subs
使用 OpenAI Whisper 和 Stable-TS 自动转录您的编辑时间线,以实现极高的准确性。
- 以您自己的自定义样式生成字幕。
- 完全免费,并在 Davinci Resolve 中本地运行。
- 适用于 Mac、Linux 和 Windows。
- 在 Free 和 Studio 版本的 Resolve 上均受支持。
- 使用 Subtitle Navigator 跳转到时间轴上的位置。
- 新增功能!!- 从任何语言翻译成英语。
✔️
主要特点
AI 驱动的速度
在几分钟内生成精确的字幕,从而在视频制作工作流程中节省宝贵的时间。
定制
使用可自定义的颜色、动画和样式效果设计独特的字幕。
多种语言…
📡发布:https://noisevip.cn/18623.html
🪧关注频道:@quanshoulu
💬频道社群:https://www.noisework.cn/qun/
📬投稿bot:@noisewowbot
📇搜索bot:@Efficiencysearchbot
🎁访问主页: www.noisework.cn - #AI #工具
开源AI一键解说并剪辑视频工具
介绍
NarratoAI 是一个自动化影视解说工具,基于LLM实现文案撰写、自动化视频剪辑、配音和字幕生成的一站式流程,助力高效内容创作。
Github:https://github.com/linyqh/NarratoAI
配置要求 📦
- 建议最低 CPU 4核或以上,内存 8G 或以上,显卡非必须
- Windows 10 或 MacOS 11.0 以上系统
快速开始 🚀
申请 Google AI studio 账号
1. 访问 https://aistudio.google.com/app/prompts/new_chat 申请账号
2. 点击 Get API Key 申请 API Key
3. 申请的 API Key 填入 config.example.toml 文件中的 gemini_api_key 配置
配置 proxy VPN
配置vpn的方法不限,只要能正常访问 Google 网络即可,本文采用的是 clash
1.…
📡发布:https://noisevip.cn/18524.html
🪧关注频道:@quanshoulu
💬频道社群:https://www.noisework.cn/qun/
📬投稿bot:@noisewowbot
📇搜索bot:@Efficiencysearchbot
🎁访问主页: www.noisework.cn - #AI
智能视频多语言AI配音/翻译工具 – Linly-Dubbing
介绍
Linly-Dubbing 是一个智能视频多语言AI配音和翻译工具,它融合了YouDub-webui的灵感,并在此基础上进行了拓展和优化。我们致力于提供更加多样化和高质量的配音选择,通过集成Linly-Talker的数字人对口型技术,为用户带来更加自然的多语言视频体验。
Github:https://github.com/Kedreamix/Linly-Dubbing
通过整合最新的AI技术,Linly-Dubbing 在多语言配音的自然性和准确性方面达到了新的高度,适用于国际教育、全球娱乐内容本地化等多种场景,帮助团队将优质内容传播到全球各地。
主要特点包括:
- 多语言支持: 支持中文及多种其他语言的配音和字幕翻译,满足国际化需求。
- AI 智能语音识别: 使用先进的AI技术进行语音识别,提供精确的语音到文本转换和说话者识别。
- 大型语言模型翻译: 结合领先的本地化大型语言模型(如GPT),快速且准确地进行翻译,确保专业性和自然性。
- AI 声音克隆: 利用尖端的声音克隆技术,生成与原视频配音高度相似的语音,保持情感和语调的连贯性。
- 数字人对口型技术: 通过对口型技术,使配音与视频画面高度契合,提升真实性和互动性。
- 灵活上传与翻译: 用户可以上传视频,自主选择翻译语言和标准,确保个性化和灵活性。
- 定期更新: 持续引入最新模型,保持配音和翻译的领先地位。
我们旨在为用户提供无缝、高质量的多语言视频配音和翻译服务,为内容创作者和企业在全球市场中提供有力支持。
-------------
TO DO LIST
- 完成AI配音和智能翻译功能的基础实现
- 集成CosyVoice的AI声音克隆算法,实现高质量音频翻译
- 增加FunASR的AI语音识别算法,特别优化对中文的支持
-…
📡发布:https://noisevip.cn/18506.html
🪧关注频道:@quanshoulu
💬频道社群:https://www.noisework.cn/qun/
📬投稿bot:@noisewowbot
📇搜索bot:@Efficiencysearchbot
🎁访问主页: www.noisework.cn - #AI #工具
开源AI处理工具-APT
介绍
这是一款免费和开源的AI工具,旨提高用户生产力,同时确保隐私和数据安全。提供高效便捷的AI解决方案,包括但不限于:内置专属ChatGPT,一键批量智能处理图片视频等。
开源和下载链接
- GitHub:https://github.com/rnchg/Apt
- 夸克:https://pan.quark.cn/s/f55c6845a334
- 完整版:包括所有功能。
- 精简版:包括除 ChatGPT 以外的所有功能。
主要特点
- 免费和开源:免费使用,用户可以自行查看和修改开源代码。
- 隐私保护:本地部署,确保所有数据在本地处理,保障用户隐私和数据安全。
- 离线使用:可离线操作,无需上网,避免网络限制。
- 无需安装:无需安装或配置,只需单击一下即可解压并运行,使其快速方便。
- 多语言支持:支持多种语言,满足全球用户的需求。
集成 AI 模型
集成多种可在本地离线环境中使用的最新AI模型,包括内置专属ChatGPT、一键批量智能处理图像和视频等。
ChatGPT的
- 提供本地离线 ChatGPT 模型,随时随地享受智能 AI 对话。
图像处理
- 超分辨率:在不影响质量的情况下提高图像分辨率。
- 自动擦除:从图像中删除水印、字幕和徽标,恢复原始图片。
- 卡通和漫画转换:将图像转换为充满活力的卡通或漫画风格。
- 3D 转换:将图像转换为逼真的 3D 场景。
- 色彩恢复:为旧照片重新着色,赋予它们新的生命。
- 面部修复:修复模糊或损坏的面部图像,增强细节。
视频处理
- 超分辨率:在保持清晰质量的同时提高视频分辨率。
-…
📡发布:https://noisevip.cn/18406.html
🪧关注频道:@quanshoulu
💬频道社群:https://www.noisework.cn/qun/
📬投稿bot:@noisewowbot
📇搜索bot:@Efficiencysearchbot
🎁访问主页: www.noisework.cn -
- #AI视频
Tailor-视频智能裁剪、视频生成和视频优化的工具
ailor 是令人惊叹的视频编辑神器!其人脸和语音剪辑精准无比,人脸识别能锁定人物画面,语音捕捉和裁剪独具魅力。视频生成方面,口播生成赋予图像灵魂,字幕生成准确契合,色彩生成让黑白鲜活,音频生成创造无限可能。优化上,背景更换如入奇幻世界,流畅度与清晰度也极佳。Tailor 不仅是软件,更是创意与精彩的钥匙,无论专业或普通爱好者都能借此让作品闪耀,快来体验它带来的震撼惊喜!
介绍
Tailor(中文简称:泰勒)是一款视频智能裁剪、视频生成和视频优化的工具。目前该项目包括了视频剪辑、视频生成和视频优化3大类视频处理方向,共10种方法。Tailor使用方法简单,点点鼠标即可使用最先进的人工智能进行视频处理工作,省时省力,若使用安装版本Tailor,所有的环境配置都可省掉,对用户特别友好。
工作界面
功能介绍
Tailor包括了视频剪辑、视频生成和视频优化3大类视频处理方向,共10种方法。下面将依次进行介绍:
视频剪辑
人脸剪辑
Tailor 拥有神奇的人脸识别技术,能自动从视频中捕捉每一个精彩的人脸瞬间。你只需轻轻一点,就能选择关注的人脸,Tailor 会像魔法一样为你自动裁剪出相关视频,让你的主角时刻闪耀!
语音剪辑
Tailor 还能智能识别视频中的语音内容,并将其清晰地展示出来。你可以根据自己的需求,选择感兴趣的语音部分,Tailor 会精准地裁剪出你想要的内容,让你的视频更加精彩。
视频生成
口播生成
只需上传一张带有人脸的图像,选择喜欢的语音音色,输入想要生成的语音内容,Tailor 就能瞬间为你生成一个对应语音口型的有声视频。让你的创意轻松实现,打造出独一无二的视频作品!
地址:https://github.com/FutureUniant/Tailor
字幕生成
通过智能识别音视频内容,Tailor…
📡发布:https://noisevip.cn/18377.html
🪧关注频道:@quanshoulu
💬频道社群:https://www.noisework.cn/qun/
📬投稿bot:@noisewowbot
📇搜索bot:@Efficiencysearchbot
🎁访问主页: www.noisework.cn - #AI视频
MoneyPrinterTurbo一键生成短视频
只需提供一个视频 主题 或 关键词 ,就可以全自动生成视频文案、视频素材、视频字幕、视频背景音乐,然后合成一个高清的短视频。
项目地址:https://github.com/harry0703/MoneyPrinterTurbo
功能特性 🎯
- 完整的 MVC架构,代码 结构清晰,易于维护,支持API和Web界面
- 支持视频文案 AI自动生成,也可以自定义文案
- 支持多种
高清视频
尺寸
◦ 竖屏 9:16,1080x1920
◦ 横屏 16:9,1920x1080
- 支持 批量视频生成,可以一次生成多个视频,然后选择一个最满意的
- 支持 视频片段时长设置,方便调节素材切换频率
- 支持 中文 和 英文 视频文案
- 支持 多种语音 合成
- 支持 字幕生成,可以调整 字体、位置、颜色、大小,同时支持字幕描边设置
- 支持 背景音乐,随机或者指定音乐文件,可设置背景音乐音量
- 视频素材来源 高清,而且 无版权
- 支持 OpenAI、moonshot、Azure、gpt4free、one-api、通义千问…
📡发布:https://noisevip.cn/17916.html
📢关注频道:@quanshoulu
💬频道社群:https://www.noisework.cn/qun/
📬投稿bot:@noisewowbot
📇搜索bot:@Efficiencysearchbot
🎁访问主页: www.noisework.cn - #AI
FunClipper-开源语音识别模型的自动化视频剪辑工具
介绍
FunClipper是一款自动化视频剪辑工具,通过调用阿里巴巴通义实验室开源的FunASR Paraformer系列模型进行视频的语音识别,随后用户可以自由选择识别结果中的片段,点击裁剪按钮即可获取对应片段的视频(快速体验)。
项目地址:https://github.com/alibaba-damo-academy/FunClipper
在上述基本功能的基础上,FunClipper有以下特色:
- FunClipper集成了阿里巴巴开源的工业级模型Paraformer-Large,是当前识别效果最优的开源中文ASR模型之一,Modelscope下载量1300w+次,并且能够一体化的准确预测时间戳。
- FunClipper集成了SeACo-Paraformer的热词定制化功能,在ASR过程中可以指定一些实体词、人名等作为热词,提升识别效果。
- FunClipper集成了CAM++说话人识别模型,用户可以将自动识别出的说话人ID作为裁剪目标,将某一说话人的段落裁剪出来。
- 通过Gradio交互实现上述功能,安装简单使用方便,并且可以在服务端搭建服务通过浏览器使用。
- FunClipper支持多段自由剪辑,并且会自动返回全视频SRT字幕、目标段落SRT字幕,使用简单方便。
- 使用FunClipper进行视频剪辑✂️
安装
# 安装FunASR(必须)
pip install -U funasr
# 安装FunClipper的Python依赖(必须)
pip install -r ./requirments.txt
安装imagemagick(可选)
如果你希望使用自动生成字幕的视频裁剪功能,需要安装imagemagick
◦ Ubuntu
apt-get -y update && apt-get -y install…
📡发布:https://noisevip.cn/17862.html
📢关注频道:@quanshoulu
💬频道社群:https://www.noisework.cn/qun/
📬投稿bot:@noisewowbot
📇搜索bot:@Efficiencysearchbot
🎁访问主页: www.noisework.cn - #AI
AI全自动视频翻译
介绍
这是一个全自动视频翻译项目。利用Whisper识别声音,AI大模型翻译字幕,最后合并字幕视频,生成翻译好的带字幕的视频
项目地址:https://github.com/Chenyme/Chenyme-AAVT
项目亮点
- 支持 faster-whisper 后端
- 支持 GPU 加速
- 支持 ChatGPT、KIMI 翻译
- 支持多种语言识别、翻译
- 支持多种字幕格式输出
- 支持字幕、视频预览
如何安装
更快速的安装(省去下载FFmpeg)
https://github.com/Chenyme/Chenyme-AAMT/releases
正常安装
本项目需要依赖 Python 环境和 FFmpeg,可能会用到 CUDA 和 PyTorch 。
1. 安装 Python 环境
- 您需要安装 Python 3.8 或更高版本。
- 您可以从 Python官网 下载并安装最新版本的 Python。
1. 安装 FFmpeg
- 您需要安装 FFmpeg。
-…
📡发布:https://noisevip.cn/17708.html
📢关注频道:@quanshoulu
💬频道社群:https://www.noisework.cn/qun/
📬投稿bot:@noisewowbot
📇搜索bot:@Efficiencysearchbot
🎁访问主页: www.noisework.cn