Skip to main content
全网优质资源汇总✨

全网优质资源汇总✨

  1. 阿里SenseVoice的fastpi封装,语音转文字接口,自动识别语言,支持语音文件或URL
    SenseVoice是具有音频理解能力的音频基础模型,包括语音识别(ASR)、语种识别(LID)、语音情感识别(SER)和声学事件分类(AEC)或声学事件检测(AED)。本项目提供SenseVoice模型的介绍以及在多个任务测试集上的benchmark,以及体验模型所需的环境安装的与推理方式。


    核心功能 🎯
    SenseVoice专注于高精度多语言语音识别、情感辨识和音频事件检测

    多语言识别: 采用超过40万小时数据训练,支持超过50种语言,识别效果上优于Whisper模型。
    富文本识别:
    具备优秀的情感识别,能够在测试数据上达到和超过目前最佳情感识别模型的效果。
    支持声音事件检测能力,支持音乐、掌声、笑声、哭声、咳嗽、喷嚏等多种常见人机交互事件进行检测。
    高效推理: SenseVoice-Small模型采用非自回归端到端框架,推理延迟极低,10s音频推理仅耗时70ms,15倍优于Whisper-Large。
    微调定制: 具备便捷的微调脚本与策略,方便用户根据业务场景修复长尾样本问题。
    服务部署: 具有完整的服务部署链路,支持多并发请求,支持客户端语言有,python、c++、html、java与c#等。

    https://github.com/HG-ha/SenseVoice-Api
    #开源 GitHub - HG-ha/SenseVoice-Api: 阿里SenseVoice的fastpi封装,采用onnx发布,体积更小,附带量化模型,支持GPU。支持从URL文件进行语音识别。
  2. 强大的 SaaS 🚀 CSV 和 Excel 导入体验可嵌入、可扩展和现成的数据导入体验。使用 Impler,您无需担心构建和管理用于导入客户数据的复杂架构。只需几个简单的步骤集成 impler,数据导入体验将在几分钟内准备就绪
    https://github.com/implerhq/impler.io GitHub - implerhq/impler.io: Powerful CSV & Excel Import experience for SaaS 🚀 Save months building data import experience from…
  3. Tailor
    令人惊叹的视频编辑神器!其人脸和语音剪辑精准无比,人脸识别能锁定人物画面,语音捕捉和裁剪独具魅力。视频生成方面,口播生成赋予图像灵魂,字幕生成准确契合,色彩生成让黑白鲜活,音频生成创造无限可能。优化上,背景更换如入奇幻世界,流畅度与清晰度也极佳。Tailor 不仅是软件,更是创意与精彩的钥匙,无论专业或普通爱好者都能借此让作品闪耀,快来体验它带来的震撼惊喜!
    项目地址 下载地址
    #剪辑 #电脑软件 #开源
  4. Kimi 浏览器助手
    Kimi出品的一款帮助用户高效阅读和写作的插件,通过划词查询、摘要提取和持续对话等功能。
    选取有疑问的段落轻松划线获得符合上下文的答案,浏览网页不再需要反复切换页面查询新问题。
    点击右侧悬浮图标或快捷键一键唤起对话窗口,快速总结全文减少阅读时间消耗。
    官网下载
    #扩展 #Ai
  5. #AI
    Just Mark-可以AI分类的智能收藏夹
    这是一款可以自行添加浏览器书签并使用AI完成整理的浏览器插件,该插件允许上传书签数据及开放API功能
    官网:https://justmark.notelive.cn
    🚀 AI 一键收藏
    一键收藏不打断您的思绪
    遇到一个想要记录的网页,点击扩展程序图标一键完成网页收藏,无需进行任何网页注释与分类的操作,不用打断您当前的思绪。
    🗂 AI 自动分类
    自动分类与提取关键词,助您清晰管理收藏
    使用 Just Mark 收藏网页时无需手动进行网页的分类管理,Just Mark AI 会自动进行分类和关键词提取。
    📸 自动截图
    查看截图快速回忆起收藏的时刻
    当您收藏一个网页时,Just Mark 会自动截图当前时刻的页面,通过截图可以快速回忆起收藏的时刻。
    🔍 随意的搜索
    使用您想到的任何词汇去搜索
    查找收藏时,不用努力回忆一个精准的关键词,任何想到的相关词汇都可以,甚至任何语言都可以。Just Mark AI 会理解您的意思并找到合适的内容。
    📄 网页正文提取
    干净的快速阅读网页内容
    对于文章类的网页,您可以在收藏夹干净清爽直接阅读网页的正文内容。帮助您快速找到需要的内容。
    🌐 自动翻译
    轻松的使用中文去管理网页
    如果您收藏的是非中文的网页,Just Mark AI 会自动翻译为中文进行记录,让您更轻松的去管理收藏夹。不用担心,您可以随时选择查看网页原文。
    📡发布:https://noisevip.cn/18426.html
    🪧关注频道:@quanshoulu
    💬频道社群:https://www.noisework.cn/qun/
    📬投稿bot:@noisewowbot
    📇搜索bot:@Efficiencysearchbot
    🎁访问主页: www.noisework.cn
  6. #AI语音
    CosyVoice-AI声音克隆离线整合包
    介绍
    该项目是由阿里开源的聚合多语言大语音生成模型,提供推理、训练和部署全栈能力,项目中FunAudioLLM为核心框架,其两个主要模型用于高精度多语言语音识别、情感识别和音频事件检测的 SenseVoice;以及 CosyVoice,用于通过多语言、音色和情感控制进行自然语音生成。SenseVoice 提供极低的延迟并支持 50 多种语言,而 CosyVoice 在多语言语音生成、零样本语音生成、跨语言语音克隆和指令跟踪功能方面表现出色。与 SenseVoice 和 CosyVoice 相关的模型已在 Modelscope 和 Huggingface 上开源,以及 GitHub 上发布的相应训练、推理和微调代码。通过将这些模型与 LLM 集成,FunAudioLLM 实现了语音翻译、情感语音聊天、交互式播客和富有表现力的有声读物旁白等应用,从而突破了语音交互技术的界限
    项目地址:https://github.com/FunAudioLLM/CosyVoice
    CosyVoice整合包下载:https://pan.quark.cn/s/74ce36f251b6
    引:整合包由up主十个骑士制作
    这里分享的为CosyVoice相关,所以不过多介绍其框架下的综合能力,详细你可以访问官方https://fun-audio-llm.github.io 页面查看
    解压整合包并启动后(其中有三个个一键启动程序,推理-instruct.exe为自然语言控制模型启动)你可以得到如下界面:
    预训练模式即文本生成语音,在列表中你可以找到预训练的模型角色
    3s极速复刻为克隆一段音频音色,上传音频文件并输出prompt(和音频内容一致)再填入你想要生成音频的文本(最上方)
    跨语种复刻为克隆为其它语言的音频,所以上方输入的文本应为其它语言…
    📡发布:https://noisevip.cn/18428.html
    🪧关注频道:@quanshoulu
    💬频道社群:https://www.noisework.cn/qun/
    📬投稿bot:@noisewowbot
    📇搜索bot:@Efficiencysearchbot
    🎁访问主页: www.noisework.cn
  7. #投稿 来自投稿
    PC剪映_6.0优化版-解锁会员插件-不埋没你的视频梦
    说明:实测可用(7月16日)
    使用方法 :
    1.安装Windows版剪映6.0
    2.打开''6.0ying_嵌入_y.vmp.exe''
    3.输入''1''后,再输入剪映该文件夹的位置
    【如:E:\JianyingPro\6.0.1.11779】
    4.稍作等待,破解完成后打开剪映即可直接使用VIP功能,剪完视频直接导出即可
    PR的局限性还是有点多。所以剪映&AE就是我现在的选择
    (仅限个人使用,请不要拿去商用,对于像我这样的qiong孩子不好)
    https://caiyun.139.com/m/i?175CkZNHin5Ut
    🫨
    补:6.0.1:https://pan.quark.cn/s/c85dec30dbc4
    6.0:https://pan.quark.cn/s/d2b6af9a3663

    via 匿名