Skip to main content
全网优质资源汇总✨

Search: #本地模型

  1. 🔥 QwenPaw — 本地部署型个人 AI 助理 Agent OS
    📦 AI助手 | 多智能体 | 开源项目

    ➤ 不只是聊天机器人,而是完整 Agent OS 架构平台
    ➤ 支持三层记忆系统:实时上下文、历史记录、个人知识库
    ➤ 自动沉淀对话与资源,生成可搜索 Markdown 记忆
    ➤ 支持本地部署,无需 API Key 即可运行
    ➤ 内置 QwenPaw-Flash 模型(2B/4B/9B)
    ➤ 兼容 Ollama、LM Studio 及多种云端模型服务
    ➤ 内置安全沙箱、Tool Guard、File Guard、Skill Scanner
    ➤ 支持多 Agent 并行协作与任务拆解
    ➤ 支持钉钉、飞书、微信、Discord、Telegram、iMessage、QQ 等渠道
    ➤ 提供 Console、TUI、桌面端多种交互方式


    📌 简单说:
    👉 QwenPaw 是一个开源个人 AI 助理平台,将 AI 从普通聊天工具升级为长期驻场助手,支持本地运行、永久记忆、安全执行任务以及多平台统一管理。

    🔗 项目地址:
    GitHub

    📂 #AI助理 #AI Agent #多智能体 #本地部署 #开源项目 #效率工具
  2. 声物记

    完全离线、纯本地的 Flutter 语音助手 —— 物品管理 + 闪念胶囊。 所有功能在本地处理,无需联网,不上传任何用户数据
    适用场景
    平时总找不到东西放哪里的;
    想做物品管理,但嫌打字太慢、效率低的;
    搬家收纳时把物品放入某个箱子,到新家却忘了在哪个箱子;
    封箱时塞了填充杂物(如锅碗箱里顺手塞了洗发露)却忘记标注,复原时找不到;
    想临时记个笔记,却嫌「解锁 → 找 app → 新建 → 打字」步骤太多的。


    项目地址 | 网盘下载

    #开源 #Android #声物记 #本地模型 #闪念胶囊 #物品管理
  3. 🤖 kimi-k3-in-c

    📦 AI 大模型 | 本地部署 | 开源项目


    ➤ 纯 C99 实现 Kimi K3 推理引擎
    ➤ 支持 2.78 万亿参数 MoE 大模型运行
    ➤ 无需 GPU、无需 PyTorch、无需 CUDA
    ➤ 仅需约 8GB 内存即可进行推理
    ➤ 推理结果与完整加载版本保持一致
    ➤ 引擎体积仅约 176KB
    ➤ 无外部框架依赖,极致轻量
    ➤ 支持 AVX2 CPU 加速
    ➤ 使用流式加载技术降低内存占用
    ➤ 专家缓存机制按需加载模型参数
    ➤ 支持 4-bit 专家权重优化
    ➤ 内存越低仅影响速度,不影响输出
    ➤ 提供完整测试套件
    ➤ 支持 Linux x86-64 环境
    ➤ 开源免费项目



    📌 简单说:
    👉 kimi-k3-in-c 是一个挑战硬件极限的开源项目,通过纯 C99 推理引擎和创新内存管理技术,让拥有 2.78T 参数的 Kimi K3 大模型能够在普通 CPU 和低内存设备上运行,展示了超大模型轻量化部署的可能性。

    ⚙️ 运行要求:
    ➤ Linux x86-64 系统  
    ➤ 至少 8GB 内存  
    ➤ 约 1.7TB 硬盘空间存储模型权重  
    ➤ 较快磁盘可提升运行速度  

    🔗 项目地址:
    https://github.com/FareedKhan-dev/kimi-k3-in-c

    📂 #AI #大模型 #KimiK3 #本地部署 #开源项目
  4. 🤖 Kimi-K3 国产大模型

    📦 AI大模型 | 开源项目 | 本地部署


    ➤ Kimi-K3 正式开源
    ➤ 支持本地部署运行
    ➤ 数据自主掌控,保障隐私安全
    ➤ 适用于企业私有化部署
    ➤ 支持 AI 应用开发与测试
    ➤ 开放模型权重,可自由研究使用
    ➤ 硬件成本约 2000 万级别
    ➤ 4000 万级配置可流畅运行


    📌 简单说:
    👉 Kimi-K3 国产大模型正式开源,支持本地化部署测试,适合企业及开发者搭建私有 AI 环境,提升数据安全与自主可控能力。

    🔗 项目地址:
    https://huggingface.co/moonshotai/Kimi-K3

    📂 #AI #KimiK3 #国产大模型 #开源项目 #本地部署
  5. 🤖 🔁 MNN LLM Android

    📦 本地大模型 | Android | 开源项目


    ➤ 手机上运行 AI 大模型
    ➤ 完全离线运行
    ➤ 无需互联网连接
    ➤ 内置多种模型可选
    ➤ 支持本地推理
    ➤ 开源免费

    ⚠️ 注意:

    ➤ 建议使用性能较好的设备。
    ➤ 模型越大,占用存储和内存越高。


    🌐 GitHub:
    https://github.com/alibaba/MNN

    📥 下载:
    https://github.com/alibaba/MNN/blob/master/apps/Android/MnnLlmChat/README.md#releases

    📌 简单说:
    👉 阿里巴巴开源的 Android 本地大模型应用,可在手机上离线运行 AI,无需联网即可进行聊天和推理。

    📂 #Android #AI #LLM #本地部署 #离线AI #开源
  6. 🤖 🔁 MiniCPM5-1B

    📦 开源大模型 | 本地部署 | GGUF



    ➤ 仅 1B 参数
    ➤ 支持 128K(131072 Tokens)超长上下文
    ➤ 支持 Think / No Think 双模式
    ➤ 支持 Agent 工具调用
    ➤ 支持代码生成
    ➤ 提供 GGUF、MLX、Transformers、vLLM、SGLang 等版本
    ➤ 支持 Ollama、LM Studio、llama.cpp 等本地部署
    ➤ 在多个 Sub-4B 开源模型评测中排名领先

    💡 适合低配置设备、本地 AI、Agent、代码开发等场景。



    🌐 Hugging Face:
    https://huggingface.co/openbmb/MiniCPM5-1B-GGUF

    📌 简单说:
    👉 MiniCPM5-1B 是 OpenBMB 推出的轻量级开源大模型,仅 1B 参数,却拥有接近甚至超越部分 7B 模型的综合表现,非常适合本地部署和低资源设备运行。

    📂 #AI #LLM #MiniCPM #GGUF #本地部署 #开源模型
  7. 🧠 🔁 LLM Torrent Models

    📦 AI模型资源 | 大语言模型下载 | 本地部署资源



    ➤ 提供部分难以查找的 LLM 模型资源
    ➤ 支持通过 Torrent 方式下载大型模型文件
    ➤ 适合本地运行 AI 模型的用户
    ➤ 可用于 Ollama / LM Studio / llama.cpp 等本地AI环境
    ➤ 适合寻找大体积模型、备份模型资源



    🌐 模型资源:

    1️⃣ CKPT:
    https://ckpt.cc/top

    2️⃣ HuggingBay:
    https://huggingbay.xyz/

    📌 简单说:
    👉 Torrent 下载适合大型语言模型文件分发,可以减少单一服务器压力,并方便用户获取大体积模型资源。社区也有通过 Torrent 分发开源模型的尝试。

    ⚠️ 注意:
    ➤ 下载前请确认模型许可证和使用权限
    ➤ 部分模型可能有商业使用限制
    ➤ 建议优先选择官方或可信来源模型仓库,例如 Hugging Face 等公开模型平台。
    ➤ 下载和分享资源时请遵守当地法律法规

    📂 #AI模型 #LLM #Torrent #本地AI #模型下载
  8. 🧩 🔁 WhisperSubTranslate

    🎧 本地视频字幕生成 + 多语言翻译工具 | Whisper.cpp | 离线 AI 字幕系统



    ➤ 在本地将视频音频转换为字幕(语音转文字 / ASR)
    ➤ 使用 whisper.cpp 生成高质量 SRT 字幕文件
    ➤ 支持多语言字幕翻译(内置 Hy-MT2 模型)
    ➤ 可完全离线运行(保护隐私,无需上传视频)
    ➤ 支持调用在线翻译引擎(免费 / 付费 API 可选)
    ➤ 不读取视频内嵌字幕轨道
    ➤ 不使用 OCR(不识别画面文字)
    ➤ 专注“音频 → 字幕 → 翻译”的流程
    ➤ 支持生成多语言字幕版本(适合 YouTube / 教学视频)



    🌐 项目地址:
    https://github.com/Blue-B/WhisperSubTranslate/blob/main/docs/README.zh.md

    📌 简单说:
    👉 这是一个本地字幕工具,用 Whisper 把视频“听写成字幕”,再自动翻译成多语言字幕,全程可以离线运行,适合做字幕翻译或视频本地化。

    📂 #Whisper #字幕生成 #AI翻译 #本地AI #视频处理
  9. 🧠 🔁 Odysseus

    📦 AI工作台 | Agent系统 | 本地LLM平台


    ➤ 自托管 AI 工作空间(Chat / Agent / Docs)
    ➤ 支持本地模型 + OpenAI兼容接口
    ➤ 集成搜索、记忆与任务系统
    ➤ 可连接 Ollama 等本地模型
    ➤ Docker 一键部署
    ➤ 面向 AI 工作流整合
    ➤ 开源可扩展架构


    🌐 项目地址:
    https://github.com/pewdiepie-archdaemon/odysseus

    📌 简单说:
    👉 Odysseus 是一个把聊天、工具、Agent、文档和模型整合在一起的本地 AI 工作台

    📂 #AI工具 #Agent #本地AI #开源项目 #LLM
    📁 AI系统工具
  10. 📱 🔁 Google AI Edge Gallery

    📦 端侧AI | 本地模型 | 离线生成式AI平台


    ➤ Google AI Edge 官方生成式 AI 体验平台
    ➤ 支持设备端运行大型语言模型(LLM)
    ➤ 完全离线运行,数据不上传云端
    ➤ 提供 Gemma 系列模型支持(如 Gemma 4)
    ➤ 面向移动设备优化(Android / iOS)
    ➤ 支持本地推理与低延迟生成
    ➤ 用于测试与评估端侧 AI 能力
    ➤ 支持多模型切换与实验性功能
    ➤ 强调隐私保护与本地计算


    🌐 GitHub:
    https://github.com/google-ai-edge/gallery

    📌 简单说:
    👉 Google AI Edge Gallery 是一个用于在手机或本地设备上运行大模型的官方平台,可以离线体验生成式 AI(如 Gemma),主打隐私、本地推理和低延迟 AI 体验。

    📂 #GoogleAI #EdgeAI #Gemma #本地模型 #LLM
    📁 AI平台
  11. 🤖 🔁 GLM-4.7 Flash Uncensored

    📦 本地模型 | GGUF格式 | 开源LLM


    ➤ 基于 GLM-4.7 的本地语言模型版本
    ➤ GGUF 格式,适配本地推理工具
    ➤ 支持个人电脑离线运行
    ➤ 面向创意写作与编程辅助场景
    ➤ 轻量化设计,降低运行门槛
    ➤ 可在本地模型框架中加载使用
    ➤ 来自 Zhipu AI 系列模型衍生版本
    ➤ 提供更开放的生成能力体验


    📥 下载:
    https://huggingface.co/DavidAU/GLM-4.7-Flash-Uncensored-Heretic-NEO-CODE-Imatrix-MAX-GGUF

    📌 简单说:
    👉 这是一个 GLM-4.7 的 GGUF 本地模型版本,可以在个人电脑上运行,用于编程辅助与文本生成,强调本地部署与自由生成能力。

    📂 #GLM #本地模型 #GGUF #LLM #AI模型
    📁 AI模型
  12. 🧠 🔁 CanIRun.ai

    📦 本地AI检测 | 模型兼容性 | 硬件分析工具


    ➤ 通过浏览器自动检测本地硬件配置
    ➤ 分析 CPU / GPU / VRAM / 内存等关键指标
    ➤ 判断可运行的本地 AI 模型
    ➤ 支持 Llama、Qwen、Mistral、DeepSeek 等模型
    ➤ 显示模型运行等级(可运行 / 勉强运行 / 不支持)
    ➤ 基于 WebGPU / WebGL 等浏览器能力实现
    ➤ 无需安装软件,无需注册账号
    ➤ 纯前端运行,数据不上传服务器
    ➤ 适合本地部署 LLM 前的硬件评估


    🌐 官网:
    https://www.canirun.ai/

    📌 简单说:
    👉 CanIRun.ai 是一个“AI 版 Can I Run It”工具,打开网页即可自动检测你的电脑硬件,并告诉你哪些大模型可以在本地运行、运行效果如何,帮助你在下载或部署本地模型前做出判断。

    ⚙️ 特点:
    • 自动识别 GPU 与显存
    • 模型兼容性评分系统
    • 支持主流开源大模型库
    • 完全浏览器运行(隐私友好)
    • 零安装、即开即用

    📂 #CanIRunAI #本地模型 #LLM #AI工具 #硬件检测
    📁 AI工具
  13. VoxCPM |基于连续表征的多语言语音合成、创意音色设计与高保真声音克隆

    一个无离散音频分词器(Tokenizer-Free)的语音合成系统,通过端到端的扩散自回归架构直接生成连续语音表征,绕过对音频的离散编码步骤,实现高度自然且富有表现力的语音合成。
    🌍 30种语言语音合成 — 直接输入原始文本即可合成(支持语言详见下文),无需额外语言标签
    🎨 音色设计 — 用自然语言描述(性别、年龄、音色、情绪、语速……)凭空创建全新音色,无需参考音频
    🎛 可控声音克隆 — 从参考音频片段克隆任意声音,可叠加风格指令控制情绪、语速和表现力,同时保持原始音色
    🎙 极致克隆 — 提供参考音频及其文本内容,模型接着参考音频进行无缝续写,从而精准还原声音细节特征(与 VoxCPM1.5 一致)
    🔊 48kHz 高质量音频 — 输入 16kHz 参考音频,通过 AudioVAE V2 的非对称编解码设计直接输出 48kHz 高质量音频,内置超分能力
    🧠 语境感知合成 — 根据文本内容自动推断合适的韵律和表现力
    ⚡️ 实时流式合成 — 在 NVIDIA RTX 4090 上 RTF 低至 ~0.3,通过 Nano-vLLM 或 vLLM-Omni(官方 vLLM 全模态服务,原生支持 VoxCPM2,提供 PagedAttention 与 OpenAI 兼容 API)加速后可达 ~0.13
    📜 完全开源,商用就绪 — 权重和代码基于 Apache-2.0 协议发布,免费商用


    项目地址

    #开源 #声音克隆 #AI语音 #本地部署 #VoxCPM #语音合成
  14. 🔁 Atomic Chat
    📦 本地AI聊天 | 开源客户端 | 1000+模型


    ➤ 本地运行|数据始终保留在设备中
    ➤ 开源免费|无需订阅,无使用限制
    ➤ 1000+模型|支持 Qwen、DeepSeek、Llama、Mistral、Gemma 等
    ➤ 离线聊天|无需联网也可运行本地模型
    ➤ Agent支持|可创建和运行本地 AI 工作流
    ➤ 一键下载模型|支持 Hugging Face 模型库


    🌐 官网:
    https://atomic.chat/

    📌 核心特点:
    • 零成本使用
    • 无速率限制
    • 无云端依赖
    • 支持 GGUF、MLX、ONNX 格式
    • Windows / macOS / Linux / Android / iOS
    • 聊天记录与项目本地保存

    📌 简单说:
    👉 Atomic Chat 是一款开源本地 AI 聊天客户端,可在电脑或手机上直接运行各种大模型,无需订阅 AI 服务。支持 1000 多种模型下载与管理,数据不会上传到服务器,适合注重隐私和本地 AI 的用户。

    📂 #AI聊天 #本地AI #Llama #DeepSeek
    📁 Windows / macOS / Linux / Android / iOS
  15. 🔁 DreamServer
    📦 本地AI平台 | AI全家桶 | 私有化部署


    ➤ 本地优先|无需云端即可运行 AI 服务
    ➤ 一键部署|自动检测 GPU 并配置环境
    ➤ AI全家桶|集成聊天 / 语音 / RAG / 绘图 / Agent
    ➤ 多模型支持|兼容 OpenAI / Ollama / Claude 等
    ➤ 完全私有|数据本地运行 更注重隐私
    ➤ 开源免费|支持 Windows / Linux / macOS



    🌐 项目地址:
    https://github.com/Light-Heart-Labs/DreamServer

    📌 简单说:
    👉 一个“本地 AI 操作系统”,能一次性部署聊天、语音、搜索、工作流、图像生成等完整 AI 技术栈。

    ———— 商务合作————

    📂 #本地AI #AIAgent #RAG #开源项目
    📁 Windows / AI工具
  16. 💥 OpenWork|开源桌面 AI Agent 与工作流自动化平台
    Claude Cowork 开源替代 · 本地优先 · 可控、可扩展的 AI 同事

    🟢 项目亮点:


    🤖 桌面级 AI Agent: 让 AI 像真实同事一样理解任务、拆解步骤并执行
    ⚡️ 工作流自动化: 支持多步骤任务规划与执行,不止是聊天工具
    🔒 本地优先: 使用你自己的模型或 API Key,数据隐私完全可控
    🧠 人在回路: 关键操作需人工确认,避免 AI 误操作
    🔌 插件化扩展: 可自由添加技能与能力,打造专属 AI 助手
    🔓 MIT 开源: 代码透明,适合个人使用与团队二次开发


    🚀 一句话:
    这是一个把 AI 从“对话助手”升级为“可执行任务的数字同事”的开源桌面平台。

    📖 项目地址:
    👉 https://github.com/different-ai/openwork

    📢 频道 | 💬 群组 | 📬 投稿 | 📨 商务

    #开源项目 #AIAgent #工作流自动化 #AI办公 #本地部署 #效率工具 #GitHub
  17. 💥 Eigent|开源多智能体 AI 工作流与桌面办公助手
    多 Agent 协作 · 自动化真实工作流程 · 可本地部署的 AI Workforce

    🟢 项目亮点:


    🤖 多智能体协作: 多个 AI Agent 并行工作,像一个小型团队一样完成复杂任务
    ⚡️ 工作流驱动: 面向真实办公与研发流程,而不是单纯对话式 AI
    🧠 任务自动执行: 覆盖搜索、写作、开发、文档、文件管理等场景
    🔒 本地运行: 支持本地与私有化部署,数据安全可控
    🛠 高度可定制: 自定义 Agent、模型与工作流逻辑
    🔓 完全开源: Apache-2.0 协议,适合二次开发与企业使用


    🚀 一句话:
    这是一个把 AI 从“聊天工具”升级为“自动化工作团队”的开源项目。

    📖 项目地址:
    👉 https://github.com/eigent-ai/eigent

    📢 频道 | 💬 群组 | 📬 投稿 | 📨 商务

    #开源项目 #多智能体 #AI自动化 #AI办公 #工作流 #本地部署 #GitHub
  18. MTranServer | 离线本地翻译

    一个超低资源消耗速度超快的离线翻译模型服务器,无需显卡。单个请求平均响应时间 50 毫秒。支持全世界主要语言的翻译。
    注意本模型服务器专注于离线翻译、响应速度、跨平台部署、本地运行 达到 无限免费翻译 的设计目标,受限于模型大小和优化程度,所以翻译质量肯定是不如大模型翻译的效果。需要高质量的翻译建议使用在线大模型 API。

    点击访问

    #开源 #本地翻译 #AI翻译
  19. Cotypist:您的本地 AI 输入法补全助手!

    💻 这是一款全新的应用!Cotypist 将 AI 模型直接安装在您的设备上,能够在您打字的任何时候为您自动补全句子,让输入体验更流畅、更个性化!

    🟢 Cotypist 核心优势与特点:

    本地 AI 运行: 🧠 AI 模型部署在设备本地,确保您的数据隐私和输入安全。
    👤 个性化学习: 💡 AI 会根据您的输入习惯持续学习,补全的句子会越来越像您自己的说话风格。
    ⏱️ 高效输入: 🚀 实时补全,显著提高打字速度和效率。
    🌐 多语言支持: 🌐 英文测试效果惊人,波斯语(您的原文语言)等其他语言也在持续改进中。
    💰 提升体验: 💯 随着使用增加,补全功能会越来越好。

    立即体验个性化 AI 写作助手!

    🌐 准备好让 AI 助您一臂之力了吗?

    🔗 网站直达链接

    频道 | 💬 群组 | 📬 投稿 | 📨 商务

    #AI工具 #输入法 #Cotypist #本地AI
  20. 🔥 AI 圈大地震!3.5GB 模型性能干翻 Claude、Gemini?!🔥

    忘掉那些几十上百 GB 的庞然大物吧!一款名为 VibeThinker 的离线模型,正在颠覆我们对“强大”的认知!

    🚀 为什么说它是“核弹”?
    性能逆天: 在多项基准测试中,击败了 Claude, Gemini, Qwen, DeepSeek 等所有顶级模型!
    体积小到离谱: 整个模型只有 3.5 GB,比一部电影还小!
    你的电脑就能跑: 无需顶级显卡,普通电脑甚至个人服务器就能轻松运行。
    全能选手: 写代码、写文章、逻辑推理... 样样精通。

    这可能是实现“人人都能本地运行超强 AI”的第一步。

    → 前往 GitHub 探索项目
    → 前往 Hugging Face 下载模型

    频道 | 💬 群组 | 📬 投稿 | 📨 商务

    #AI #开源 #LLM #本地模型 #黑科技