一个基于 DeepSeek v4 Flash 的轻量级本地大模型推理版本,专为低资源设备优化,支持 GGUF 格式与 DSpark MTP 头部结构,适合开发者在本地运行高效、低延迟的 AI 推理任务。
↑8823/天
Kanon 于 2026 年 8 月 1 日 收录 · 当时 ↑44 · 现 ↑88
为什么值得关注
在资源受限设备上实现高性能大模型推理,满足对隐私与低延迟有要求的本地 AI 应用场景。
信号来源: Reddit
访问官网 →
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布