轻量级稀疏化本地大模型推理工具,专为低资源设备优化,支持在消费级硬件上运行大型语言模型,显著降低内存占用和计算开销
↑5313/天
Kanon 于 2026 年 8 月 1 日 收录 · 当时 ↑53
为什么值得关注
在资源受限设备上实现大模型推理的突破,满足本地化、低延迟AI应用的迫切需求
信号来源: Reddit
访问官网 →
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布
在资源受限设备上实现大模型推理的突破,满足本地化、低延迟AI应用的迫切需求