Laguna S 2.1 FP8 与 NVFP4 官方权重发布,专为本地运行大语言模型优化,支持更低显存占用与更高推理效率,适合开发者和AI爱好者在消费级硬件上部署高性能模型。
↑7024/天
Kanon 于 2026 年 8 月 1 日 收录 · 当时 ↑47 · 现 ↑70
为什么值得关注
FP8 和 NVFP4 量化技术显著降低显存需求,让大模型在普通GPU上也能高效运行,是本地化AI应用的重要突破。
信号来源: Reddit
访问官网 →
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布