~/home / Reddit
Reddit · r/LocalLLaMA

New official weights for Laguna S 2.1 FP8 & NVFP4 are now available

Laguna S 2.1 FP8 与 NVFP4 官方权重发布,专为本地运行大语言模型优化,支持更低显存占用与更高推理效率,适合开发者和AI爱好者在消费级硬件上部署高性能模型。
↑7024/天
Kanon 于 2026 年 8 月 1 日 收录 · 当时 ↑47 · 现 ↑70
为什么值得关注

FP8 和 NVFP4 量化技术显著降低显存需求,让大模型在普通GPU上也能高效运行,是本地化AI应用的重要突破。

AI开发者工具模型效率
信号来源: Reddit
访问官网 →
分享到 X
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布

同类产品

Unsloth Deepseek V4 0731 GGUF's are UP!DeepSeek v4 Flash for DS4 (DwarfStar) GGUF w/ DSpark MTP HeadWeight-Aware Streaming Tensor Engine: run Kimi K3 using 29 GB of RAM at 0.50 tok/sStripe Eyes $10 Billion Deal for AI Model Marketplace OpenRouterai-sage/GigaChat3.1-Audio-10B-A1.8B · Hugging FaceSources: OpenAI and Anthropic quietly lobby Washington regulators to restrict open-source AI models, even as Sam Altman publicly says he supports open source AI