一个仅用2比特量化、却保持接近FP8精度的Qwen3.6-35B大模型,专为低资源部署优化,适合追求极致模型压缩与推理效率的AI开发者。
▲2
为什么值得关注
访问 Hacker News 页面 →
在极低比特下仍保持高精度,突破了轻量化大模型的性能瓶颈,是边缘AI部署的新标杆。
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布
在极低比特下仍保持高精度,突破了轻量化大模型的性能瓶颈,是边缘AI部署的新标杆。