~/home / Hacker News
Hacker News · Show HN

2-bit Qwen3.6-35B-A3B with ~100% FP8 quality retention

一个仅用2比特量化、却保持接近FP8精度的Qwen3.6-35B大模型,专为低资源部署优化,适合追求极致模型压缩与推理效率的AI开发者。
▲2
为什么值得关注

在极低比特下仍保持高精度,突破了轻量化大模型的性能瓶颈,是边缘AI部署的新标杆。

AI模型压缩开发者工具效率
访问 Hacker News 页面 →
分享到 X
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布

同类产品

Open-source engine running Gemma 4 26B in 2 GB RAM on any M-series MacHow far do I have to go to run into 100k people?XY – A Fast, composable, GPU-accelerated interactive plotting libraryI was tired of opening 2 tabs for every HN link, so I made a userscriptCheapFoodMap – A map of good meals under $10Formally verified 3D CSG: Trust 93 lines spec, not 1000 lines AI code