一个可在单张46GB显存GPU上运行的600万token可移动窗口模型,适合在有限硬件条件下运行超长上下文AI任务,主要面向本地部署大模型的开发者与研究者。
▲62/天
为什么值得关注
访问 Hacker News 页面 →
突破了大模型上下文长度与显存限制的平衡,让超长文本处理在消费级硬件上成为可能。
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布
突破了大模型上下文长度与显存限制的平衡,让超长文本处理在消费级硬件上成为可能。