llama.cpp 是一个用 C/C++ 实现的本地 LLM 推理框架,支持在 CPU 上运行 Llama 等大模型,无需 GPU,适合边缘设备和隐私敏感场景。
⭐121.9k🔥 +79 近1日
为什么值得关注
访问 GitHub 页面 →
在无 GPU 环境下实现大模型本地推理,兼顾性能与隐私,是边缘 AI 推理的标杆项目。
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布
在无 GPU 环境下实现大模型本地推理,兼顾性能与隐私,是边缘 AI 推理的标杆项目。