EN
~/home / GitHub
GitHub · Python

slime

一个用于强化学习扩展的LLM后训练框架,专注于提升大模型在RL场景下的训练效率与性能,面向AI研究与工程团队
1.4k 票
🤖 Agent 拆解 · research
解决什么场景提升大模型在强化学习场景下的训练效率与性能
目标市场AI研究与工程团队
牵引 · 为什么在涨1373
为什么值得关注

聚焦RL Scaling这一前沿方向,为大模型训练提供可复用的工程框架,具备技术深度和研究价值

AI机器学习开发者工具研究工具
访问 GitHub 页面 →
分享到 X
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布

同类产品

hermes-agentAutoGPTlangchainbrowser-usedeer-flowautogen