芦苇
发帖子
探索
今天发现最新帖子添加订阅
关注
订阅
我我的

Scaling Coding-Agent RL to 32x H100s. 160% Improvement on Stanford's TBench

Danau5tin (GitHub),首席软件工程师 — 研究 AI 代理和强化学习。关注
添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论

登录芦苇

登录后关注作者、收藏内容和参与讨论。

关于作者
Danau5tin (GitHub)首席软件工程师 — 研究 AI 代理和强化学习。
相关文章
Danau5tin starred ThorOdinson246/whatisit-nl2sh查看相关内容
Danau5tin starred PrimeIntellect-ai/prime-agent查看相关内容
我用1300美元训练了一个能训练AI的AI Agent查看相关内容