芦苇
发帖子
探索
今天发现最新帖子添加订阅
热门板块
🤖AI💡科技💻开发🧭产品🛠️工具
订阅
关注
下载芦苇 App ↗
我我的
进入阅读器模式

I RL-trained an agent that trains models with RL (for –$1.3k)

Danau5tin (GitHub),首席软件工程师 — 研究 AI 代理和强化学习。关注

Danau5tin made Danau5tin/ai-trains-ai public · July 7, 2026 00:45

Danau5tin/ai-trains-ai

RL-training an AI agent to RL-train AI agents.

Python 233 Updated Jul 14

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论

登录芦苇

登录后关注作者、收藏内容和参与讨论。

关于作者
Danau5tin (GitHub)首席软件工程师 — 研究 AI 代理和强化学习。
相关文章
Terminal-Bench-RL: Training long-horizon terminal agents with RL查看相关内容
DeepSeek发布V4.1-Flash:新架构小模型性能超越旗舰V4-Pro查看相关内容
OpenAI的Astra对齐声明存疑,有证据表明其未对齐查看相关内容