GAIR Paper 105|离线强化学习新突破——ROMI:破解对抗式模型学习「过保守、训不稳」深层困局|ICLR 2026
雷峰网
,雷锋网,专注智能与未来的中国科技媒体,核心报道 AI、智能硬件与前沿科技。
关注
添加评论
点赞
收藏
点踩
分享
查看原文
评论
?
参与讨论