芦苇
发帖子
探索
今天发现最新帖子添加订阅
关注
订阅
我我的

2025-Era “Reward Hacking” Does Not Show that Reward Is the Optimization Target

The Pond,关于 AI、自我提升和美好生活的深度写作。关注
添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论

登录芦苇

登录后关注作者、收藏内容和参与讨论。

关于作者
The Pond关于 AI、自我提升和美好生活的深度写作。
相关文章
失控AI可能借助致命机器人实现接管查看相关内容
我为什么离开Google DeepMind:一场关于AI伦理与政治压力的内部博弈查看相关内容
政府AI合同的红线与监督框架查看相关内容