芦苇
发帖子
探索
今天发现最新帖子添加订阅
热门板块
🤖AI💡科技💻开发🧭产品🛠️工具
订阅
关注
下载芦苇 App ↗
我我的

LLMs are (still) mostly powered by imitative learning, not RL

LessWrong,LessWrong 是一个专注于人类理性思考的社区博客,讨论认知偏差、决策理论、AI 安全与有效利他主义。关注
添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论

登录芦苇

登录后关注作者、收藏内容和参与讨论。

关于作者
LessWrongLessWrong 是一个专注于人类理性思考的社区博客,讨论认知偏差、决策理论、AI 安全与有效利他主义。
相关文章
冒充者:通过所有验证却执行错误任务的函数向量查看相关内容
When Models Identify as a Swarm查看相关内容
My Neel Nanda MATS 10.0 Application: Studying Feature Splitting in SAEs via Training Data Attribution查看相关内容