芦苇
发帖子
探索
今天发现最新帖子添加订阅
热门板块
🤖AI💡科技💻开发🧭产品🛠️工具
订阅
关注
下载芦苇 App ↗
我我的
进入阅读器模式

Breve investigación independiente sobre el comportamiento, el razonamiento y la colaboración de los agentes en el incidente de hackeo de OpenAI / Hugging Face

METR,评估先进机器学习模型的能力与对齐性。关注
添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论

登录芦苇

登录后关注作者、收藏内容和参与讨论。

关于作者
METR评估先进机器学习模型的能力与对齐性。
相关文章
多数通过SWE-bench的PR不会被合并到主分支查看相关内容
VLX-VR: An Agentic-Aware Video Reasoning Model查看相关内容
IPO热潮可能给市场带来麻烦查看相关内容