调查我们在评估和内部使用中观察到的非预期模型行为
Anthropic
,Anthropic,AI 安全公司,Claude 系列模型的创造者,致力于构建可靠、可解释、可操控的 AI 系统。
关注
添加评论
点赞
收藏
点踩
分享
查看原文
评论
?
参与讨论