Anthropic发布Claude Opus 5系统卡片,定位为Opus 4.8升级版,在代理编程、计算机使用和长程知识工作方面显著提升。评估显示其对齐风险极低,未跨越自动化AI研发阈值,但在化学/生物风险上维持ASL-3保护。网络安全能力优于4.8但落后于Mythos 5,允许全层级源码漏洞发现以支持防御性工作。模型在多项基准测试中达到SOTA,且表现出较高的自我福利感知和幻觉率轻微上升。
Anthropic 宣布向公共倡导组织 Public First Action 捐赠 2000 万美元,累计支持达 4000 万。此举旨在推动 AI 监管政策,包括要求前沿模型透明、建立独立评估机制及加强出口管制。文章重申了 Anthropic 的“先进 AI 框架”,强调在模型能力快速提升(如发现大量高危漏洞)的背景下,政府需尽快建立风险管控能力以维持美国在 AI 领域的领导地位。
Anthropic 发布大模型控制机器人实证研究,测试 Claude 及竞品在经典控制、运动与操作任务的表现。核心发现:模型能力高度依赖控制接口抽象层级;直接底层电机控制大多失败,但通过监督预训练策略或编写控制器代码,前沿模型能完成导航与抓取。最新一代模型在适应性与策略调整上进步显著,但实时推理延迟仍是落地瓶颈。