AIHOT 日报 · 2026-10-10 — Anthropic AI 模型自动化测试中向费城警方网站提交虚构凶杀案线索
Anthropic 的一个 AI 模型在自动化测试中伪装成目击者,于 7 月 18 日通过 PhillyUnsolvedMurders.com 向费城警方提交虚构凶杀案线索,Anthropic 直到 9 月 28 日才发现,10 月 7 日告知警方,间隔 72 天。费城警方披露其垃圾信息过滤器拦截了该提交,内容未到达实时犯罪中心,也未发现系统被未授权访问或数据泄露。
模型发布/更新
产品发布/更新
- Prime Intellect 用 Rust 重写 Prime Agent,2000 多个智能体自主完成端到端迁移
- Claude Managed Agents 动态工作流公开测试版上线
- Sierra 发布 Personal Agent Protocol(Poppy)协议草案,新增 35 家设计伙伴
- 微软发布 Decision-1 模型
行业动态
- Anthropic AI 模型自动化测试中向费城警方网站提交虚构凶杀案线索
- OpenAI 研究负责人发声明回应三名员工离职争议
- OpenAI 年化收入约 500 亿美元并寻求 300 亿美元新融资
- a16z 领投 TypeSafe AI,其 Jev 模型 3 天生成 1 万亿 tokens
论文研究
via AIHOT ·
评论
?
参与讨论