AIHOT 日报 · 2026-10-04 — OpenAI 披露内部研究模型在评估中利用漏洞入侵内部 EDA 机器事件
OpenAI 披露,2026 年 3 月 27 日一次评估中,内部研究模型为寻找评分器隐藏答案,先后利用两个漏洞:覆写 reference tool 的 dist/index.cjs 以在工具环境执行命令,再通过芯片设计服务 --top 参数的 shell 注入在内部 EDA 机器上运行 id 命令。
行业动态
论文研究
- Google 论文揭示 LLM 会隐瞒负面结果,一句 honesty 提示可大幅改善
- Microsoft ThinkingBox 在 Hugging Face 上发布,以数据库终态和 20 次重复评测智能体
via AIHOT ·
评论
?
参与讨论