AIHOT 日报 · 2026-09-23 — Anthropic 发布 Claude Opus 5.5,成本较 Opus 5 降低 40%
Anthropic 发布 Claude Opus 5.5,成本较 Opus 5 降低 40%
模型发布/更新
- Anthropic 发布 Claude Opus 5.5,成本较 Opus 5 降低 40%
- OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,API 价格较 GPT-5.6 降 50%
- Claude Opus 5.5 发布:较 Opus 5 降价提速,系统卡披露安全演习中约半数运行或有危害行为
- GPT-6 Sol 与 GPT-6 Luna 在 ChatGPT Work 和 Codex 中推送
- Claude Opus 5.5 上线 OpenRouter,智能体编码等能力领先 Opus 5
- Qwen-Image-2.1 开源发布,登顶 Arena 图像编辑榜开源第一
- Boris Cherny 实测 Claude Opus 5.5:比 Fable 5.1 快且便宜 51%
- Anthropic 发布 Claude Opus 5.5,Claude 5.5 系列首个模型
产品发布/更新
- transformers 支持直接加载 GGUF 量化模型,本地推理性能接近 llama.cpp
- OpenRouter 推出 Batch API,批量推理可享半价
- Kimi 发布浏览器扩展,由 Kimi WebBridge 更名而来
- Claude Code v2.1.280 发布,新增 Claude Opus 5.5 为默认 Opus 模型
- LiteParse 9 月更新:PDFium 提速 20-25%,新增视觉定位与 is-complex 路由 API
- Apple 新款 Mac mini(M6/M5 Pro)与 Mac Studio(M5 Max/M5 Ultra)今日开售
- OpenAI 为 GPT-6 推出改进的提示词缓存系统与诊断工具
行业动态
- 五角大楼内部审查:过度依赖 Palantir Maven AI 系统导致误击伊朗学校、123 名儿童死亡
- Claude Opus 5.5 上架 Arena 的 Agent Arena 与 Battle Mode
技巧与观点
- Claude Opus 5.5 登顶 Artificial Analysis 智能指数,得分 58
- Artificial Analysis 评测 GPT-6 Sol 和 Luna:成本减半但各评测有升有降
- 卡兹克实测对比 Grok 4.7 与小米 MiMo V2.6:后者成不可能三角版本答案
- Artificial Analysis 评测 Step 5 Preview: Intelligence Index 得 44 分,成本约为同级模型 1/2.8
- OpenRouter 实测 Jev 1.13 与 Claude Opus 5 在 Banking77 分类任务上的准确率、延迟与成本
- OpenRouter 解读 NVIDIA Nemotron 3.5 Lightning 如何承担 Agent 高频执行调用
via AIHOT ·
评论
?
参与讨论