[程序员] Grok 4.5 发布,部分 Benchmark 超过 Opus 4.8
x.ai/news/grok-4-5 亮点: 在 DeepSWE ,Terminal Bench 中超过 Opus 4.8 Max $2 百万输入 / $6 百万输出 80 TPS Token 效率比 GPT 5.5 ,Opus 4.8 高。Artificial Analysis 单任务花费少于 GLM 5.2 支持视觉,500K 上下文,马斯克说后续将扩展到 1M 如果体验能跟上分数,Grok 又能上桌了。
评论
?
参与讨论