别再谈论AGI了:我们应重新定义AI进步的衡量标准
作者反对用“AGI时间表”来衡量AI进展,认为这暗示了AGI必然到来且定义模糊。文章提出应关注“单位人类投入产生的AI产出比”,并以自动驾驶从追求“完全无人驾驶”转向衡量“每人工干预行驶里程”为例。作者指出,尽管OpenAI o1和DeepSeek R1等新模型能自我纠错生成更长输出,反驳了Yann LeCun关于误差累积的观点,但AI最终仍需人类介入,因为纯自主生成的信号会衰减。结论是应像看待自动驾驶一样看待LLM,关注其独立工作的时长/能力提升,而非虚幻的AGI终点。 



