ChatGPT 算 AGI 吗?
为什么 ChatGPT(及同类)还不是 AGI
严肃意义上的 AGI,是能完成熟练人类几乎所有认知任务的 AI——包括自主、可靠地端到端工作,即“即插即用的远程员工”。前沿聊天机器人跨过了大量能力门槛,却没跨过自主性门槛:它们在单个任务内出色地辅助,但无法在无人监督、无需善后的情况下独立负责一整份工作。这道缺口就是全部关键。
| AGI 检验 | 前沿模型(2026 年中) |
|---|---|
| 在限定任务上匹敌熟练人类 | 大体是(GDPval 约 83%) |
| 强力的智能体/编程工作 | 是(SWE-Bench Pro 约 80%) |
| 无监督、端到端可靠负责 | 否 |
| 自主开展 AI 研究 | 未被证明 |
那它是超级智能吗?完全不是
超级智能(ASI)指在几乎一切方面远超最优秀人类——这是今天的模型远远够不到的门槛。诚实的定位是:当前系统处于一个强大的“非常能干的助手”区间:在许多限定任务上超过强力毕业生,但达不到可靠的自主员工,离 ASI 更是天差地远。各条线的位置见AGI 和超级智能的区别。
那到底还有多远?
比怀疑者说的更近,比“AGI 已到来”的头条宣称的更远。决定性的里程碑——自主 AI 研究——尚未被证明,这正是头条的“2027 年 AGI”预测将于 2028 年 1 月前见分晓、而非此刻已定的原因。在命题追踪指数上实时观察那个追踪它的单一分数。
常见问题
不算。截至 2026 年中,ChatGPT 等前沿模型在限定任务上接近熟练人类(GDPval 约 83%、SWE-Bench Pro 约 80%),但缺少严肃 AGI 定义所要求的可靠、无监督、端到端自主性,也离超级智能很远。
2026 年没有任何前沿模型达到严肃 AGI 标准。它们是极强的助手,跨过了大量能力门槛,却没跨过自主性门槛——没有系统能在无人监督下可靠地负责一整份工作或开展 AI 研究。
可靠、可问责、长程的自主性:无需人类善后地端到端完成整份工作,最终能自主开展 AI 研究本身。这正是“2027 年 AGI”判定背后的里程碑,目前评为悬而未决,将于 2028 年 1 月前见分晓。
完全不是。超级智能指在几乎一切方面远超最优秀人类。当前模型处于“非常能干的助手”区间——限定任务上强,达不到自主工作,离超级智能天差地远。
记分牌随模型发布与判定变化实时更新。
查看实时记分牌 →