黄仁勋半年喊了 3 次'AGI 已到来':同一个词,从使命变成了话术

9 月 7 日,黄仁勋在 X 上回复一条帖子,简短的几句话里塞了三层信息:

从 ChatGPT 到 o1,再到 Astra,只用了 4 年。 AGI 已到来。 祝贺 OpenAI 团队。 下一批 40 万块 GPU 即将上线。

就是这条帖子(7.1M 浏览、33K 赞):

这本来只是"英伟达老板祝贺 OpenAI 新模型"的商业互吹。但它冲上头条热榜 No.2(233 万热度)的原因,是这已经是黄仁勋半年内第三次宣布 AGI 到来了——3 月播客、8 月财报会、9 月发帖。

事件来源:9 月 7 日黄仁勋在 X 回复 Crusoe CEO 帖子(“从 ChatGPT 到 o1 再到 Astra,只用了 4 年。AGI 已到来。祝贺 OpenAI 团队。下一批 40 万块 GPU 即将上线”),由财联社/新浪财经、36氪(盒饭财经)报道。参考:新浪财经 · 36氪《半年三次,黄仁勋的 AGI 怎么又到了》

半年前已经实现的东西,为什么今天还能再次到来?

同一句话,三种"AGI 已来"

把三次声明摆在一起,你会看到"AGI"这个词在半年里被三个不同的定义撑起来:

3 月(Lex Fridman 播客):主持人问"AI 能不能创立并经营一家价值 10 亿美元的科技公司"。黄仁勋说"我认为我们已经实现了 AGI"——但他补了一句:“你说的是十亿美元,又没说要永远经营下去。” 他设想的是一个爆红应用,突然吸引几十亿用户,每人付 50 美分,很快消失。但追问"十万个这样的智能体能否建立一家英伟达"时,他给的答案是"零"。

8 月(财报电话会):面对投资者"递归自我改进会怎样推动算力需求"的问题,黄仁勋说:“在许多方面、对许多任务而言,我们可以说已经实现了 AGI。” 这次他主动把范围收窄了——“对许多任务而言”。他的例子很日常:持续运行的智能体更新技能文档,把经验留给下一次任务,这叫"较粗粒度的自我改进"。

9 月(X 发帖):这次依据是 OpenAI 的 GPT-6 Astra——“代际跃迁”,在计算机操作、软件工程、网络安全、科学研究达到最先进水平,ARC-AGI-3 测试得分 99.9%

三次声明,三次不同的衡量标准:能不能赚钱、能不能干活、能不能考高分。 这不是黄仁勋不严谨,是"AGI"这个词本身就没有统一标准——它被不同的人在不同场合,用来指代完全不同的东西。

最有意思的一幕:考了 99.9 分,出题人却不认

Astra 拿 99.9% 的那个测试,叫 ARC-AGI-3——名字里直接带着"AGI"。

但公布这项评测的 ARC Prize 团队没有一起宣布 AGI 到来。9 月 3 日,评测作者 Greg Kamradt 肯定了 Astra 的能力跃升,却在同一篇文章里明确写:“我们并未声称它就是 AGI。”

为什么?因为 ARC-AGI-3 的测试条件是:半私有测试集、厂商适配框架(Provider Adapter)、high 推理档位——允许模型保留内部推理状态的一套配置。而且这套题本质是"规则确定、目标封闭"的交互环境:模型需要探索、发现规则、决定下一步,但环境终究有边界。出题者保留判断的原因正是:掌握这些游戏,尚不足以证明模型能应对现实世界的开放性和复杂性。

同一张成绩单,卖芯片的看到了"到来",出题者看到了"重大进步"。99.9% 是事实,是不是 AGI 是观点。

“AGI"是怎么从使命漂移成话术的

把时间线拉长,你会看到一个词的定义被反复重写:

  • 2015 年(OpenAI 成立公告):讨论一种未来——AI 可能在几乎所有智力任务上达到人类水平
  • 2018 年(OpenAI 章程):AGI = “在大多数具有经济价值的工作中超过人类的高度自主系统”
  • 2023 年 3 月(GPT-4 发布):成绩约在律师资格考试前 10%,但发布说明同时提醒"在许多现实场景中仍不如人类”
  • 2023 年 10 月(Noema 文章《通用人工智能已经到来》):谷歌研究者认为跨主题、跨任务、跨语言处理问题,已足以叫"通用"——“通用性可以先出现,可靠性和能力水平继续提高”
  • 2023 年 11 月(DeepMind《AGI 的等级》):不做"是或不是"的门槛,把做事的广度与水平分开——“胜任"级 = 多数认知任务达到成年人中位水平,“专家"级 = 第 90 百分位。按这个标准,当时的 ChatGPT 只是"萌芽 AGI”
  • 2024 年 10 月(达里奥·阿莫代伊):“我不喜欢 AGI 这个词。” 他认为它含混、夹杂科幻和炒作,宁愿用"强大 AI”——多数相关领域比诺奖得主更出色、能长时间自主工作、能并行运行大量副本

看清楚这条线:“AGI"从一份使命宣言,变成了一个产品形容词。 2018 年章程里"高度自主 + 大多数经济价值工作"的定义,没有人真的拿来验收——因为没法验收。于是每个新模型发布,都可以顺势宣布一次"里程碑”。

程序员视角:别管它叫不叫 AGI,看它多了什么

对你我而言,真正的问题是**“这次比上次多做成了什么”**——而不是它配不配叫 AGI。

按这个标准拆 Astra 的能力跃迁,是实实在在的:

  1. 直接操作计算机:编程、科研、金融建模、做 PPT 和表格——不再是"聊天建议你做什么",是"替你做了"
  2. ARC-AGI-3 的 99.9%:即使不算 AGI,也说明"从少量样例学会规则"的能力大幅跃升——这是通用性的关键组分
  3. 黄仁勋说它由 10 万+ 块 Grace Blackwell NVLink72 集群训练:算力军备竞赛没有减速,下一批 40 万块 GPU 已在路上

这些能力变化不依赖"AGI"这个词成立。模型变强是事实,叫不叫 AGI 是修辞。 做 AI 应用的人应该盯前者,别被后者带节奏。

一句话的真相

黄仁勋半年三次"AGI 已到来",说的不是同一个东西——第一次说"能赚钱",第二次说"能干活",第三次说"能考高分"。“AGI"从 OpenAI 的使命宣言,漂移成了卖芯片的贺词、卖算力的预告、和新闻标题的流量密码。

真正诚实的表态反而是出题者那句:能力大幅跃升,但我们并未声称它就是 AGI。

明天能做的:别再争论"AGI 到底来了没”——换成问"这个新模型比上一个多了什么我能用的能力"。前者是宗教,后者是工程。


搬砖程序员带你飞,专注 Golang / AI / 后端。每天一篇,讲清楚一个技术真相。

0%