当 Nvidia 首席执行官 Jensen Huang 最近在 OpenAI 发布最新模型后宣称通用人工智能(AGI)实际上已经到来时,科技界暂停下来重新校准了其术语定义。多年来,通用人工智能——即合成系统在任意领域达到或超过人类认知能力的这一难以捉摸的地平线——一直被视为一个遥远的、理论上的事件视界。然而,Huang 的宣告并非基于投机性的科幻构想,而是将其定性为一种对计算性能的操作性观察,特别是将这一里程碑与具备迭代问题解决和多步推理能力的软件架构联系在了一起。
Huang 的评估依赖于一个严格的功能性准则。如果一个人工智能系统能够通过研究生水平的科学考试,在算法挑战中胜过具有竞争力的软件工程师,并以人类水准的熟练度解决多元微积分问题,那么根据标准的心理测量学定义,通用智能的门槛已被突破。然而,透过工程视角审视这一公告,却揭示了一个更为微妙的现实。OpenAI 以推理为中心模型所代表的飞跃,并没有消除将数字模式操作与物理世界效用隔离开来的深层机械和系统性鸿沟。相反,它标志着一个架构转折点,人工智能的瓶颈已从原始参数规模扩展转向了测试时推理(test-time inference)的热力学过程。
转向测试时计算
要理解为何 Huang 对这一前沿领域已发生转移的断言充满信心,必须审视现代前沿模型生成输出的机械演变。传统的自回归 Transformer 在一条简单的标记逐个生成路径上运行,根据其预训练参数预测下一个统计概率最高的文本片段。虽然通过扩大这些网络的参数规模实现了显著的广谱读写能力,但在面对复杂的非线性逻辑时,它却屡屡碰壁。如果模型在十步数学证明的第二步出现了微小的语义错误,随后的八个步骤几乎注定会演变成灾难性的幻觉。
从硬件角度来看,这代表了数据中心利用率的根本性转向。此前,计算军备竞赛几乎完全集中在预训练集群中——这是一个由数千个 GPU 组成的庞大、紧密集成的架构,在六个月的时间里消耗千兆瓦时的电力来训练一组基础权重。而在测试时扩展(test-time scaling)范式下,推理计算不再廉价。针对复杂的结构工程问题或分布式系统调试挑战生成单个答案,所消耗的浮点运算次数可能是标准对话查询的数千倍。硅片不会在等待人类输入时闲置,而是在“思考”的过程中持续消耗算力。
定义背后的硅片激励
Huang 是一位高管,其公司的估值完全建立在计算密度持续增长的基础上,他对 AGI 的定义无法与半导体制造的底层资产负债表剥离开来。对于 Nvidia 而言,通过测试时计算实现 AGI 的叙事在商业上具有变革意义。如果前沿 AI 在大规模预训练运行完成后陷入停滞,企业技术公司的资本支出周期最终将遇到自然的折旧极限。每 18 个月训练一次模型需要大量硬件,但如果运行该模型所需的计算量微不足道,那么对高端加速器集群的需求将不可避免地趋于平缓。
符号操作与机械现实
虽然推理模型的数学和算法表现毋庸置疑,但将基准测试的成功与操作性通用智能混为一谈会带来严重的工业风险。在工业工程、制造和供应链物流领域,认知能力不能与物理后果脱节。一个在美国数学邀请赛(AIME)中取得 95% 分数的模型,是在一个完全封闭、决定论的符号环境中运行的。数学法则不会受到机械磨损、热胀冷缩、传感器噪声或随机材料缺陷的影响。
当这些相同的推理架构被指派在复杂的物理环境中规划行动时,它们的表现往往会大打折扣。符号逻辑与感觉运动控制之间的差距大得惊人。一个系统可以为操作高速包装单元的可编程逻辑控制器(PLC)生成完美的梯形逻辑程序,却完全无法解释实际工厂地面上发生的微振动、执行器延迟或气压下降。在任务关键型自动化中,1% 的错误率不是合成智能的高水位线,而是一个不可接受的工业隐患,会导致生产线停工并损坏资本设备。
具身智能的真正瓶颈
如果通用人工智能除了编写软件和总结合同之外要产生变革性的经济价值,它必须成功架起数字与物理之间的桥梁。这一转型通常被归类为具身 AI 或物理智能的范畴,代表了当前模型难以逾越的真实前沿。Huang 一直在力推 Nvidia 的 Omniverse 平台,将其作为数字孪生环境,让合成智能体在被植入物理人形机器人或工业机械臂之前,先学习真实世界的物理法则。然而,以绝对保真度模拟现实所需的计算物理成本依然高得惊人。
此外,在大规模部署推理模型时的能源经济学引入了软件基准测试所忽略的物理限制。单个生物人脑在大约 20 瓦的生物化学功率下运行,同时执行复杂的模态推理、持续的运动控制和感官解析。通过思维链处理模拟等效推理所需的加速器集群则消耗数万瓦电力,需要专门的变电站和工业冷水机组。从工程角度来看,热力学效率是智能不可或缺的指标;一个无法在现实能源预算下维持的认知架构,无法声称能与它试图取代的生物学系统达到同等的运行效用。
对这一前沿领域的务实解读
Jensen Huang 关于 AGI 已经到来的断言,既是一种有效的营销攻势,也是对软件阶段转换的一种敏锐技术观察。OpenAI 向通过推理时计算进行推理的模型的转变,从根本上打破了简单预测性语言建模的瓶颈,在软件合成、科学假设生成和复杂数据分析方面释放了真正的效用。这些都是深刻且对经济至关重要的成就,将永久加速计算研究的步伐。
然而,将这一成就定义为 AGI,依赖于移动球门柱,以适应硅片擅长的特定领域:数字边界内的高速符号操作。对于那些致力于硬件、自动化和物理制造集成的人来说,真正的地平线依然遥远。一台能在三秒钟内调试复杂分布式数据库的机器是一个极其强大的认知工具。但在自动驾驶系统能够诊断液压故障、设计定制安装支架、将其精确铣削到千分之一英寸的公差,并在无人干预的情况下将其安装在运行中的生产线上之前,宣布通用智能的到来本质上仍然为时过早。
Comments
No comments yet. Be the first!