五角大楼部署 Grok AI 指挥伊朗战争中的 2000 次打击行动

Grok
Pentagon Deploys Grok AI to Orchestrate 2,000 Strikes in Iran War
法庭文件披露,美国军方已将埃隆·马斯克的 Grok 政府版模型集成到“Maven”智能系统中,以在“史诗愤怒行动”(Operation Epic Fury)中执行高速目标打击。

在现代电子战的高风险领域,从以人为中心的决策向算法瞄准的过渡已达到了令人震惊的新速度。最近的法律披露证实,美国国防部使用了Elon Musk旗下xAI开发的Grok模型,以辅助针对伊朗目标的大规模空袭行动。这一披露并非来自军方简报,而是源于一场国内环境诉讼,它为外界提供了一个难得的窗口,得以窥见“Grok政府模型”(Grok Gov Model)的技术细节,以及它在五角大楼所谓的“史诗之怒行动”(Operation Epic Fury)中所扮演的角色。

Grok政府模型与Maven智能系统的架构

要了解聊天机器人是如何演变成瞄准引擎的,必须着眼于xAI与五角大楼“Maven项目”(Project Maven)之间的机械和软件集成。Maven项目最初旨在实现无人机影像分析的自动化,现已发展为“Maven智能系统”(Maven Smart System, MSS)。该平台主要与Palantir合作开发,充当集中式仪表板,能够摄取海量的卫星图像、信号情报(SIGINT)和人力情报(HUMINT)数据。

Grok政府模型是商业版Grok大型语言模型(LLM)的专用衍生版本,充当该系统架构中的分析层。虽然公开版Grok以其不羁的语调和对社交媒体数据的实时访问能力而闻名,但军用版则针对模式识别和离散数据点的综合进行了优化。当输入高分辨率卫星图像和截获的通信内容时,该模型能以远超人类情报官员的速度识别异常情况,例如移动导弹发射车的行踪或特定后勤枢纽的加固情况。“史诗之怒行动”中96小时的突袭行动,便是这种作战效率提升的概念验证,人工智能在其中充当了目标获取的“力量倍增器”。

转向Grok也标志着美军在很大程度上不再依赖其他前沿模型。冲突早期有报道称,五角大楼曾使用Anthropic的Claude模型执行类似任务。然而,在内部争议及据称来自特朗普政府要求放弃Anthropic的行政命令之后,军方转向了xAI。五角大楼目前将Grok列为“最高国家安全”事项,理由是该模型具备竞品系统所不具备的功能,尤其是其以更低延迟处理实时数据流的能力。

算法战争的工业成本

从工程角度来看,一个能够在四天内协调2,000次打击的模型,其电力需求是巨大的。对这些模型进行大规模训练和推理需要稳定且持续的电力供应。美国司法部代表xAI介入此事,辩称密西西比州的数据中心对国家安全至关重要。通过承认该设施为伊朗战场上使用的Grok政府模型提供动力,政府实际上是在主张《清洁空气法案》(Clean Air Act)应让位于在活跃战区保持人工智能驱动优势的必要性。

环境法与军事必要性之间的这种交集,揭示了数字战争的物理足迹。据称,为了维护Maven项目运行所需的硬件,xAI绕过当地审批程序安装了燃烧涡轮机。这表明现代人工智能驱动战争的瓶颈不仅在于代码的复杂程度,还在于产生电力的原始工业产能。对于密西西比州的社区而言,伊朗的战争并非遥不可及的地缘政治事件,而是一场由瞄准系统所需的服务器机房引发的局部环境健康危机。

动力瞄准中“幻觉”带来的技术风险

尽管Grok政府模型被吹捧为高效,但在战争中使用大语言模型引入了一个危险变量:人工智能倾向于“产生幻觉”或依赖陈旧数据。虽然五角大楼强调其打击的精确性,但伊朗当地的现实情况却更为复杂。有报道称平民基础设施遭到打击,包括阿扎迪体育中心(Azadi Sport Complex)和Shajareh Tayyebeh女子学校。后者受到的打击造成了重大伤亡,并已被证实与人工智能辅助瞄准过程中的失误有关。

从技术层面看,这种失效模式通常涉及人工智能训练数据与当前地面现实之间的不匹配。如果数据库将某座建筑列为军事仓库,但该建筑十年前已被改建为学校,那么在96小时窗口内处理数千个目标的人工智能模型,可能缺乏启发式检查来核实这一变化。人类分析师在承受96小时时间框架所要求的“作战效率”压力下,可能会过度依赖人工智能的建议,从而导致一种被称为“自动化偏见”的现象。

核心问题仍然是这些打击手段缺乏透明度。虽然Grok政府模型可以处理数百万个数据点,但如果没有持续、高保真的地面真相,它无法考虑到人类生命的细微差别或城市空间不断演变的使用方式。当军方将目标获取的速度置于目标性质的核实之上时,系统的算法效率就成了民用安全的隐患。“史诗之怒行动”中部署的2,000枚弹药可能确实命中了预定坐标,但这些坐标是否为合法的军事目标,仍是国际社会激烈争论的焦点。

人工智能-工业复合体的未来

在伊朗部署Grok标志着硅谷与国防部之间关系发生了永久性转变。我们正在告别科技公司可以置身于其产品军事化应用之外的时代。通过融入Maven智能系统,xAI已将自己定位为关键国防承包商,足以比肩洛克希德·马丁(Lockheed Martin)或雷神(Raytheon)等老牌巨头,且其产品的迭代速度是以软件而非硬件的速度进行的。

作为一名机械工程和机器人专家,我认为这是数字阵线与物理阵线的最终融合。机器人不再仅仅是无人机或导弹,它涵盖了识别、选择和授权打击的整个认知系统。五角大楼提到的96小时窗口是一个工业吞吐量指标,其处理方式与自动化工厂生产线的产出并无二致。然而,当该生产线的产品是致命打击时,其容错空间是不存在的。

Noah Brooks

Noah Brooks

Mapping the interface of robotics and human industry.

Georgia Institute of Technology • Atlanta, GA

Readers

Readers Questions Answered

Q Grok Gov 模型如何融入五角大楼现有的军事基础设施?
A Grok Gov 模型是 Maven 智能系统(Maven Smart System)的分析层,该平台由 Palantir 开发,旨在整合来自卫星、信号和人类情报的数据。与商用版 Grok 不同,该军事衍生版本针对高速模式识别进行了优化。它能识别移动导弹发射车移动和后勤枢纽加固等异常情况,使系统处理目标数据的速度显著超过传统的人工分析。
Q 为什么位于密西西比州的 xAI 数据中心成为法律和环境争议的对象?
A 美国司法部认为,密西西比州的设施是一项关键的国家安全资产,因为它为活跃战区中使用的 Grok Gov 模型提供动力。据称,为了满足协调数千次打击所需的巨大电力需求,xAI 绕过了当地许可证安装了燃气轮机。这引发了环境诉讼,政府主张 AI 驱动的军事优势需求应凌驾于传统的《清洁空气法》法规之上。
Q 使用像 Grok 这样的大型语言模型进行动态军事打击存在哪些技术风险?
A 主要技术风险是算法幻觉,即 AI 依赖过时或错误的数据来识别目标。据报道,在“史诗愤怒行动”(Operation Epic Fury)期间,由于该模型未能识别建筑物被挪作他用的现状,这导致了对平民设施的打击。此外,人类操作员可能会产生自动化偏见,盲目信任 AI 的高速建议,而未执行必要的启发式检查以核实合法的军事目标。
Q 美国军方为何从使用 Anthropic 的 Claude 模型转向 xAI 的 Grok 模型?
A 此次转变发生在内部纠纷以及据报道特朗普政府发布行政命令要求弃用 Anthropic 模型之后。五角大楼目前将 Grok 列为国家安全必需品,声称与竞争对手相比,它提供了更低的延迟和更优越的实时数据流处理能力。这一转变突显了向 xAI 架构的战略转向,以支持“史诗愤怒行动”等大规模空中战役的高速需求。

Have a question about this article?

Questions are reviewed before publishing. We'll answer the best ones!

Comments

No comments yet. Be the first!