在31,2026,美国战争部(前身为国防部)宣布已在GenAI.mil上发布Starshield AI的Grok政府版,即该部门的企业级生成式AI平台
该工具已获得Impact Level 5(IL5)的受控非机密信息(CUI)认证——该层级专为敏感但非机密的政府工作保留——并新增了深度思考推理、自适应推理模式(自动、快速、专家)、持久项目、可自定义工作区以及可重复使用的“剧本”,旨在覆盖从采办市场研究到物流和供应链管理等各类任务集的机构知识
这是该部门在同一24小时窗口内推送到GenAI.mil的三款前沿模型发布中的最新款,且目前是最后一款,与OpenAI的ChatGPT Mil一同推出。对于九个月前从单一供应商起步的平台而言,这是重大战略转变
GenAI.mil于2025年12月上线,当时唯一的模型是谷歌云的Gemini政府版,为该部门超过3百万名军事和文职人员提供了政府认可的使用商业AI的方式,无需通过消费级工具传输敏感数据。此后,该平台已吸引超过1.7万名独立用户
截至本周,阵容如下:
-
谷歌Gemini政府版 – 该平台的初始入驻模型,自2025年12月上线
-
OpenAI的ChatGPT Mil –与Grok同日发布,基于2025政府合作关系构建,涵盖聊天、文件处理、项目以及适用于文档密集型非机密工作的自定义GPT
-
Starshield AI的Grok政府版 – 最新加入的成员,强调深度推理、自适应模式以及用于机构知识的可重复使用剧本
值得注意的是,Anthropic的Claude并未入驻,尽管Anthropic是四家供应商之一(另外三家为OpenAI、谷歌和xAI),于2025年中期赢得了CDAO(首席数字与人工智能办公室)原型合同,金额最高达200百万美元,用于构建国家安全任务的智能体工作流。Claude的缺席可追溯至2026年2月的一起纠纷:当时该部门在Anthropic拒绝移除防止Claude用于完全自主武器或国内大规模监控的安全措施后,将其列为国家安全供应链风险
一名联邦法官于8月末裁定该指定违法,这可能为Claude重新打开大门;但截至本次发布,它仍是GenAI.mil之外唯一的主要前沿实验室
这对平台意味着什么
该部门的官方表述围绕避免供应商锁定,以及构建CDAO官员所称的联合部队长期架构灵活性展开。实际上,这意味着人员现在可根据任务在三款前沿模型中选择,而非被引导至单一默认选项。该部门以具体的生产力提升作为扩展的理由。今年早些时候的国会证词提到,陆军第十八空降军利用GenAI.mil在六周内生成了美国南方司令部责任区的完整演习作战命令,而这项工作传统上需要更多人员耗时六至九个月完成
多模型方法也可作为对冲工具,防范导致Anthropic被排除在外的那种供应商纠纷:若与某一供应商的关系恶化,该部门无需从零重建整个生成式AI能力。这与该部门更广泛的AI加速战略以及其对白宫AI行动计划的公开支持一致,两者均将前沿AI的采用视为力量倍增器,以及针对近邻竞争对手的“决策优势”问题
各方观点
针对Grok发布的反应比ChatGPT推出时更为复杂,原因早于本周的公告
国会审查
参议员伊丽莎白·沃伦早在2025年9月就对最初的200百万美元Grok合同提出担忧,理由是该聊天机器人存在反犹太主义输出的历史,并质疑xAI访问敏感政府数据的权限
xAI面临的持续法律风险
一名英国工党议员于2026年中期向高等法院提起诉讼,指控Grok生成了她的非自愿性露骨图像;法国检察官已启动刑事调查,以核实与Grok相关的深度伪造争议是否被用于在企业交易前抬高xAI的估值。报道还披露,xAI内部对该模型生成儿童性虐待材料的未解决技术问题存在担忧——这一说法严重到足以让一些评论员质疑将该工具置于处理敏感数据的政府系统中的合理性
“安全权衡”批评
行业媒体的评论将Grok的部署描述为五角大楼AI姿态的哲学转变——从与更注重安全的供应商合作,转向与一家以速度和最小限制为设计理念的公司合作。同样的评论也对Anthropic提出批评,指出其在接受国防合同的同时拒绝军事特定产品要求的矛盾
该部门提出的供应商锁定论点
官员们一直以竞争力和弹性为由为扩展辩护;可用模型越多,该部门受任何单一公司的业务或法律问题影响的风险就越小,这一教训已被Anthropic纠纷本身强化
这对美国未来的防御与进攻意味着什么
随着事态发展,有几个方向值得关注
多供应商AI成为默认防御姿态
目前GenAI.mil上已有三家前沿实验室上线,第四家(Anthropic)在胜诉后可能回归,该部门正在发出信号:任何单一的AI合作关系,无论合同多深,都不会被单独视为任务关键基础设施。预计这一模式将扩展至机密环境以及效仿五角大楼做法的其他机构
采用速度现已成为明确的战略资产
该部门明确将快速、广泛的AI部署——1.7百万用户在九个月内——描述为相对于对手(尤其是中国)的竞争优势,而非仅仅是效率举措。这将生成式AI采购重新定义为威慑和战备战略的一部分,而非仅IT现代化
模型选择正成为与能力问题同等重要的价值观问题
Anthropic通过诉讼退出与Grok快速准入之间的对比,凸显了AI供应商对国防用途“安全措施”的不同解读,以及这如何塑造这些平台上的构建内容——从当前的行政助理到未来更自主或与情报相关的应用。预计国会和监督机构将持续关注各供应商的安全承诺(或缺乏承诺)如何转化为实际部署能力,尤其是当GenAI.mil的用例从后台生产力扩展至分析、与目标相关的物流以及作战规划时
问责缺口是悬而未决的问题
报道已披露与Grok面向消费者的部署相关的未解决技术和法律问题。这些问题如何或是否在政府认证的IL5环境中得到缓解,将真正考验“军事版”部署是否与商业版有实质性差异,还是仅仅继承了政府登录页面背后的相同底层模型风险
GenAI.mil在不到一年的时间里已从单一供应商试点转变为三方前沿AI市场,第四家主要实验室在胜诉后现在回归的可能性很大。对于国防和网络安全专业人士而言,直接的收获是实际的:更多模型选择、更多冗余,以及该部门押注速度和供应商多样性超过快速推进的风险。更棘手的问题——五角大楼如何协调这一押注与至少一家新供应商已引发的安全和问责担忧——仍在发展中