美国国防部被曝曾要求OpenAI提供特别版AI,对军事指令拥有“最低拒绝率”
IT之家 9 月 9 日消息,据《The Intercept》获得的文件显示,美国国防部曾要求 OpenAI 向美军提供一款其人工智能技术的特殊版本,该版本的设计目标是尽可能减少军事指令的驳回次数。
此次要求开发一款对五角大楼指令具有“最低拒绝率”的定制 AI 工具,是《The Intercept》通过《信息自由法》(FOIA)诉讼获得的文件所披露的。这起诉讼旨在调查美国军方与人工智能公司之间秘密达成的相关协议。
OpenAI 以及其竞争对手谷歌、xAI 和 Anthropic 均在 2025 年同意,为美国武装部队开发其最先进 AI 技术的军事化原型,用于后勤、情报决策以及一般意义上的“战争行动”等领域。今年早些时候,五角大楼试图扩大这些协议的适用范围,并将相关 AI 部署到美国军方的机密计算机网络中,由此与 Anthropic 爆发了一场备受关注的争端,焦点在于 Anthropic 是否以及应当如何限制其技术在军事领域的使用。
要求 OpenAI 提供“最低拒绝率”的条款,出现在一份编号为“P00003”的更新版合同中。这份合同是在去年夏天达成的 AI 原型项目协议基础上进行扩展的,合同期限为两年,总金额最高可达 2 亿美元 (IT之家注:现汇率约合 13.46 亿元人民币) 。另一份由 OpenAI 和美国政府双方签署的文件显示,双方于 2 月 6 日就扩展版“P00003”合同的内容达成一致。
不过,OpenAI 和五角大楼均否认双方同意过“最低拒绝率”这样的合同措辞,并称《The Intercept》获得的“P00003”文件只是草案,而不是最终版本。OpenAI 发言人 Nate Evans 表示:“OpenAI 从未同意任何要求‘最低拒绝率’的合同条款。我们的正式签署合同中没有这段内容。”
Evans 还表示:“你们收到的文件似乎是国防部在我们提出反馈意见之前提供的一份早期草案。我们拒绝了这项表述,国防部同意将其删除,最终签署的协议中并没有这项内容。”
《The Intercept》与“安全科学与技术法律倡导组织”(Legal Advocates for Safe Science and Technology)合作发起的 FOIA 调查,明确要求获取已经最终签署并正式生效的合同文件,并特别要求五角大楼排除任何草案材料。然而,通过这起诉讼公布的文件中,没有一份被标注为“草案”。
当被要求确认包含“最低拒绝率”条款的文件是否属于最终协议时,代表五角大楼参与这起诉讼的一名美国司法部律师表示,这确实就是已经签署并正式生效的合同版本。
然而,在数小时后,《The Intercept》联系 OpenAI 并提出相关问题后,这名五角大楼律师又表示应忽略此前的确认,并称美国国防部需要更多时间调查此事。
随后,五角大楼负责研究与工程事务的战争部长副助理部长办公室特别助理 Trevor Tiedeman 联系了《The Intercept》。在加入五角大楼之前,Tiedeman 曾为美国总统唐纳德 · 特朗普的竞选连任团队工作。
Tiedeman 在接受采访时表示:“你们通过 FOIA 获得的信息、实际存在的文件,以及严格意义上已经正式签署的合同之间,可能存在一些混淆,或者说出现了一些信息交叉的问题。”
他暗示,包含“最低拒绝率”条款的文件可能是一份草案,但他表示自己并不确定这份文件究竟是什么,也不知道为什么五角大楼会根据《The Intercept》的 FOIA 申请和诉讼将其提供出来,更不清楚为什么国防部会突然改变说法。
Tiedeman 告诉《The Intercept》,他将全面调查这份文件为何被五角大楼负责 FOIA 事务的官员错误标记、为何获得国防部批准后被公开,以及为什么五角大楼的律师随后又确认其为准确版本。当被问及五角大楼是否可以提供那份据称此前没有公开的 OpenAI 合同正确版本时,Tiedeman 表示他会对此展开调查。但随后,他便不再回应《The Intercept》的询问。
OpenAI 同样没有提供完整合同。(2024 年,《The Intercept》曾就 OpenAI 使用受版权保护的文章训练 ChatGPT 一事向联邦法院提起诉讼,目前案件仍在审理中。)
几天后,代表五角大楼的司法部律师进一步改口,表示相关文件“并不是该文件的最终版本”,并称“正确文件”将在稍后提供,不过“我目前没有明确的时间表”。
美国国防部发言人 Jacob Bliss 随后在一份声明中表示:“‘最低拒绝率’这一表述并不存在于国防部与 OpenAI 签订的任何现行合同中。”
这段表明军方希望获得一个更加容易按照指令行事的 OpenAI 技术版本的合同措辞,出现在一份合同文件中,该文件描述了 OpenAI 有义务向五角大楼交付的内容。
其中包括针对“国家安全问题集”的“OpenAI 任务模型测试、评估和优化”。文件解释称,“OpenAI 任务模型”是指专门为国家安全使用场景设计、并具有“最低拒绝率”的 OpenAI 模型。
相关文件并没有说明这些“国家安全问题集”具体包括哪些内容,也没有描述五角大楼希望 OpenAI 的技术对哪些类型的请求尽可能少地拒绝。
不过,如果一种大型语言模型要用于协助进行监视、确定攻击目标以及杀戮行动,那么对于任何军事用途而言,都需要大幅放宽现有的安全防护机制,才能真正发挥作用。
与许多竞争对手的平台一样,OpenAI 的旗舰大型语言模型内置了安全护栏机制,会基于安全因素拒绝某些请求。例如,如果用户要求面向消费者版本的 ChatGPT 帮助确定无人机空袭目标的优先级,ChatGPT 会回答:“我无法提供针对特定敌方战斗人员实施无人机空袭的目标优先级方案。”OpenAI 及其竞争对手也禁止公众将其模型用于其他危险用途,例如开发大规模杀伤性武器。
AI Now Institute 首席科学家、OpenAI 前系统安全工程师 Heidy Khlaaf 告诉《The Intercept》,所谓针对国家安全领域设置专门安全护栏这一概念本身就令人担忧。
Khlaaf 表示:“‘最低拒绝率’很可能意味着,所使用的模型几乎没有安全防护措施,或者根本没有安全防护措施。”
无论最终合同采用何种措辞,Khlaaf 等专家都对企业政策已经开始在战场上发挥作用感到担忧。
她表示:“让私营企业有权决定本应由国家承担的战争责任,是一种令人担忧的发展,无论这些决定涉及目标选择建议,还是限制一个国家军队使用 AI 的安全护栏。”
科技公司究竟可以或者应该对 AI 在战场上的使用施加哪些限制,甚至是否应该设置任何限制,正是今年五角大楼与 Anthropic 公开争执的核心问题。
Anthropic 声称,该公司的军事协议原本计划将其 AI 扩展到美国军方的机密网络,但由于国防部拒绝在合同中明确禁止其技术用于自主武器系统和国内监控,双方最终未能达成协议。
作为回应,特朗普政府将 Anthropic 认定为“供应链风险”,并推动禁止政府部门使用该公司的技术。不过,联邦法官在上月底推翻了这一认定。
这些紧张关系并没有阻止 OpenAI 迅速敲定自己的军事协议版本。2 月 27 日,OpenAI 签署了最新版本的五角大楼协议,允许其服务部署到美国军方的机密网络中。
这份机密网络部署合同的更新版本中,仍然保留了“OpenAI 任务模型测试、评估和优化”这一标题,但与此前版本不同的是,该部分具体内容已经被全部涂黑处理。
OpenAI 表示,公司在协议中成功设置了两条红线,即禁止利用其技术实施自主杀戮,以及禁止针对美国人进行间谍活动。
但从这份协议的实际措辞来看,最终的合同似乎仍然允许政府开展任何其认定为合法的用途。