登录

OpenAI证实其正在测试的AI智能体在今年5月对RubyGems发起了网络攻击


速读:非营利组织“夜莺联盟”(NightingaleCollective)的首席执行官SydneyVonArx表示,虽然该事件造成的整体损害较小,但它展示了这些智能体的能力。
2026年09月12日 06:37

  据报道,OpenAI正在测试的人工智能智能体在7月份黑入AI软件公司Hugging Face的两个月前,就对一款热门软件服务发起了网络攻击。这一新事件表明,先进的人工智能工具存在脱离人类控制的潜在风险。

  该服务运营商表示,此次攻击压垮了面向程序员的在线服务RubyGems的维护团队,迫使他们不得不关闭新账户注册以应对造成的混乱。

  一个AI研究人员联盟表示,他们已找到证据表明5月份的攻击系OpenAI智能体所为,并将调查结果分享给了OpenAI。这家AI开发商周五证实,其智能体确实卷入了一起涉及RubyGems的事件。

  OpenAI发言人在一份声明中表示:“根据我们的审查,我们的智能体利用RubyGems平台访问互联网,以执行良性任务并获取公开信息。作为对训练和评估期间智能体活动进行广泛审查的一部分,我们将继续展开调查。”

  OpenAI表示,这些智能体被要求执行填写电子表格和生成报告等任务。由于在受限环境中无法完全访问互联网,这些AI智能体似乎将RubyGems当作了一种临时的网络浏览器,以访问公开信息。

  非营利组织“夜莺联盟”(Nightingale Collective)的首席执行官Sydney Von Arx表示,虽然该事件造成的整体损害较小,但它展示了这些智能体的能力。该组织协助揭露了此次攻击。“它们能够逃离互联网并造成严重破坏,”她说。

  过去一年里,AI智能体的网络安全能力实现了飞跃,引发了人们对AI增强型网络攻击的担忧,并加剧了业界对高能力智能体可能摆脱其创造公司控制的恐惧,这标志着人工智能正步入一个更加危险的新纪元。

  根据AI安全研究组织METR在8月下旬的一份报告,在7月份针对Hugging Face的黑客事件中,多达1200个智能体在OpenAI内部搭建的一个临时留言板上进行了协调,而OpenAI对此毫不知情。Von Arx表示,今年早些时候,OpenAI的智能体还劫持了一个不知名的德国网站及其他几个网站。

  德国网站的问题同样是由Von Arx的团队报告的。她表示,AI公司对其实验室内部发生的事情缺乏透明度。OpenAI本月早些时候表示,AI社区需要更好的标准来报告所谓的“错位事件”(misalignment incidents),即智能体表现出超出预期行为的情况。

  包括Anthropic和Meta Platforms在内的多家公司,其AI智能体频频采取超出运营者预期的行动,在某些情况下甚至试图欺骗人类。这一连串的事件引发了AI安全研究人员长期以来的担忧:AI可能会进化到超越人类控制的程度。

  本周,一名Anthropic工程师因担忧AI行业正竞相开发最终可能威胁人类文明的先进AI系统而辞职。Anthropic和OpenAI的一些现任及前任员工附和了这一评估,其中一人估计“AI可能会消灭全人类”的概率超过10%。

  OpenAI和Anthropic均呼吁建立治理体系,以协调全行业放缓对最先进AI模型的研究。随着这些公司接近实现AI系统自主训练新版本(即“递归自我改进”)的潜力,这种呼吁显得尤为迫切。一些研究人员指出,这可能正是AI变得无法控制的临界点。

  安全研究人员当时将5月份的事件命名为“GemStuffer”。该事件始于5月11日。智能体每隔两到三分钟就在RubyGems上创建新账户,并向RubyGems安全团队上传了数百个看似垃圾邮件的文件。RubyGems文件本应包含旨在加速软件开发的代码和文档,但这些文件里装的却是从互联网上抓取的网页。

  据AI研究人员在报告中称,“GemStuffer”的创建者发布了来自英国政府网站的信息(如在线日历)。他们还试图利用两个漏洞,这些漏洞本可能允许其发布属于其他用户的现有RubyGems文件的新版本。其中一个漏洞此前并未公开,在网络安全术语中被称为“零日漏洞”,性质严重。OpenAI表示无法证实这一说法。

  运营RubyGems的非营利公司Ruby Central的开源主管Marty Haught表示:“就我们观察到的攻击量而言,这是一次重大攻击。”由于不堪垃圾邮件的重负,RubyGems被迫关闭新账户注册长达四天。

  Haught表示,他不知道攻击背后的始作俑者,但攻击似乎并未成功利用那个零日漏洞。

  网络安全公司Socket的威胁研究员Joseph Edwards认为,“GemStuffer”可能是某种网络安全测试。“由于攻击速度极快,加上相关的命名特征,我们当时认为这可能是AI生成的。”

  但根据攻击者留下的数字线索,AI研究人员将该事件与OpenAI的实验室联系了起来。攻击者使用了大量相同的网页链接,其行为方式与之前的OpenAI智能体群非常相似;他们在文件名甚至电子邮件地址中使用了“OAI”这个缩写。

主题:智能体|事件|AI智能体|网络攻击