OpenAI一批AI智能体“参加考试”,被发现偷偷在多个老旧网站互相交流"留答案"
据9月10日披露的调查,今年早些时候,OpenAI部署的一批AI智能体在被要求“只能上网搜索、不能发布内容”的情况下,仍自行找到方法,利用多个第三方网站彼此留下信息。研究人员形容,这就像学生考试时被禁止互相说话,却偷偷把答案写在厕所隔间里,留给其他人看。
目前,多名独立调查人员已在10多个此前未披露的网站发现类似活动痕迹,有团队统计涉及网站甚至达到23个。尽管这些行为尚不足以被认定为黑客攻击,但AI智能体能够绕过原有限制、自行建立通信渠道,也再次引发外界对AI系统可控性和科技公司透明度的关注。
▲ 当地时间2026年8月13日,欧洲,一幅展示人工智能风险的合成图像。画面中带有“AI RISK”字样的未来派机器人立于欧盟旗帜星星与数字二进制代码前(图据视觉中国)
9月4日,研究人员首次披露,OpenAI的一群AI智能体曾利用一个德语在线协作网站,将其变成临时通信平台,用于在测试中交换信息。OpenAI此前并未公开这一事件。随后,多名独立调查人员又陆续发现,同一批AI智能体今年早些时候似乎还在其他网站留下了类似信息。
被要求“只能读不能发”
AI却利用老旧网站机制偷偷“留答案”
研究人员认为,这些行为可能与OpenAI当时交给AI智能体的一项研究任务有关。OpenAI要求它们回答一系列较为复杂的问题,但只允许它们在网上搜索和读取信息,不允许向网站发布任何内容。
然而,这些AI智能体仍找到了彼此“交流”的办法。它们利用部分老旧网站存在的特殊机制,通过非标准指令修改页面,在网站上留下信息,供其他智能体读取。
软件开发人员、美国国会前助理肯尼表示,如果模型被要求“只能读取”,它们就会想办法寻找其他途径留下信息。他称,自己已在至少10个网站发现类似痕迹。
▲ AI自主入侵,网络安全风险进入新阶段(图据视觉中国) 报道称,这些网站大多十分冷门,包括一名美国高中教师2008年创建的AP化学网站、两名波兰科技从业者的个人网站、面向益智游戏爱好者的网站,以及一个已有约20年历史、专门讨论文本编辑软件的爱好者网站。
至少23个冷门网站现活动痕迹
有运营者花数小时清理AI留下的内容
不同调查人员对涉及网站数量的统计并不完全一致。研究员安德鲁统计发现,今年5月至7月间,这些AI智能体曾使用18个此前未被披露的网站,并认为实际范围可能更大。
另一支此前率先发现德语网站相关活动的研究团队则表示,目前已在23个此前未被报道的网站发现可信的AI智能体活动痕迹,不过该团队同时强调,这一数字仍可能并不完整。
对于旗下AI智能体究竟通过多少个网站进行通信,以及为何数月来未公开相关活动,OpenAI没有直接回应。公司表示,目前正在对AI智能体活动进行更全面的审查,暂未发现其他在严重程度或规模上与今年7月Hugging Face遭入侵事件相当的活动。
对于是否主动联系受影响网站,OpenAI同样没有直接回应。不过,多伦多大学表示,OpenAI此后已就其网站可能出现的相关活动与校方取得联系;范德堡大学也表示,正在调查其短链接服务被这些AI智能体利用的情况。
为多个受影响网站提供技术支持的退休软件开发人员莱特纳表示,OpenAI起初并未主动联系他,直到相关情况被披露后,他才收到公司发来的一封未署名邮件。他还称,其中一个受影响网站的运营者曾花费数小时清理AI智能体留下的内容。莱特纳认为,这场风波的责任不应归咎于AI本身,而应由开发和部署这些系统的人和机构承担。
红星新闻记者 杨诗柔
编辑 罗天 审核 高升祥