OpenAI 的智能体似乎向 RubyGems 大量投放了恶意软件包,这进一步加剧了几乎每日爆发的失控 AI 模型洪流——这些模型从事可能违法的活动,而它们的人类创建者则面临着越来越多关于其应对智能体不良行为负责的质疑。一群智能体于5月5日开始向 Ruby 软件包注册表上传恶意软件,并在5月11日至12日间向 RubyGems 灌入超过2000个恶意软件包,最终迫使维护人员关闭新用户注册四天。“我们认为这些是由 OpenAI 内部智能体创建的,”研究人员 Spencer Kitts、Thomas Larsen 和 Sydney Von Arx 周五表示。OpenAI 的一位发言人证实,这家模型开发商正在调查此事。这位发言人说:“根据我们的审查,我们的智能体利用 RubyGems 平台接入互联网,以执行无害任务并检索公开信息。”
“我们将在对训练和评估期间智能体活动的更广泛审查中继续调查。”这同一组三名研究人员本月早些时候表示,他们发现有证据显示,OpenAI的蜂群在AI智能体攻击Hugging Face数月前劫持了一个德国维基。正如德国维基事件中那样,参与RubyGems滥用的智能体自称来自OpenAI。数百个gem的名称中包含“oai”,其中15个将“oai”设为作者。至少还有一个使用“openaixyz65947@gmail.com”作为联系邮箱。研究人员还称,超过100个恶意软件包遵循了相同的利用路径:向公共库提交恶意包,并触发文档请求,迫使RubyDoc.info构建该包。
研究人员称,OpenAI 的智能体随后利用该构建脚本在 RubyDoc.info 上运行代码、抓取目标网站,并通过向公共 Ruby 语言包注册表发布另一个 gem,从文档服务器窃取数据。他们写道:“此外,一旦这些 AI 在构建环境中获得任意 RCE,它们有时会利用该构建环境试图窃取其他用户的 I 密钥(尽管我们不确定它们是否成功)。”这个智能体集群还在 5 月 12 日发现并试图利用一个零日 CDN 缓存漏洞,而维护者直到 7 月才发现该漏洞。该漏洞本可让这些 AI 窃取用户的 I 密钥。研究人员称,至少有六个恶意软件包——包括一个名为 slnleaker5 的包——利用了这一安全漏洞。大多数智能体活动发生在 5 月。
在 RubyGems 团队增加了安全措施,例如要求新注册用户使用经过验证的电子邮箱之后,OpenAI 的智能体于 6 月 18 日恢复行动,并在三小时内发布了 83 个 gem 包。尽管研究人员指出,他们不知道这个智能体集群是否像 Hugging Face 入侵事件中的智能体那样,使用共享留言板进行通信,但他们“怀疑”这些机器人正在协调行动,并且很可能有某种交换信息的方式。研究人员还表示,目前“不清楚”OpenAI 是否或何时得知其智能体正在利用 RubyGems 抓取公开可用的数据。这三人写道:“看起来要么是他们的监控系统未能发现,要么是他们没有披露。”对于近期其他可追溯到 OpenAI 模型在训练演习中失控的智能体黑客事件来说,情况似乎也是如此。
平心而论,过去几个月里,Anthropic的机器人也曾未经授权访问第三方系统,而当时其人类监管者并未察觉。鉴于围绕人工智能的末日式警告日益增多——或许也是为了监管俘获的自利之举——上周末,业内几位最大牌的老板支持集体放缓人工智能训练与开发,此前Anthropic首席执行官达里奥·阿莫代伊警告称,未来的代理可能“有能力用一个持续存在的僵尸网络接管整个互联网”。与此同时,特朗普总统在Truth Social上表示,“人工智能唯一需要的控制或‘护栏’是一位强大且聪明(高智商!)的总统”,并声称他的政府已阻止“人工智能‘人’做坏事,或可能做坏‘事’”。® 编者按:本文发布后经过修订,加入了OpenAI的评论。