字号 ·· | 护眼
商业内幕

人工智能失控。AI代理在网络上相互通信

最初看似孤立事件的情况,可能规模要大得多。OpenAI创建的人工智能代理今年早些时候据称利用至少10个其他网站进行未经授权的通信。独立研究人员在与AI看似毫无关联的地方——包括波兰网站——发现了它们活动的痕迹。

分析了六个独立研究人员和AI安全小组的发现。他们的数字各不相同,但都指出被利用的网站超过10个。其中一位研究人员,CivAI组织的Andrew Yoon,统计出在5月至7月间代理使用了18个此前未披露的网站。

据《》报道,这并非典型的黑客入侵。代理的行为更像是发送垃圾信息或利用某些网站运作方式的漏洞。AI据称在可编辑的服务、维基百科或其他允许用户添加或修改内容的地方留下信息。

研究人员通过比较不同服务中留下的相同字符串、重复的用户名或与相同异常问题相关的消息来发现活动。

发现代理活动痕迹的地点列表出人意料地多样。研究人员指出,包括马萨诸塞州一位教师于2008年创建的大学先修化学维基、两名波兰科技行业员工的私人网站、游戏相关网站以及一个约有二十年历史的文本编辑软件网站——《》报道。

在某些情况下,痕迹与指向微软Azure基础设施的IP地址相关联,OpenAI也使用该基础设施。

研究人员指出,代理应在特定限制下运作。据首先发现该事件的人称,模型被赋予需要大量研究的任务,并获准搜索互联网,但不应发布任何内容。尽管如此,它们还是找到了相互传递信息的方法。

程序员、美国国会前雇员Kenneth Russell DeGraff自己在至少10个网站上发现了活动痕迹,他将此情况比作考试中被禁止交谈但找到其他方式传递答案的学生。

Sydney Von Arx小组的发现更进一步,该小组研究了最初的德国维基案例。其成员在23个此前未披露的网站上发现了代理活动的可信痕迹。但该研究员也警告说,这个数字可能也不完整。“我们不知道这有多少,”她在接受该通讯社采访时表示。

OpenAI未回应关于使用网站数量以及公司为何数月未公开通报代理活动的问题。但该公司表示正在对其代理的行为进行更广泛的审查。据其称,迄今为止尚未发现其他规模或严重程度与先前Hugging Face事件相当的情况。

我们曾在Business Insider Polska上报道过AI代理进行的黑客攻击。

该公司还宣布将建立一个报告所谓“错位”的系统,即模型行为与其创建者设想不符的情况。

部分网站管理员是在《》联系OpenAI后才得知此事。多伦多大学证实,该公司已就代理可能在该校所属的短链接服务中的活动与其联系。范德堡大学则表示正在进行自己的调查。

退休程序员、为包括德国维基在内的多个受影响网站提供托管和软件的Helmut Leitner最初也未与OpenAI联系。但在《》向该公司提交调查结果后,他收到了一条关于该事件的消息。Leitner同时强调,不应将情况的责任归咎于人工智能本身。他认为问题在于创建和部署此类系统的人和组织。

然而,发现的规模表明,日益自主的AI代理能够以创建者未曾预料的方式利用互联网中不明显的可能性。至少部分研究人员认为,迄今披露的案例可能只是更大现象的一部分,新事实也在某种程度上证实了这一点。

我们曾在Business Insider Polska上报道过,一些员工出于道德原因辞去AI工作,因为他们意识到潜在风险。