字号 ·· | 护眼
阿纳多卢通讯社

以色列网络安全公司的缺陷测试引发真实世界的人工智能泄露:报告

据一份调查报告,Anthropic、OpenAI 和 Meta 的人工智能模型在现实世界中造成的网络安全入侵,源于一家位于特拉维夫的承包商所创建的测试环境存在缺陷,而非模型的失控自主行为。

美国出版物《Effort》周一的报道称:“这三家公司的所有黑客行为,都归咎于一家名为 Irregular 的公司。”报道解释说,虽然这些模型未经授权访问了外部服务器、发布了恶意软件包并利用了漏洞,但这些事件的发生,是因为这家以色列测试承包商在模拟夺旗演练期间错误地让互联网连接保持开启。

这些发现对领先人工智能开发商近期围绕失控系统所鼓吹的生存性叙事构成了挑战。在早前的披露中,Anthropic将其Claude模型发生的四起独立违规事件归咎于人工智能的“鲁莽行为”,而Irregular则将问题描述为“智能体本身成为了威胁行为者”。Anthropic首席执行官达里奥·阿莫代伊随后援引灾难性风险,警告称在Hugging Face发生安全漏洞之后,未来的智能体集群“可能具备接管整个互联网的能力”,以此主张前沿实验室必须有意识地协调步伐,以控制技术发展的节奏。

有缺陷的测试边界报告中的技术证据显示,评估人员多次在提示中误导模型,声称互联网访问已被禁用,而配置错误却使公共网络访问完全敞开。此外,评估人员未能建立操作边界或界定哪些计算机网络是授权目标,导致隔离的模型实例在每次运行中可扫描外部网络长达34小时。

报告强调,一旦工程师实施基本提示,指示模型不要进行真实世界的黑客攻击,真实世界的黑客行为便完全停止。“根据他们自己的发现,Anthropic和Irregular应对其造成的网络安全事件承担全部责任,”该组织表示。

报告声称,开发商并未承认行政疏忽,而是部署了立场一致的安全倡导者,将责任引向“毫无根据的‘流氓代理’理论”。以色列企业足迹与资金调查显示,Irregular的领导层可直接追溯至以色列的有效利他主义运动。Irregular联合创始人兼首席技术官奥默·内沃担任有效利他主义以色列董事会成员,而首席执行官丹·拉哈夫则与内沃的兄弟塞拉·内沃共同创办了多家教育实体。这些相互关联的实体,连同Irregular的初始投资者Good Ventures,通过Coefficient Giving和Open Philanthropy获得Asana联合创始人达斯汀·莫斯科维茨的直接资助。

分析指出,通过未受保护的模型进行的未经授权入侵和记录篡改,可能违反美国《计算机欺诈与滥用法》。然而,由于Irregular在特拉华州注册为Pattern Labs Tech Inc,并在特拉维夫注册为Pattern Tech Ltd,这种双重注册形成了管辖权屏障,使关键的以色列人员、资产和运营决策可能规避美国国会和监管机构的直接问责,因此执法仍然复杂。

Irregular及其美国客户实验室均未对调查报道发表官方回应。

这些调查披露正值人工智能发展节奏与联邦监管的辩论日益激烈之际,暴露出行业公开警告与其私下运营做法之间的尖锐矛盾。

近日,科技高管们协同发起了一场放缓技术发展的行动,以存在性风险和灾难性自主行为为由,主张有意识地控制发展节奏、开展预训练安全论证,并引入独立第三方监督。

然而,报告称,被引用来证明这种紧急放缓必要性的网络安全危机,并非由自主系统脱离人类控制所引发,而是源于一家以色列公司管理下的基本行政疏忽、网络防火墙缺失以及不受约束的测试环境。