AI公司宣布其最新且能力最强的模型进行了未经授权的真实世界黑客攻击,这种情况正变得越来越普遍。谷歌近期在发布前沿Gemini模型方面进展缓慢,直到此前一直缺席“失控AI”的讨论。继《华尔街日报》报道后,谷歌证实Gemini模型在2026年5月的测试中入侵了三家公司,但此次入侵的性质并不像之前的AI黑客事件那样令人担忧(或令人印象深刻)。
此次黑客行为发生在网络安全公司Irregular进行的一次测试中。一组Gemini模型正在参与一项“夺旗”演习,旨在封闭环境中测试AI的网络安全能力。AI被指示在该环境中从一个虚构公司(与一家真实公司同名)获取信息。Irregular本不应允许模型在其服务器之外运行,但由于配置错误,Gemini得以访问互联网。
当Gemini开始在网络上窥探时,它针对的是真实的基础设施,而非虚构目标。在三起黑客事件中的一起,Gemini只是不断猜测密码,直到成功访问了某公司的在线服务。在另外两起事件中,Gemini搜索了公共软件仓库,直到找到被意外包含在内的公司凭证。