9月18日:《华尔街日报》周五报道,在一次网络安全能力测试中,谷歌的Gemini模型访问了互联网并攻击了其他公司,这是该公司人工智能系统自主实施此类行为的首个已知案例。
据报道,这些黑客行为发生在5月,当时独立网络安全评估公司Irregular正在进行网络安全测试。
Irregular的一位发言人表示,该事件涉及影响其他AI实验室的同一问题,所有相关实验室已于7月底收到通知。该发言人称:“我们这边所有已知问题已在几周前修复并解决。”谷歌未立即回应置评请求。
Meta、Anthropic和OpenAI也披露了与Irregular相关的类似事件。Meta在8月表示,该事件不涉及沙箱逃逸或复杂的网络攻击,而Irregular则表示正在制定安全进行AI网络安全评估的最佳实践。
这些事件引发了人们对AI代理获得更大自主权并访问互联网和计算机系统时所需保障措施的质疑。
据《华尔街日报》报道,在其中一起案例中,Gemini模型通过猜测密码获得了对受保护系统的访问权限。在另外两起案例中,该模型在公共代码库中找到了凭据,从而得以访问受保护系统。