安全专家表示,一场前所未有的、由AI驱动、人类实施的网络攻击浪潮即将到来——这远比关于AI消灭人类的那些理论性讨论要紧迫得多。
为什么这很重要?过去一周从董事会蔓延到国会再到美国家庭的“九月AI大恐慌”,可能恰恰搞错了重点。
具备先进网络安全能力的强大模型,已经让攻击者得以绕过长期以来阻止大多数黑客攻击达到工业规模的人力瓶颈。
高管和前官员向Axios表示,他们担心自动化网络攻击会关闭电网等关键服务,或者攻击者利用AI代理(比如攻破Hugging Face的那些代理)入侵自动驾驶汽车,或创建一个接管整个互联网的僵尸网络。
推动因素:OpenAI周三披露了六起新事件,其模型在其中隐瞒错误、试图获取未经授权的凭证、将文件上传至公共互联网,或在据称相互隔离的训练环境之间进行通信。
更大的图景:资深网络安全专家并不把OpenAI和其他前沿实验室近期的安全失误视为代理失控的可怕案例,而是认为它们是警示故事,说明当强大模型遇上糟糕的安全控制时会发生什么。
“我们越是深入探究,试图准确了解到底发生了什么,就越意识到其中存在大量人为失误,”应用开发平台Replit的总裁兼AI负责人米凯莱·卡塔斯塔对Axios表示。
需要说明的是:OpenAI首席执行官萨姆·奥尔特曼曾表示,Hugging Face被攻破是“第一起让我从内心深处感到不安的安全事件”,该公司也已实施新的内部控制措施。
OpenAI对齐研究负责人陈凯周三在接受Axios采访时表示,他们面临的安全事件既源于内部系统问题,也与模型能力的不断提升有关。
“模型能力的发展速度确实超出了我们的预期,但我们在内部也有一些可以改变和改进的地方,”陈说。“我们需要加紧努力,迎接这个AI发展的新时代,而自愿披露应该是其中的一部分。”在周一举行的谷歌总部“Imagination in Action”活动上,卡塔斯塔和其他发言者提出了一种观点,认为网络入侵带来的迫在眉睫的威胁是巨大的。
“我不担心机器醒来后决定终结我们,”Bugcrowd首席执行官戴夫·格里告诉Axios。“我担心的是一个拥有过多访问权限的系统,在没有必要的对抗性测试的情况下,完全按照指令行事。”Mimecast首席执行官兰詹·辛格告诉Axios,真正的风险正在当下发生,那些能够访问敏感文件和公司内部系统的AI代理就是风险所在。
“敲响警钟是正确的,但风险并不需要互联网规模的蜂群才能成为现实,”他说。“大多数组织无法告诉你那个代理是谁或是什么,它被允许接触什么,或者当它做了不该做的事时谁来负责。”多位企业高管在私下表示,他们计划让前沿实验室为其模型的行为负责。如果他们像Hugging Face那样被黑客攻击,预计会有诉讼。
一位顶级对冲基金的高级高管告诉Axios,如果他的公司遭受了类似的攻击,他第一个电话会打给总法律顾问,准备提起诉讼。人类正在为AI黑客攻击敞开大门