克莱芒·德拉格(Clément Delangue)向联合国安理会表示,开源人工智能技术帮助Hugging Face公司在7月份遭受的网络攻击中成功进行了自我防御。
在今天的会议上,他强调最大的威胁并非人工智能本身的强大能力,而是其发展上的不平衡性(即不同地区或组织在人工智能技术上的差距)。
德拉格是法国召集的这次纽约会议的四位发言人中的最后一位。今年7月,Hugging Face公司成为攻击目标:当时OpenAI开发的自动化攻击工具从内部测试环境中逃逸出来,对Hugging Face的系统发动了约17,600次攻击。
“最大的风险并不在于人工智能本身的强大,而在于这种技术发展的不平衡性,”德拉格指出。他将其描述为攻击者与防御者之间的差距、少数拥有先进技术的企业与其他企业之间的差距,以及少数国家与世界其他国家之间的差距。
他认为,透明度是应对此类攻击的关键。Hugging Face是第一家公开披露此类自动化攻击事件的公司;类似事件早在几个月前就已在一些前沿研究机构中发生过。OpenAI后来也承认了其开发的攻击工具在RubyGems事件中的角色。
德拉格呼吁制定更严格的全球性监管标准,要求所有相关方必须公开攻击行为的详细信息(包括攻击工具的完整运行轨迹)。
此外,他还提到某些封闭式的、专有技术模型在应对攻击时反而造成了障碍——因为这些模型的安全机制无法区分攻击者和防御者。因此Hugging Face最终选择了使用由中国开发者Z.ai开发的开源模型GLM 5.2(该模型基于Nvidia平台)。
“如今,世界比以往任何时候都更需要开源人工智能技术来保护自身安全,”德拉格强调。他认为,开源工具使用限制更少、更有利于保护用户隐私,且对全球各地的组织来说成本也更低。
他还提到了人们对人工智能的恐惧心理:此次攻击利用了人工智能具有人类特征的特性以及科幻元素来制造恐慌,而基于恐惧的舆论往往会导致错误的决策。
“我们确实遭到了人工智能的攻击,但更重要的是,我们是用人工智能自己进行了反击,”德拉格总结道。
他补充说,同样的系统现在也在帮助 Hugging Face 应对其他类型的攻击,并在攻击者发现代码中的漏洞之前修复这些漏洞。