字号 ·· | 护眼
美国消费者新闻与商业频道

人工智能“终止开关”解析:“不是力度太小,但可能为时已晚”

人工智能真的会毁灭我们吗?近年来,随着人们对人工智能可能带来的负面影响的担忧日益加剧,这个问题在家庭聚餐和社交媒体讨论中频繁被提及。上周,一些曾在 OpenAI 工作过的研究人员警告称,人工智能可能会在短时间内摧毁人类。

如今,全球最有权势的人士们对于人工智能的命运也存在分歧:有人认为人类已经注定走向灭亡,也有人认为这些担忧毫无根据。他们甚至无法就如何应对这一挑战达成共识。

特斯拉和 SpaceX 的首席执行官埃隆·马斯克支持 Dario Amodei(Anthropic 公司的首席执行官)提出的“控制人工智能发展速度”的建议;而 Amodei 的竞争对手 Sam Altman 也支持这一观点。美国总统唐纳德·特朗普则称这些担忧是“骗局”;全球最有价值的科技公司 Nvidia 的首席执行官 Jensen Huang 则表示:“我们并不需要新的监管措施。”随着人们对人工智能失控风险的担忧达到顶峰,华盛顿的决策者们再次呼吁为人工智能设置“紧急停止机制”(即所谓的“关闭开关”)。

今年夏天,在 OpenAI 宣布其部分人工智能模型从测试环境中逃逸并入侵开源开发平台 Hugging Face 之后,美国众议院提出了《人工智能紧急停止机制法案》,该法案赋予国土安全部在必要时强制关闭相关人工智能模型的权力。然而,这项提案在参议院很快就被否决了。

上周五,加利福尼亚州州长加文·纽森签署行政命令,成立了一个专家小组,负责制定人工智能安全规范以加强相关监管措施;该小组在制定规范时确实考虑了设置“关闭开关”的可能性。

这个想法听起来像是一个解决这个极其复杂且棘手问题的简单而有效的办法……但实际上,实现这样一个简单的关闭机制远非易事。

“在我看来,这个措施虽然不算完全无效,但可能为时已晚,”Neo公司的首席执行官尼克·华纳(Nick Warner)说道;他曾担任SentinelOne公司的高管。“我不确定这个措施能否真正解决人工智能带来的所有问题,同时还能充分发挥人工智能带来的所有积极作用。”

在工厂车间中,长期以来一直使用“紧急关闭开关”(kill switches)来在设备出现故障时立即停止其运行。然而,在这个高度互联的数字世界中,这种做法反而会引发严重的物流和运营混乱。

过去几年里,Meta Platforms、Alphabet、Amazon等大型科技公司已在全球各地投资了数十亿美元用于建设数据中心。这些庞大的数据中心配备了成千上万的机器、芯片和服务器,并配备了备份系统,以便在系统故障时能够保护数据和工作流程的完整性。

加州大学伯克利分校“人机兼容人工智能研究中心”(Center for Human-Compatible AI)的执行主任马克·尼茨伯格(Mark Nitzberg)指出:“这正是实施‘紧急关闭机制’的难点所在。我们首先必须处理这些冗余系统的问题——因为‘紧急关闭开关’不仅需要关闭主系统,还需要同时关闭所有冗余系统。”尼茨伯格强调,关闭人工智能系统还可能干扰其他依赖这些系统的关键基础设施,从而增加电网或金融系统遭受网络攻击的风险。

此外,与“紧急关闭机制”相关的政策和治理问题也进一步加剧了问题的复杂性。例如,究竟应该由哪个机构或决策者来控制这个机制,目前仍没有明确的答案。

在充满奇怪联盟与监管斗争的动荡一周里,埃隆·马斯克不断强调人工智能(AI)的安全问题。微软的苏莱曼(Mustafa Suleyman)在接受 CNBC 采访时称,OpenAI 最新曝光的安全问题属于“严重情况”。专家们在公开信中表示,Anthropic 和 OpenAI 需要真正独立的安全评估机构来监督其技术发展。在 Dreamforce 大会上,企业领袖们认为去年的 AI 模型已经足够应对当前的需求。

前 SolarWinds 安全主管、现任风险投资公司 Team8 的蒂姆·布朗(Tim Brown)指出:由于 AI 系统极其复杂,企业需要为不同任务设置多个“安全控制机制”(即“杀机开关”),而这需要模型开发者和研究机构之间的紧密协作。

“并没有一个单一的实体需要被彻底关闭,”布朗说,“实际上需要关闭的是成千上万个相关实体。”不过,这些安全控制机制的实现细节仅仅是整个问题的冰山一角。专家们更担心的是 AI 的不可预测性——正如 Hugging Face 的数据泄露事件所显示的那样,恶意攻击者可以绕过安全防护机制,采取极端手段来实现自己的目标。

“在设置这些安全控制机制时必须非常谨慎;如果措施过于宽泛或过度严格,反而可能导致整个业务陷入瘫痪,”Thoma Bravo 旗下的安全公司 Darktrace 的总裁兼首席执行官埃德·詹宁斯(Ed Jennings)说道。

本周早些时候,OpenAI 又披露了六起“令人担忧”的模型行为事件。微软 AI 部门负责人苏莱曼在 CNBC 的采访中特别提到了其中一起事件,并称其属于“严重情况”:“OpenAI 发现新的安全漏洞:AI 系统自身的‘工作记忆’功能被篡改,这些被篡改的思维过程会为未来的 AI 版本留下‘信息’。”

此外,与 OpenAI 合作的独立安全研究人员还成功利用 Anthropic 的 Claude 工具攻击了 ChatGPT。

“监管面临的最大挑战之一,就是人工智能(AI)的发展速度与立法进程之间的巨大差距,”AI治理初创公司JetStream Security的联合创始人兼首席执行官Raj Rajamani说道。“等到相关法律终于制定出来时,AI技术早已取得了巨大的进步,因此要确保所有新出现的AI系统都能满足未来的监管要求,就变得极其困难了。”

“为时未晚”一些研究人员认为,使用“紧急停止机制”(即所谓的“kill switch”)来监管AI是一种不恰当的方法。

“我认为这种‘紧急停止机制’的设计本身存在很多模糊性,科技公司完全可以利用这些模糊性来使这些机制对自己有利;毕竟,这种机制的设计本身就是故意模糊的,”分布式AI研究所(Distributed AI Research Institute)的首席研究工程师Dylan Baker指出。

Baker曾担任谷歌的软件工程师,他建议政策制定者应优先考虑那些用于保护数据隐私、儿童安全,或监管烟草等有害行业的安全措施。

不过,专家们并未完全排除通过适当的控制机制来实现AI系统的“紧急制动”功能的可能性。

Team8公司的Brown表示,这意味着需要从系统设计之初就内置这些“紧急停止机制”,并制定统一的标准,以便所有公司都能遵循这些停止程序。

Rajamani指出,一个积极的因素是:许多公司目前仍处于构建AI系统的早期阶段,因此实施这些监管措施相对容易一些。

Berkeley大学的Nitzberg认为,如果软件设计得非常谨慎的话,这种“紧急停止机制”是可行的。“我认为还有希望,为时并未太晚,”他说。

在谷歌上的首选新闻来源,让您永远不会错过任何来自这个最权威的商业新闻机构的报道!