字号 ·· | 护眼
大西洋月刊

如何监管幽灵

乔什·蒂兰吉尔执导的这部电影讲述了友谊、黏液以及巨型棉花糖的特定熔点——这让人很容易忘记,它同时也是一部关于监管的电影。故事的核心灾难始于环境保护局官僚沃尔特·佩克造访捉鬼敢死队总部的地下室,发现了一台他无法理解的机器。书呆子科学家伊根·斯宾格勒解释说,这是一个收容系统;关掉它“就像向城市投下一颗炸弹”。佩克不相信鬼魂,更不相信捉鬼敢死队,于是他命令电工关掉机器。联合爱迪生公司的工人隐约感到一种自己无法完全理解的风险,犹豫了。佩克告诉他,他对他的意见不感兴趣。开关被拉下。鬼魂逃逸。

在1984年里根时代,这个笑话的讽刺在于:政府监管愚蠢至极,反而制造了它本应防止的灾难。里根的成功由此可见一斑——如今,在人工智能时代,这个笑话完成了一个轮回。政府仍在试图关闭收容系统——只不过现在他们把这种尝试称为“放松监管”。唐纳德·特朗普在第二任期第一天就撤销了乔·拜登的人工智能行政令,该命令要求某些先进人工智能系统的开发者在向公众发布模型之前,与政府共享安全测试结果。仅在过去一个月里,就出现了大量“失准”的证据——“失准”是业界对人工智能违抗程序员指令的一种委婉说法。

在7月对科技公司Hugging Face的黑客攻击中,由于对齐机制失效,一组OpenAI智能体获取了Hugging Face服务器的管理员权限,窃取私有数据并收集员工凭证——这是一项重罪——随后还向疏忽大意的人类监管者隐藏了证据。谷歌周五宣布,其AI模型通过猜测登录信息或在公共存储库中搜索真实密码,未经授权访问了三个外部系统。与此同时,美国有线电视新闻网(CNN)报道称,一次更为常规的AI幻觉险些导致美军拦截并登上一艘中国船只,直到官员们发现该报告有误。

AI脱离有效监管的速度,是顶级AI公司员工纷纷辞职抗议的原因之一。这也是萨姆·奥特曼(Sam Altman)、达里奥·阿莫迪(Dario Amodei)和埃隆·马斯克(Elon Musk)共同呼吁放缓或“控制节奏”最先进模型开发的原因。就在上周,特朗普还在朝相反方向狂奔,称AI可能威胁文明的想法是“骗局”,并指责施加护栏的努力是“病态的阴谋”。但周六,或许是在中期选举前六周意识到这一立场的巨大不受欢迎程度,他调整了热情,宣布成立一支“AI部队”,该部队将由一位AI沙皇监督,这位沙皇将“珍视”AI行业,同时也“寻找坏人”。这将是特朗普的第二位AI沙皇。第一位是大卫·萨克斯(David Sacks),一位滥情的AI投资者、炒作者和播客主持人,他辩称现在呼吁克制的高管们是出于私利且缺乏诚意。上周我与其中一些高管交谈;他们听起来相当真诚——并且对萨克斯感到真诚的恼怒。当然,当萨克斯版本的“钻吧,宝贝,钻吧”(Drill, baby, drill)正在推高他们的估值时,许多同样的人也曾为萨克斯欢呼。

多年来,我一直试图理清人工智能公司首席执行官们、特朗普及其身边人究竟真正相信什么,而不是他们出于利益需要声称相信什么。也许有一天,如果我再找不到其他自我伤害的方式,我会重新回到这个课题。就目前的讨论而言,他们的真诚与否并不重要。当务之急是:我们该如何应对这些“幽灵”?

没有人——无论是奥特曼、特朗普,还是未来的“人工智能沙皇”——知道当今的人工智能模型究竟是失控超级智能的前奏,还是仅仅极其强大且有时危险的机器;同样,也没有人知道,比中国领先几个月究竟会让美国更安全,还是会加速我们走向毁灭。但你不必全知全能才能采取行动。你不需要拥有超心理学学位,才能应对房间里乱飞的家具。

美国上一次不得不管理这种“幽灵风险”是在2008年。当时的金融系统被一种经过彻底重新打包的债务所感染,以至于没有人——甚至持有这些债务的银行——能判断其价值、来源,甚至是否仍潜伏在它们的资产负债表上。汉克·保尔森、蒂姆·盖特纳和本·伯南克坚持认为,不采取行动的风险大于采取错误行动的风险。他们迅速行动,迫使最大的几家银行抱团,接受紧急资金援助,否则将面临独自死亡的命运。这一应对并不完美,但我们也不是在街角卖苹果的小贩。

金融危机并非一个完美的寓言,但它与人工智能危机在一个重要方面有着异曲同工之妙。没有任何一家实验室会在竞争对手不减速的情况下选择放慢脚步——不是因为其高管不相信风险是真实的,而是因为个体的谨慎只会将市场拱手让给最鲁莽的人。这就是为什么那些警告灾难的人仍在不断发布新模型。这是一个囚徒困境,唯一的出路是依靠一个更高的权力——或者一群挥舞干草叉的暴民——来强制推行集体行动。

这一行动应从强制将风险公之于众开始。目前,人工智能实验室可以自行决定是否以及何时告知外界其模型是否突破了安全防线。这在监管层面等同于让一家鸡肉加工厂自行选择是否要通报沙门氏菌污染情况。报告义务必须是强制性的,且须在72小时内完成,若未能遵守,则必须承担极其沉重的代价。

近期发生的越狱事件暴露了人工智能的发展速度,也揭示了理应负责监管的人类在监督方面的松懈。OpenAI在其面向公众的产品中所使用的安全措施,在其智能体入侵Hugging Face时并未启用,因为这次突破发生在内部测试期间,而OpenAI是唯一决定其自身规则适用范围的机构。一个拥有系统访问权限的独立评估机构——无论是联邦机构、学术机构还是其他组织——可以确保始终有人在进行监督。

人工智能研究的前沿领域最需要监管,但目前只有少数几家公司在该领域运营。这使得监管变得更加容易。那些追求低风险能力的人工智能公司——例如推荐餐厅的聊天机器人,或改进城市回收利用的图像识别模型——并不需要与OpenAI同等程度的监管。欧盟的《人工智能法案》已经对系统进行了分类:在训练模型时,一旦算力超过一定限额,就会自动被纳入最严格的监管层级,无需任何辩驳。

上述这些措施并未限制实验室可以开发什么、不能开发什么,也没有限制其开发速度。它们旨在规范安全与部署方面的透明度与问责制,同时为未来的讨论留出了充足的空间。

但我还没天真到认为这一切有可能在美国发生。最快、最有力的变革途径是行政命令;迄今为止,人工智能力量对计算机科学领域着墨甚多,对具体细节却语焉不详。实验室当然可以全力支持真正的立法——它们有钱,而且如果我们认真对待它们的公开声明,它们也有动机。但数百年的资本主义历史表明,除非被迫,它们不会这么做。这样一来,就只剩下真正愤怒的中期选举选民来推动具体改革了,而具体性并非愤怒者的标志。

这就是为什么此刻让人感到格外焦虑。有我们不了解的幽灵,有动机不可知的主事者。这让我们比电影里的人处境更糟。至少他们知道该打给谁。