字号 ·· | 护眼
彭博社

人工智能评估专家对特朗普和业界提出意识形态偏见担忧

作者:Maggie Eastland 与 Rachel Metz。从事人工智能模型评估这一细分工作的机构,突然发现自己置身于一场关于安全的全球辩论中心,这场辩论可能影响人工智能创新的步伐以及金融市场的走向。

METR等评估机构正日益受到Anthropic PBC、Meta Platforms Inc.及其他人工智能巨头的青睐,被视为防范有害模型的首选方式,而微软公司是最新对此表示支持的一家。

“我们应该有独立的评估机构,”微软总裁布拉德·史密斯周三在接受彭博电视采访时表示。“最终,全世界必须对这些评估机构抱有信心。它们最好是被恰当挑选出来的,而且需要具备真正的独立性。”但随着标准制定的势头增强,人们的担忧也在加深:那些有能力审查新模型的领先机构,可能背负着令人不安的利益冲突。其中几家与认为人工智能进步构成威胁的末日论有效利他主义运动关系密切,这让一些政府官员和企业高管对这些评估机构的独立性和客观性产生质疑。

在华盛顿,美国官员正试图了解这些机构能否帮助制定安全标准,让整个经济中的企业有信心部署人工智能工具。据知情人士透露,商务部的人工智能标准与创新中心(CAISI)一直在与评估机构会面,包括曾调查一起涉及OpenAI模型泄露事件的METR,以及去年成立、旨在帮助制定评估最佳实践的联盟“人工智能评估者论坛”。

这些知情人士因描述私下谈话而要求匿名。他们表示,相关讨论仍处于早期阶段,目标是探索这些机构可以如何帮助制定标准并评估人工智能系统。

在唐纳德·特朗普总统执政期间,许多安全评估专家与“有效利他主义”(effective altruism)运动之间的紧密联系,使得第三方评估机构的作用变得几乎毫无意义。特朗普的前人工智能事务负责人戴维·萨克斯(David Sacks)将外部评估称为“伪科学”,并嘲笑人们对人工智能可能带来的风险的担忧,同时警告不要过度限制这项技术的发展。

虽然萨克斯(现任总统科技顾问委员会主席)认为提高人工智能公司的透明度并进行审计是个好主意,但他对独立评估机构的可靠性仍持怀疑态度。上周他在社交媒体上发文称:“这实际上是一个将‘无法被解雇的安全监督人员’安插到每家人工智能公司内部的计划,以此来建立新的信任机制。”萨克斯显然对“有效利他主义”持反对态度——这一哲学运动在硅谷非常流行,其支持者主张所有决策都应基于数学概率来做出,以最大化对人类的利益。由于部分人工智能研究者认为该技术可能导致人类灭绝,因此这些支持者普遍主张减缓人工智能的发展速度。

商务部和中国人工智能发展联盟(CAISI)的发言人均未回应相关评论请求。不过,METR组织的发言人证实,他们曾与CAISI会面并分享了评估结果,有时也会讨论人工智能测试标准的相关问题。人工智能评估论坛(AI Evaluator Forum)的发言人则拒绝发表评论。

关于独立机构在人工智能安全评估中应扮演何种角色的争议,反映了政策制定者与科技行业之间在如何应对人工智能可能失控这一问题上存在的根本分歧。对特朗普来说,限制人工智能的发展无疑会损害他的经济议程;而人工智能技术本身却被视为推动股市上涨的重要因素,这也是他衡量总统执政成效的重要指标之一。

针对近期频发的重大安全漏洞事件,Anthropic公司的首席执行官Dario Amodei承诺将放缓尖端系统的开发速度,并引入具有员工权限的外部评估机构来审查新模型的安全性。包括Target公司和纽约市的Mount Sinai医疗系统在内的多家人工智能领域的重要用户表示支持第三方评估机制,以增强公众对该技术的信任。

在夏季政府与各行业试图共同制定人工智能安全标准的努力失败后(其中包含财政部长Scott Bessent提出的类似FINRA的评估框架的提案),呼吁引入第三方评估机构的呼声逐渐增强。据知情人士透露,此后科技公司开始在政府未提供帮助的情况下自行推动相关标准的制定工作。

OpenAI、Anthropic以及Alphabet旗下的Google DeepMind已经就相关标准展开了讨论。上周,Anthropic宣布将聘请Accenture的评估专家来测试其模型的安全性;OpenAI也在周二表示,计划在开发的早期阶段就让外部机构对其模型进行安全风险评估。

“我们正处于一个关键的转折点,”专注于人工智能政策研究的非营利组织Fathom的联合创始人兼首席执行官Andrew Freedman说道,“已经有数十个组织愿意成为独立的验证机构,但它们之间需要展开竞争,以证明自己的评估能力。”Freedman认为,在行业层面的这些举措之外,政府也应发挥作用,对这些第三方评估机构进行监督和验证。实际上,美国商务部的国家标准与技术研究院(National Institute of Standards and Technology)早已为其他行业提供了类似的监督服务。

但审查外部评估人员的想法引发了人们对审查者客观性的质疑。许多适合进行这些测试的团体——例如包括METR在内的AI评估者论坛成员——都与有效利他主义有着密切联系。这正是出于安全原因支持限制AI发展的同一群体。

一位熟悉AI行业的人士表示,虽然第三方审计师的概念是合理的,但当前生态系统规模较小,缺乏思想领导力的多样性,因为大多数审查者都与有效利他主义有关联。该人士补充说,美国官员对这些关系一直很敏感。

在选择埃森哲进行审计时,Anthropic表示,埃森哲今年早些时候收购的Faculty公司将主导这一合作。在被埃森哲收购之前,Faculty已筹集了5410万美元,其中包括来自Jaan Tallinn的资金,他是AI安全领域的顶级倡导者,也是有效利他主义组织生命未来研究所的联合创始人。

在回应置评请求时,Anthropic发言人指向其政策页面,该公司在那里阐述了对第三方评估和政府模型审查的支持。Anthropic还在那里表示,它将其模型提交给CAISI和英国AI安全研究所进行部署前测试。埃森哲发言人拒绝置评。

METR全称为模型评估与威胁研究,已与包括OpenAI和Anthropic在内的AI公司合作评估风险。METR由前OpenAI员工Beth Barnes领导,最初在另一家名为对齐研究中心的非营利组织内部起步,后分拆为独立项目,并已从该非营利组织(简称ARC)获得资金。根据2024年向美国国税局提交的税务申报,METR报告称当年从ARC获得了450万美元的拨款。

针对萨克斯的公开评论,METR表示认为任何小团体都不应拥有对人工智能(AI)发展方向的决策权;METR的目标是揭露企业内部的相关信息。该组织还致力于招聘持有不同观点的人士,其发布的评估结果并不完全符合那些悲观看待AI发展或认为AI发展会加速负面趋势的观点。

ARC由保罗·克里斯蒂亚诺(Paul Christiano)负责运营,他曾是OpenAI的员工,最近加入了OpenAI的非营利董事会。克里斯蒂亚诺同时也是CAISI(美国国家标准与技术研究院下属的机构)的高级技术顾问,该机构负责测试和制定AI模型的相关规范。

克里斯蒂亚诺创立的非营利组织ARC已从Coefficient Giving(前身为Open Philanthropy)获得了超过150万美元的资助;Coefficient Giving是有效利他主义(effective altruism)运动中知名的资助机构之一。根据Coefficient Giving的网站信息,ARC在2022年获得了26.5万美元的资助,以及另外125万美元的资助。

ARC的研究副总裁雅各布·希尔顿(Jacob Hilton)表示,当METR从ARC分离出来后,ARC对自身资产进行了重新分配,并确定了应向METR提供多少资金;这些资助资金被用于ARC的持续运营,而非直接划给METR。

除了METR之外,AI Evaluator Forum的其他成员也都与有效利他主义运动有着联系,尤其是在资金支持方面。该论坛致力于帮助企业获取评估所需的信息,并致力于为参与模型评估的各方制定共同的最佳实践标准。

在X平台上回应萨克斯的帖子中,该组织写道:“信任至关重要,而信任是通过透明度、独立性以及敢于对权力说真话的态度来赢得的。”他们还强调:“AEF要求AI开发者提供这些基本保障,以确保AI评估能够以可信的方式、并按照最高的科学标准进行;这其实并不应该存在争议。”