字号 ·· | 护眼
axios新闻网

在争夺“值得信赖的AI警察”技术的竞争中……

许多行业参与者、政策专家和企业都在纠结一个问题:如何以可信的方式监管人工智能。在白宫内部,一切基本照常运转。

原因何在?行业的疯狂冲刺是临时拼凑的监管机制以及一种普遍共识的产物——即华盛顿短期内不太可能采取迅速行动。人工智能公司的首席执行官们一直在努力解决如何测试先进人工智能以及与北京在安全标准方面合作的问题,而白宫则倾向于让行业自行找到自我监管方式的解决方案。

这意味着,在各公司等待立法或白宫在当前自愿程序之外采取行动之际,一场关于谁将被选定为人工智能系统和控制的第三方评估者的竞赛已经展开。

一个强大的安全和基准测试团体生态系统已经存在,但一些白宫官员和人工智能高管认为它们与顶级人工智能公司关系过于密切。其他选项包括已经在做评估的企业和初创公司,以及一些更为非传统的建议。

他们的观点是:据一位白宫官员称,企业在人工智能方面拥有最丰富的专业知识,也了解白宫人工智能自愿框架的要求。“这些人可不是12岁的孩子,”该官员说。

“顶级前沿公司需要就他们想要什么达成共识,因为他们目前什么都还没达成一致,”该官员继续说道。“如果这些公司觉得情况如此严峻,他们完全有权利、有理由、也有能力限制自己的模型。”摩擦:一些第三方评估者——包括调查了OpenAI- hugging Face事件的METR机构的个人——被指与有效利他主义运动以及他们将要监管的公司关系密切。

Hugging Face事件的主要外部调查员之一,其配偶是资深人工智能安全与技术官员保罗·克里斯蒂亚诺(Paul Christiano),他近期加入了OpenAI非营利基金会的董事会。此外,一名Anthropic的员工近期也离职并加入了METR。

METR表示,该机构不接受前沿实验室的资助。一位发言人称,克里斯蒂亚诺是在调查结束后才加入OpenAI董事会的。

人工智能公司和安全官员表示,人工智能研究界一直以来规模较小且联系紧密,来自前沿实验室的员工非常适合评估模型的能力。

现有的部分人工智能评估体系源于推广新模型能力的努力,包括模型在编程基准测试和数学测试中的表现。

包括国防和技术承包商博思艾伦(Booz Allen)在内的多家公司,都在为客户评估人工智能系统。

博思艾伦人工智能负责人埃里克·赛法德(Eric Syphard)表示,许多评估缺乏关键要素,例如衡量模型产生软件漏洞的频率,或模型对提示词响应的变异性。

赛法德在接受Axios采访时说:“它们都倾向于那种只看重性能的世界观。”

埃隆·马斯克本周建议,中美两国的人工智能实验室可以互相审查对方的模型,但由于顶尖企业之间竞争激烈,一些人认为这种前景不太可能实现。

此外,其他想法也随之浮现,包括一位前特朗普顾问呼吁传奇“编程大神”约翰·卡马克(John Carmack)介入此事。

在识别出六起新事件后,OpenAI本周发布了一份公共事件报告手册。与白宫的人工智能框架一样,OpenAI关于公共事件报告的构想是自愿性质的,马斯克的同行评审方案也是如此。

OpenAI的公共事件报告构想涉及在处理更复杂案例时引入第三方审计机构。

“在这里,公众的透明度至关重要。这些公司的做法固然不错,但这一切都建立在它们的善意基础上;我认为这还不够。”SaferAI的执行董事Henry Papadatos在采访中表示。

美国财政部长Scott Bessent表示,本周末他将与中国副总理何立峰进行会谈,他认为与北京方面展开安全方面的对话是有可能的。