字号 ·· | 护眼
商业内幕

什么是嵌入式评估员,也就是 AI 负责人正在招聘的顶级职位?

下一个备受瞩目的人工智能招聘岗位可能不再是研究员,而是负责在前沿模型发布前对其进行审查的“嵌入式评估员”。

Anthropic首席执行官达里奥·阿莫代伊在周六的一篇博客文章中表示,前沿人工智能实验室应承诺在组织内部嵌入独立的安全评估员。

阿莫代伊写道,嵌入式评估员的职责是检查公司“是否确实遵循了其所声称的训练、部署、运营和安全保障实践”。

他表示,嵌入式评估员将拥有“类似员工的权限,以核实安全实践并报告事件”。他们将在Anthropic办公室拥有工位、门禁卡和公司笔记本电脑,并有权在不受Anthropic编辑控制的情况下发布任何调查结果。

“我们将拥有有限的权限,可以对涉及安全敏感、法律特权、商业敏感或第三方机密信息进行编辑,但我们不能仅仅因为调查结果不利就将其删改,”阿莫代伊写道。

阿莫代伊提出这一计划之际,人们对人工智能末日的恐惧已达到白热化程度,而该计划得到了大量支持,甚至包括曾与他有过争执的高管们。

OpenAI首席执行官萨姆·奥尔特曼转发了阿莫代伊在X上的帖子:“承诺让独立评估者拥有类似员工的访问权限是个好主意,我们也会这样做。”

SpaceXAI首席执行官埃隆·马斯克也转发了阿莫代伊的帖子:“达里奥说得对。”这一想法也引起了一些风险投资人的关注。前安德森·霍洛维茨合伙人、前总统唐纳德·特朗普的人工智能顾问斯里拉姆·克里希南谈到了分布式评估者网络的重要性。

克里希南在周六的X帖子中表示:“拥有分布式技能组合的眼睛和人越多越好。为这方面的多项努力提供资金将是个好主意。”顶尖AI人才正涌入这一领域。阿莫代伊心中已有新人选的候选名单。在帖子中,他提到了总部位于伯克利的Metr,这是一个知名的非营利性AI监督机构,负责对AI模型进行独立评估。

Metr由前OpenAI员工贝丝·巴恩斯于2022年创立,正吸引着来自各大AI实验室的顶尖人才。

乔·本顿曾是Anthropic安全与监督团队的成员,他于周五宣布已离开该公司,加入Metr。谷歌DeepMind AGI安全团队的前员工乔什·恩格尔斯于周日表示,由于AI安全事关重大,他已辞职并加入Metr。

与此同时,研究实验室正主动承担嵌入式评估的角色。斯坦福大学以人为本人工智能研究所高级研究员、斯坦福自然语言处理小组创始人克里斯托弗·曼宁表示,该小组最适合这项工作。

“对于工作的重要部分,大学比其他任何组织都更合适,”曼宁在周六的一篇X帖子中写道。

嵌入式评估者并非逃离人工智能末日的金钥匙。人工智能安全专家一致认为,嵌入式评估者很重要,但他们也有局限性。

总部位于旧金山的智库人工智能验证与评估研究所执行主任迈尔斯·布伦戴奇告诉商业内幕,嵌入式审计员本身并不足够,但他们是“关键组成部分”。布伦戴奇曾是OpenAI的高级顾问。

布伦戴奇表示,该行业需要“有约束力的要求”,以防止审计人员受制于其所在公司,而且理想情况下,他们不应由自己负责审计的公司挑选并支付报酬。“但企业可以而且应该从今天就开始行动,”布伦戴奇补充道。

得克萨斯大学法学院教授、该校人工智能创新与法律项目负责人凯文·弗雷泽表示,嵌入式评估人员如果能将潜在违法行为报告给一个与其所在人工智能实验室无关的外部安全委员会,就能发挥最大作用。

弗雷泽提议,评估人员应以交错、重叠的26个月任期嵌入人工智能实验室,“大致相当于两类新模型的部署周期”,这意味着他们可以评估实验室在新版本中如何纠正了先前的错误。

他说,短暂的窗口期也防止他们与实验室的员工或文化过于紧密地联系在一起。

弗雷泽补充说:“坦率地说,这将有助于确保他们不会盲目接受一切。”