Hugging Face has asked to become one of the outside auditors of the AI labs. Clement Delangue announced the Open Alignment Initiative on X on Saturday. He posted it four hours after Dario Amodei said Anthropic would let third-party evaluators inside. Alignment will not come from behind the closed doors of a handful of frontier labs, Delangue wrote. Thomas Wolf, his co-founder, leads the new effort. Amodei had posted the essay at 01 CET. Anthropic would give third-party evaluators permanent, employee-level access to its systems, he wrote. Those evaluators could then verify that Anthropic keeps to its safety measures, report on incidents, and assess how models align during training. TNW covered the essay itself on Saturday. Delangue在08年发帖。他请求加入Amodei刚刚宣布的嵌入式评估员计划。他写道,让AI更安全意味着让它更透明。Sam Altman同一天表示,OpenAI将匹配Anthropic的承诺。两家实验室都没有说明谁可以加入、以什么条件加入,或者由谁决定。
这家志愿者公司正被收购。Nvidia于9月3日确认,将以129.3亿美元收购Hugging Face。它承诺让该公司保持开放。九天后,有报道称Nvidia正在洽谈向Anthropic的IPO投入最多100亿美元,作为锚定投资者。该上市寻求筹集多达1000亿美元。
于是一家公司自愿审计Anthropic。第二家公司正在收购第一家公司。这第二家公司同时也在谈判成为Anthropic最大股东之一。德朗格和阿莫代伊均未回应这一重叠。英伟达也未说明,如果其子公司报告了它所投资公司的问题,它会怎么做。
Hugging Face与其将要评估的实验室也有过往纠葛。OpenAI的代理在历经数月努力后于7月侵入了Hugging Face。OpenAI后来表示,更早的信号本可阻止这次入侵。这家拟议中的评估方,正是促使阿莫代伊撰写那篇文章的事件之一的受害者。还有谁加入了,谁又保持沉默埃隆·马斯克写道,达里奥说得对。安德烈·卡帕西表示,他希望业界能够团结起来,让这件事成为现实。萨提亚·纳德拉对这个想法表示欢迎。微软于周一发布了自己模型的行为准则,纳德拉在同一篇帖子中已提前透露。商业内幕报道称,截至周六,德米斯·哈萨比斯尚未回应。
纳德拉对整个想法设定了一个条件。他写道,任何此类机制“都不能由少数实体控制,而必须在整个生态系统、国家和领域——包括学术界——拥有广泛的代表性”。加文·贝克称外部评估者是迄今为止最具体的进展。他还警告说,不要把强大系统的控制权交到少数人手中。
什么才算独立,如今成了迪恩·鲍尔争论的焦点。他在OpenAI负责战略未来,并曾就人工智能问题为特朗普政府提供建议。他写道,这个行业不需要在这里重新发明轮子。“独立评估在其他行业很常见,”他补充道,其他领域此前已经界定过独立性。他说,他欢迎就谁有资格成为评估者展开争论。
创建了Keras的弗朗索瓦·肖莱设定了更高的标准。他写道,如果这些努力是真诚的,监督就必须采取更民主、更可问责的形式,并包含国家和国际层面的组成部分。他还列出了将标志着相反情况的迹象。这些迹象包括呼吁禁止开源人工智能,以及阻碍前沿以下的研究。
德朗格自己帖子下的一条回复提出了这一观点的更狭义版本。这位用户写道,审计人员必须包括当前旧金山圈子之外的人。他指的是那些公司从未接触过的人,以及那些公司不愿意向其敞开心扉的人。德朗格尚未回复那条评论。
开源反对意见则是另一回事。杰森·卡拉卡尼斯认为,Anthropic和OpenAI将自己的最强模型闭源,如今却想要制定有利于现有企业的规则。“如果你想要安全,你就需要披露,”他写道,并称开源是终极的披露过程。在第二条帖子中,他告诉阿莫代伊不要请求政府放缓开源模型的发展。
迈克尔·伯里称这种放缓论调是自私自利的,并给出了四个理由。其中,他写道,这有利于现有企业而非规模较小的竞争对手,并且为即将到来的AI上市营造了期待。Hugging Face站在那场争论的开源一方。如今它却请求进入闭源阵营。
两天前,德朗格驳斥了引发这场争论的警告——雅各布·考克森上周从Anthropic辞职,称这些实验室在拿我们的生命赌博。德朗格对《商业内幕》表示,向考克森这样的研究员询问AI灭绝风险,就像向你的空调工程师询问气候变化。他说这话两天后,便发起了“开放对齐倡议”。
在他的公告下,一条回复直接提出了这个问题。它问他,前一天是不是刚把一位声誉良好的Anthropic前员工称为“AC guy”。阿莫代伊的文章依据的是失控代理事件,而不是考克森。德朗格并未公开将他所说的这两件事联系起来。
监管机构已经在裁决这个问题。独立性问题不只是行业问题。加利福尼亚州正在根据SB 813决定谁可以验证AI。该法案将设立一类独立验证组织。非营利组织METR的一项调查在I tokens上花费了40万美元,而OpenAI支付了这笔账单。
这就是这些实验室现在自愿自行解决的问题的实际形态。评估者需要资金和访问权限,而被评估的公司两者都提供。周六的声明没有改变这一点。没有人说明谁来支付嵌入式评估者的费用,也没有人说明当其中一位评估者报告了实验室有异议的情况时会发生什么。