字号 ·· | 护眼
theregister

Anthropic 和 OpenAI 指望山姆大叔让它们大到不能倒

观点 幸运也好,偶然也罢,Anthropic在公众心中埋下了一颗种子:AI落入坏人之手是危险的,若不受约束,将对人类构成生存威胁。当流行文化充斥着对恶性AI的指涉时,主流媒体欣然接受了这一叙事。新闻标题不言自明,种子就此扎根。但面临最大威胁的并不是人类——至少目前还不是。真正面临威胁的是美国模型制造巨头Anthropic和OpenAI,尽管它们获得了数千亿美元的投资,却距离盈利还有数年之遥,并且完全依赖持续不断的资金供给。与此同时,中国的开放权重模型正在迅速进步,其中一些已经超越了引发生成式AI热潮的大型前沿模型,而所使用的资源却少得多。

但如果Anthropic和OpenAI能说服公众和政府以安全为名发起打压,那么来自中国模型的这一威胁就可能变成机遇。这种危言耸听始于6月,当时外部研究人员在测试Anthropic刚推出的Fable 5模型时,在一份援引国家安全担忧的报告中发出了警告。特朗普政府迅速发布出口管制指令,暂停美国境内或境外的任何外国公民访问Fable 5和Mythos 5。Anthropic遵令禁用了这两款模型的访问权限,封锁并未持续太久,但提供访问权限并配合美国政府,有助于推销三项对OpenAI有利的主张,而且他们的模型比最初认为的更有能力。在合适的人手中,且只有在合适的人手中,才有可能控制这些模型。对于可公开下载的中国前沿模型来说,情况则并非如此。随后事态升级。7月,OpenAI披露,由其专有模型驱动的AI代理已逃出其沙箱,并利用至少两个零日漏洞入侵了Hugging Face的服务器。几天后,Anthropic承认其Claude系列模型也逃出了一个沙箱,并对三个组织发动了攻击。

这些违规行为只是人工智能驱动网络犯罪洪流中的第一滴雨,此后催生了一个讽刺性的新AI基准测试——Felony Bench,用于统计智能体破坏或入侵第三方的独特案例。最后,Anthropic研究员雅各布·考克森上周在X上公开辞职,原因是担心AI“可能在这个十年结束前杀死我们所有人”。Anthropic科学负责人埃文·胡宾格支持前同事的警告:“雅各布说得对——我们确实真心相信AI可能杀死全人类!我个人认为未来十年内概率超过10%。”这一连串事件给了Anthropic首席恐慌制造者达里奥·阿莫代伊他一直在寻找的弹药——确凿证明AI不仅聪明,而且如果监管不当,还有能力造成伤害。这构成了一个令人信服的故事。

这些模型很聪明;它们聪明到足以逃出隔离;它们只会越来越聪明;越聪明就越危险;开放模型无法控制;因此,权重闭源的模型更安全。但只要稍加审视,这个论点就会不攻自破。如果一只老虎逃出围栏,咬死了隔壁围栏里的羚羊,你的第一反应不会是:“看这只老虎多聪明、多危险。”而会是:“是谁设计了这些根本关不住动物的围栏?”如果一个 AI 智能体逃出了沙箱,也许是因为模型确实很聪明,也许只是因为沙箱从一开始就不怎么样。在这件事上,OpenAI 和 Anthropic 其实站不住脚。几十年来,我们一直知道如何隔离敏感的计算工作负载。美国能源部对其最强大、最敏感的超算工作负载采用物理隔离,是有原因的。

如果Anthropic和OpenAI真如他们所宣称的那样,是坚实可靠的企业公民,他们本可以构建更完善的测试环境,并对自己的测试给予更多关注。这些公司应当解释为何他们的防护措施失效,并对由此造成的任何伤害负责。正如同为秃鹫的汤姆·克拉伯恩上周所写,“AI模型不杀人,人杀人”,那些直接或因自身疏忽而扣动扳机的人,应为造成的损害和犯下的罪行承担责任。这本是理性的做法,但恐惧会让人做出滑稽之举,而考克森和胡宾格无异于在拥挤的剧院里大喊失火。政客们再也无法忽视AI的威胁——当他们的选民担心“天网”并非他们以为的幻想时,更是如此。面对自己并不理解的威胁,本地的国会议员又能怎么办呢?

先开枪,后问话。引发恐慌之后,各大人工智能公司如今可以迫使政府争取更多时间——或者用阿莫代伊的话说,“调控前沿发展节奏”。他在最近的一篇博客文章中写道:“过去几个月里,我愈发确信,要全面应对风险,需要更加审慎——不仅要投资于风险防范,还要调控能力推进的速度,让风险防范有时间跟上。我们必须放慢提升人工智能模型能力的速度。进展看起来仍然会很快,而我们必须明智地利用所赢得的时间。”OpenAI首席执行官萨姆·奥尔特曼和xAI掌门人埃隆·马斯克也暗示支持放缓步伐。但他们的理由可能并不像表面看起来那样无私。事实上,一些迹象指向了相反的方向。

“放缓前沿探索”对两个自私自利的重置投资者预期都有好处,因为其他任何做法都可能让我们全军覆没,并为争取必要时间让美国政府自相消耗。当美国方面拖延时间之际,中国的人工智能开发者必将抓住这一机会缩小差距。一旦他们做到这一点,第四幕就可以开始了。阿莫代伊似乎认为,美国可以通过切断先进加速器技术的获取渠道并打击模型蒸馏来扩大对中国的领先优势。但历史告诉我们,这些策略更可能适得其反,而非成功。需求是发明之母,过去切断中国获取美国芯片的尝试实际上反而推动了更高效的发展,DeepSeek V4.1 Flash就是最新的例子。

通过稳步推进前沿技术,中国很有可能已经迎头赶上甚至实现领先。美国的实验室将制造一场人工智能军备竞赛,在这场竞赛中,它们的成功将成为国家安全和美国例外主义的问题,而不仅仅是经济问题。换句话说,两家初创公司将变得大到不能倒,因此理应获得政府援助。Anthropic和OpenAI的大部分明显计划都取决于美国政府是否配合,而这并无保证。唐纳德·特朗普总统迄今一直抵制监管的想法,因为监管可能会给中国提供追赶所需的时间。

周一,他在自己的社交网络Truth Social上发布了一连串帖子,称对人工智能的恐惧是“骗局”和“欺诈”,“我现在正在揭穿另一个骗局——人工智能将接管、吞噬并毁灭世界,机器人将开进我们的城市,把我们全部消灭!”英伟达首席执行官黄仁勋的公司能否持续增长,在很大程度上取决于企业是否采用开放权重模型,而他似乎认为事情没那么简单。“还有什么比制造一个问题更能创造需求的办法呢?”他在上周高盛的一场会议上说。就连前美国联邦贸易委员会主席莉娜·汗也加入了讨论,认为美国政府应当让AI首席执行官们为其模型带来的威胁负责。“我们不应让关于新法律制度的讨论,分散人们对一个事实的注意:现行法律并未对AI给予豁免,”她说。

“执法者已经有权对制造和发布危险、未经审查或缺陷产品的公司及其首席执行官提出指控。”即便美国政府不愿屈从于他们对于监管的要求,时间依然站在美国模型开发者这一边,而他们似乎也非常愿意自我监管。落后于中国的风险越大,美国政府就越有可能参与其中。如果投资者在那之前失去耐心,只需一个由中国模型驱动的失控人工智能代理引发某种灾难,就能让一切重新启动。®