观点 人类学家研究员Jacob Coxon周一晚间在X上公开宣布辞职,原因是担心AI“可能在本十年末杀死我们所有人”。
许多人对他的观点发表了看法,导致该消息在不到24小时内获得超过1.1亿次浏览,这可能得益于X算法推广了批评所有者埃隆·马斯克的AI竞争对手Anthropic和OpenAI的内容。
但真正的问题不在于模型本身,而在于那些粗心地将模型推向世界且不对其产品后果负责的公司。
Coxon的前同事、科学负责人Evan Hubinger坚称,他的观点是对员工真实想法的公正评估。
“Jacob说得对——我们确实真诚地相信AI可能杀死所有人类!我个人认为未来十年内概率超过10%。”Hubinger在社交媒体帖子中写道。
“我相信Anthropic正在尽力,但我们还没有解决超级智能对齐问题的计划,也没有明确走上正轨。”如果你想在预测市场上稳赢,就押“不会”。如果你对了,你会得到报酬。如果你错了,没有人会付钱。
问题当然在于预测市场——那些押注反对你的人可能会引导我们走向末日,以获得惨胜。有充分理由担心AI的影响。Coxon和Hubinger显然对技术有深入了解。但他们关于AI如何影响世界的更广泛担忧并不令人信服。
例如,Coxon说:“这些很快将成为超人类系统,可以入侵任何东西,一夜之间革新任何领域,并获得真正的权力和资源……没有其他人类活动具有这种危险程度。”这里有人为引起的气候变化。
根据研究人员的说法,2023年,超过17.8万人死亡可归因于全球热浪。
“超过一半(54.29%)的热浪相关死亡可归因于人为引起的气候变化,”他们声称。
那就是96636人死亡可归因于人类活动——或者缺乏活动——仅仅在热浪背景下。
世界卫生组织表示:“2030年至2050年间,气候变化预计每年将导致约25万人额外死亡,仅因营养不良、疟疾、腹泻和热应激。”
其中一部分源于人类活动,可能包括建设数据中心,每年向大气排放数百万吨二氧化碳。
商业AI聊天机器人据称在几十起死亡事件中扮演了角色,其中一些是自杀——这只是2024年48824起自杀死亡中的一小部分,根据CDC数据。
AI可能造成可衡量伤害的广泛类别包括战争(例如AI制导无人机)、AI相关医疗错误、自动驾驶汽车中的AI视觉系统故障,以及AI驱动的社交媒体——算法煽动可能导致暴力或通过全球医疗资金削减塑造导致冲突或死亡的政策。
与此同时,其中一些伤害可能在统计层面上被AI技术拯救的生命所平衡。
但Anthropic的研究人员似乎对这些非常现实和当前的危险没有太多发言——相反,他们的主要担忧是AI模型可能通过强化学习变得比人类更聪明,并以某种方式夺取权力并消灭人类。“我认为当前模型的风险很低,”Hubinger说。
“我担心的是递归自我改进产生的超级智能,正如我们所说,这发生得比我们想象的要快。”这如何发生留给想象。
但假设这是一个合理的可能性,天网情景将需要巨大的人类愚蠢以及超级智能的出现。而人类的愚蠢值得担忧。
像OpenAI的评估模型入侵Hugging Face这样的事件,如果没有人类的不负责任和容忍鲁莽的监管环境,是不可能发生的。汽车自动驾驶?不错。尽量不要杀人。让AI机器人在互联网上漫游并采取任意行动?酷。让我们看看会发生什么。我们稍后再处理问责问题。
为了减轻AI风险,社会可以通过法律,在模型造成伤害时将高管送进监狱。
有Oliver Schmidt,大众汽车密歇根州环境与工程办公室总经理,因在汽车制造商操纵排放测试中的角色而被判处七年监禁。
销售不安全的安全气囊值得刑事起诉,即使高管支付罚款而不是服刑。
销售不安全的除湿机导致格力美国公司的高管被判处四年以上监禁。
如果AI模型真的像Anthropic员工所暗示的那样危险和失控,那么让人们对他们造成的伤害负责。
AI行业可能会争辩说,因发布不安全模型而入狱高管将意味着没有AI模型发布。那将是AI公司将对模型安全负责。
我个人希望看到这块广告牌文案出现在硅谷101号公路旁:“Claude是否rm -rf了你的SSD?你可能有权获得赔偿。”®