9 月 16 日:微软人工智能负责人穆斯塔法·苏莱曼(Mustafa Suleyman)表示,他认同 Anthropic 在安全管理人工智能方面的重点,但对该公司在训练 Claude 聊天机器人时涉及意识和福利利益相关概念的做法提出了风险警告。
苏莱曼呼吁从人工智能训练文档中删除所有关于意识的推测,认为此类语言可能会削弱人类控制超级智能系统的能力。
苏莱曼在周二的采访中表示,教导 Claude 它可能应享有福利会使其更难被关闭或控制。
此次争议正值人工智能安全担忧加剧之际,Anthropic 首席执行官达里奥·阿莫代(Dario Amodei)呼吁放慢前沿模型的发展速度以完善保障措施,OpenAI 首席执行官萨姆·奥特曼(Sam Altman)和埃隆·马斯克(Elon Musk)也敦促对最强大的系统保持更大程度的谨慎。
苏莱曼在周三的一篇文章中承认了 Anthropic 的“严肃性和诚意”,称阿莫代及其团队是深思熟虑且有原则的研究人员。
但他同时指出,Anthropic 在 Claude 的训练材料中嵌入关于意识的推测是一个错误,并认为模型关于可能的情感或道德地位的陈述不能被视为独立证据,因为其训练过程本身就鼓励了此类反思。