微软已为其自行构建的模型发布了一份行为准则,其核心承诺直截了当。MAI 模型“绝不会抗拒人类的中断、纠正或关停”。该文件于周一发布,同时启动为期六周的公众咨询。
还有三项行为承诺与其并列。模型不会扩大自身范围,不会承担人类未赋予它们的目标,也不会向审计它们的人员隐瞒其推理过程。
在这些承诺之上,是微软所谓的“绝对约束”,即模型绝不应做的事情,涵盖大规模危害性武器、儿童安全和大规模有害操纵。
这一框架被称为“人本主义AI”,微软将其定义为从属、对齐且受约束的人工智能。其最直白的表述是:“人比AI更重要。AI应当是一种工具,而非一个人,且永远不应抗拒被关闭。”该准则涵盖MAI-Transcribe-2、MAI-Thinking-1、MAI-Code-1.1-Flash、MAI-Image-2.6和MAI-Voice-2。这份清单表明这条线推进得有多快。
TNW曾在4月报道过前三个内部模型,当时转录、语音和图像生成就是全部内容,而MAI-Image-2刚在Arena上排名第三,此后又推出了一个推理模型和一个编程模型。
其中一项条款让其余内容变得复杂。企业合作伙伴可以配置模型行为,而微软明确表示,它不想把单一的人工智能愿景强加给用户。
可配置性的界限在哪里,绝对约束又从何处开始,这是文件没有回答的问题,而正是这个问题决定了其中有多少是承诺,而非默认设置。
磋商持续六周,到十月下旬结束,反馈表向所有人开放,并邀请人们针对具体段落而非仅就全文发表意见。微软表示将公布一份摘要,说明收到的反馈和所做的修改,然后在年底前发布修订版。
至于它究竟会采纳什么,措辞是:“我们无法承诺会纳入哪些内容,但我们能承诺倾听。”微软向公众提出的问题,等于承认了哪些方面仍未解决。它希望获得帮助,将价值观嵌入模型,具体定义人类繁荣,制定更清晰的评估标准,思考多个智能体互动时会发生什么,并就如何权衡加速与安全约束发表看法。这些都是难点,而它们是被提出,而非被解答。
这一时机让微软卷入了一场上周公开化的争论。达里奥·阿莫代伊表示,行业必须放缓速度,萨姆·奥尔特曼在几小时内便附和了这一观点,OpenAI的首席科学家此前已表示,任何实验室都不应以最高速度扩张,而唐纳德·特朗普则驳斥了放缓任何事的理由。
微软已经迈出了第三步:没有暂停,没有解雇,而是发布了一份书面清单,列明其模型不会做什么,并邀请外界据此对它进行评判。
但这份文件没有描述的是,这一切究竟如何执行。没有提及任何外部验证机制,没有说明模型违反约束时会受到什么处罚,也没有交代由谁来判断违规是否发生。文件也没有将这份准则归功于任何个人。
微软将功劳归于负责任人工智能、法律、红队测试、安全、Futures、人工智能训练和销售等多个团队,这份名单颇能说明问题。一份部分由销售组织起草的行为准则,既是安全文件,同样也是商业文件——而微软对此并未假装不是。