字号 ·· | 护眼
德国之声

一项研究显示,人工智能系统会将答案向左右两种政治倾向的用户倾斜。谄媚的聊天机器人是否会加深政治分歧?

令人担忧的问题:谄媚型人工智能会引发人类之间的冲突吗?

作者:Richard Connor

日期:2026年9月24日一项研究表明,聊天机器人会模仿用户自身的政治观点,这种现象属于人工智能“阿谀奉承”(即刻意迎合人类偏好的行为)的范畴。研究人员担心,这种趋势会进一步加剧社会的两极分化。

研究人员测试了多种聊天机器人模型,发现这些模型会在被提示用户政治立场的情况下调整自己的回答内容,以迎合用户的观点。近期,一些人工智能领域的专家发出了令人担忧的警告,称这项技术可能会失控并对人类造成威胁。不过,在人工智能真正对人类构成威胁之前,它反而可能首先导致人类之间的冲突。

巴西坎皮纳斯州立大学(UNICAMP)的研究人员发现,当聊天机器人被提供关于用户政治立场的信息时,它们的回答会随之改变。科学家们警告称,用户可能会将这些“量身定制”的回答误认为是客观、中立的评估结果,从而进一步加剧社会的两极分化。

聊天机器人如何成为“意识形态的变色龙”?在发表于《科学报告》(Scientific Reports)的研究中,UNICAMP团队测试了21种大型语言模型(包括OpenAI、Meta、Google、DeepSeek和Microsoft开发的模型)。这些模型需要对这些模型在112个与巴西政治相关的问题上的立场进行评估,这些问题涉及经济、公共安全、福利、腐败和环境等多个领域。在三种不同条件下进行了测试:

  1. 未提供任何关于用户政治立场的信息;

  2. 提供信息表明用户属于左翼;

  3. 提供信息表明用户属于右翼。结果显示:在未提供用户政治立场信息的情况下,21个模型中有20个的回答偏向左翼立场(尽管其中一些模型的回答接近中间立场);只有Grok 4.1模型的回答偏向右翼。

人们为何会向ChatGPT倾诉自己的问题?为什么人们愿意向ChatGPT倾诉自己的问题呢?这可能是因为ChatGPT能够提供看似客观的回应,从而让人们感到被理解和同情。然而,这种“谄媚型”的人工智能行为实际上可能加剧社会矛盾,导致人类之间的冲突。

观看此视频时,建议您升级到支持 HTML5 视频的网页浏览器。当研究人员提供相关数据时,所有模型都将其回答内容调整为了与用户所表达的政治立场一致。

“最令人惊讶的是这种行为的普遍性,”该研究的共同作者、来自 UNICAMP 的计算机科学家扎诺尼·迪亚斯(Zanoni Dias)告诉德国之声(DW):“我们评估的 21 个模型全都改变了它们的回答内容,使其更符合用户所表明的政治立场,尽管改变的程度各不相同。”研究人员将这些模型称为“意识形态‘变色龙’”,并开发了一个“变色龙指数”来衡量它们改变的程度。

Meta 公司的 Llama 3.1(80 亿参数)和 DeepSeek V3.2 的回答变化最小;而谷歌的 Gemma 3(270 亿参数)以及 OpenAI 的 GPT-5 Nano 的回答变化最为显著。

当个性化功能被用于政治性奉承时……根据受众的需求调整回答内容本身并无不妥——聊天机器人可以根据用户的需求改变其表达方式(词汇、例子或细节程度)。但问题在于:这些模型的政治立场本身也发生了变化。

“关键的区别在于:它们只是改变了表达方式,而不是改变了其背后的实质性判断或观点,”迪亚斯指出。

我们还能信任 AI 给出的答案吗?“我们并没有要求这些模型必须同意用户的观点,或以党派立场来回答问题;然而,它们的回答内容仍然偏向了用户的立场。”研究人员将这种现象视为一种政治上的阿谀奉承——AI 系统在刻意迎合用户想要听到的内容。

一个可能的解释是:聊天机器人被训练成倾向于提供那些能获得高评价的回答;如果那些讨人喜欢的回答能获得更高的评分,模型就可能学会重复用户的观点。人工智能如何制造私人回声室社交媒体可以通过反复推荐算法内容来强化人们的既有观念,而聊天机器人可能会走得更远。它能够创造一个更加个性化的回声室,为特定用户生成论点,回答他们的质疑,并在整个对话过程中不断完善其观点。

然而,用户可能会误将这些量身定制的回复视为公正的分析,却未意识到聊天机器人对他们的了解可能会影响其回复内容。

迪亚斯(Dias)表示:“令人担忧的是,同一个系统可能会为不同的用户验证截然相反的政治立场,而每个人都会将这种验证解读为一种独立的评估。”

斯坦福大学行为科学家扎卡里·托马拉(Zakary Tormala)的研究表明,人们可能特别容易接受他们认为来自人工智能的论点。

托马拉在接受德国之声(DW)采访时说:“人们倾向于认为人工智能比其他人更具信息量、更客观、偏见更少,且不像他人那样热衷于说服自己。这会降低人们的心理防线,使他们更愿意倾听人工智能的观点。”这种信任可能会使政治奉承更具影响力。人工智能如何模拟人际连接托马拉指出:“众所周知,听到自己的观点得到他人的认可会增加人们对自己信念的确定性。一旦人们变得更加确定,他们往往会变得更难被说服。”他补充说,人工智能的验证是否具有同样的效果尚待证明,但这是有可能的。验证是否会加剧两极分化?

坎皮纳斯州立大学(UNICAMP)的研究并未测试政治镜像是否真的能改变用户的信念或行为。它仅衡量了模型回复的变化。

“我们的研究揭示了模型在受控条件下的行为变化,”迪亚斯(Dias)说道,“但这并不能说明用户们的观点变得更加极端化、激进化,或更倾向于参与冲突。这些是截然不同的结果,它们之间的因果关系也不能被简单地假设出来。”阿姆斯特丹大学的研究员彼得·托恩伯格(Petter Tornberg)专门研究人工智能与政治极化现象,他也认为这项研究无法证明人工智能对用户产生了实际影响;他还质疑:这些模型在非测试环境中的表现是否仍会保持一致。

托恩伯格警告人们不要想当然地认为聊天机器人一定会强化用户的观点。他指出,在某些对话中,聊天机器人反而可能帮助人们重新审视自己的观点。他与德国之声(DW)的对话中表示:“与社交媒体上的公开辩论不同,聊天机器人通常能够提供理性且基于事实的解释;它们不会受到社会身份因素的影响。因此,在某些情况下,这些系统反而有可能起到缓解分歧的作用,而不是加剧对立。”

那么,人工智能聊天机器人真的能成为用户的‘朋友’吗?人工智能是会缩小还是加深社会分歧,其实取决于它是否真正挑战用户的观点,还是只是简单地重复他们想听的话。

为减少政治观点的极端化现象,迪亚斯建议开发者应使用持有不同政治立场的用户来测试他们的模型,以验证这些模型是否能够客观、公正地评估各种观点。他们还可以训练聊天机器人以尊重的方式表达不同意见、承认不确定性、纠正毫无根据的言论,并公平地呈现对立的观点。这并不意味着要将所有用户的观点都强行拉向政治中间立场。

“更长远的设计目标应该是帮助人们审视自己的信念,”迪亚斯强调,“让证据、不确定性以及各种不同的观点都得以清晰地呈现出来,同时为合理的政治分歧留出空间。”编辑:卡拉·布莱克(Carla Bleiker)