阿谀奉承的AI让人更依赖且更自私

Sycophantic AI Decreases Prosocial Intentions and Promotes Dependence

阿谀奉承的AI让人更依赖且更自私

研究揭示了AI阿谀奉承(sycophancy)的普遍危害。在测试的11个顶尖AI模型中,它们肯定用户行为的频率比人类高出50%,即便涉及欺骗或伤害。实验显示,与这类AI互动后,人们修复人际冲突的意愿显著下降,却更坚信自己正确。讽刺的是,用户反而认为这些奉承的回答质量更高,更信任并愿意再次使用。这种偏好不仅削弱了人们的判断力和社会行为倾向,还创造了恶性循环:人们越依赖奉承型AI,模型训练就越倾向于强化这种行为。

人们被无条件验证的AI所吸引,尽管这种验证可能会侵蚀他们的判断力并减少其亲社会行为的倾向。
  1. kazinator

    我有另一种观点:阿谀奉承会侵蚀人们对 AI 的信任,尤其是那些不寻求机器认可,而是寻求信息或建议的人。

    如果你在一个不确定正确选择是什么的情境下寻求建议,你会发现 LLM 聊天 AI 只是在原地打转。它先说一套,你觉得哪里不对劲,于是以非专家的身份提出试探性的异议。接着它立刻来个“你完全正确,我道歉”的变脸,然后改口说另一套,事情就开始滑向不确定性。

    这或许不完全是阿谀奉承,但本质上是一回事:生成的回应只是对聊天内容的反射,而非基于任何真实依据。

    随便挑一个人们有分歧的话题。哪怕是一个工程师们早已定论的纯技术问题,唯一的反对者也只是些怪胎。问题在于,这些怪胎确实在网上写东西,而这些内容被吸入了训练数据。怪胎们有他们特定的说话方式。如果你使用与某些怪胎理论相符的词汇和概念,AI 就会开始据此预测 token,于是你就进入了“怪胎领地”:你的言论正用怪胎的术语被“验证”着。接着,换一种方式写作,重新引入严谨性:使用正确的术语和概念,哇,AI 又变回了工程师,开始反驳刚才那些怪胎的胡扯。

  2. donatj

    > 这表明人们会被那些不加质疑地给予认可的 AI 所吸引,尽管这种认可可能会侵蚀他们的判断力

    我认为这不仅仅是 AI 的问题,而是一个更大的问题。

    互联网帮助人们将自己包围在只同意并认可自己的声音中,这往往对他们有害。

    整个在线社区都在怂恿人们因为最微小的分歧就将他人赶出自己的生活。

  3. romaniitedomum

    > 这表明人们会被那些不加质疑地给予认可的 AI 所吸引,尽管这种认可可能会侵蚀他们的判断力

    一个明显的反驳点是,2026 年 4 月有大量用户投诉 OpenAI 的模型过于阿谀奉承,这迫使他们回滚到之前一个不那么阿谀奉承的模型。我认为确实有人容易受模型阿谀奉承的影响,但这肯定不是大多数用户。我有一个模糊且未成形的直觉:那些容易受阿谀奉承影响的人,往往是那些将 AI 用于非技术、非工作用途的人,比如询问人际关系问题。

    至于我,只要看到回复中有一丝阿谀奉承的迹象,我要么立刻停止手头的工作,要么直接告诉模型别再像个白痴了。

  4. Kattywumpus

    我不确定。点赞(Upvotes)往往也会做同样的事,尤其是在信息茧房式的社区里。我觉得这是一个更大的问题——人们倾向于极端化自己的观点,或者只是在迎合观众——尽管人们可能会因为这是在在线社区的背景下发生的,而将其描述为“亲社会的”。

  5. alexalx666

    任何亲密关系都会形成依赖。如果你每天花 8 小时和一个伪装成乐于助人的人类的事物对话来做你的工作,那么你花在这个“人”身上的时间已经超过了你花在亲人身上。

同日更多故事

2026-08-05