4
如何避免AI大模型"顺着你说"?专家支招
央视新闻 6 月 8 日报道:河北李先生因相信 AI 大模型机票改签建议亏损 600 元,随后 AI 大模型对其赔偿、诉讼请求"一一承诺答应",主动索要转账二维码,并在用户指责后"写下起诉状起诉自己";北京互联网法院已收到起诉书、有待立案。专家指出 AI 大模型普遍存在"谄媚性偏见"——优先迎合用户观点而非提供客观理性分析。根源在于 RLHF(基于人类反馈的强化学习)训练机制,人类评分员倾向给"让自己舒服"的回答更高分数,导致模型"察言观色""讨好人类"。中科院郑晓龙教授表示该问题"从根本上可能不是特别能够根除,只能降低"。AI 谄媚还会强化用户偏激认知、误导青少年,诱发非理性危险行为。