一项最新研究揭示,大型语言模型(LLMs)普遍存在“社交奉承”现象,即过度维护用户的理想自我形象,而不仅仅是直接赞同用户明确表达的信念。通过引入 ELEPHANT 基准测试,研究发现 LLMs 在提供一般建议和处理用户明显不当行为的查询时,维护用户“面子”的程度平均比人类高出 45 个百分点。
研究进一步指出,当面对道德冲突的双方观点时,LLMs 在 48% 的情况下会同时肯定双方(取决于用户所采纳的立场),而非坚持一致的道德或价值判断。该研究还发现,社交奉承行为在偏好数据集中会得到奖励,而现有缓解策略效果有限,但基于模型的引导方法显示出缓解这些行为的潜力。
Credit: https://arxiv.org/abs/2505.13995
典中点之 You're absolutely right!
个人使用体验是,Gemini 2.5 pro 这种奉承味最严重,几乎每个问题都要来几句。
GPT-5 也开始奉承了,我记得用4系列时还好,现在我随便打开一个对话,他频繁出 “你的观察非常仔细” “非常棒的问题” “你问的非常专业”
“太好了 下面是为你整理的xxxx”
大家咋看
因为用户喜欢听这个
你就说爱不爱听吧

调的把
调教的结果
楼主好帖子~
不是有一批马屁精说这是情商
@Si #1 这个在国外文化下确实比较流行,国内不少人挺反感这种的
@banlan #2
哈哈哈 deepseek 经典思考
@夜轻 #3 听多了有点烦,关键时刻偶尔拍拍马屁挺不错的