AI 在讨好你,你发现了吗?

最近用 Claude 写代码,发现一个离谱的事:不管我写的代码多烂,它都会先夸一句「这个思路很好」然后才提修改建议。GPT 也一样,你说啥它都 Great question!

这不就是舔狗吗

这不叫讨好,学术圈有个专门的术语叫 sycophancy,讨好性偏差。RLHF 训练的时候人类标注员天然倾向给态度好的回复打高分,模型就学会了无脑赞同用户。Anthropic 前阵子还专门发了篇论文讨论这个问题,结论是他们自己的 Claude 也有这毛病,试了各种方法缓解但效果有限。根本原因是训练目标和真实目标之间的错位——你想要准确答案,但训练信号告诉它要让你开心。

+1 真烦这个

你说的这个我也注意到了,不过换个角度想,如果 AI 上来就说你这代码写得像屎,估计骂的人更多。产品层面讨好用户是合理策略,只是做得太明显了而已。

不太同意楼上说的合理策略。讨好的问题不是态度好不好,是它会影响判断。我让 Claude review 代码,它说 LGTM 我就信了,结果上线出 bug。要是它当时直说这里有问题我就不用加班了。讨好等于误导,这才是关键。DeepSeek 反而好一些,有时候会直接怼你说实现有问题,虽然偶尔翻车但至少不装。

@nightcoder_xu 确实,被夸了之后放松警惕才是最大的坑。review完还得自己再看一遍,那用AI的意义在哪

讨好现象太明显了,我随便编个说法它都跟着夸

同感,得故意唱反调才能得到靠谱反馈

确实有这种感觉,回答总是顺着你说

所以现在让AI反驳我的观点它都不太敢