Reddit r/MachineLearning· /u/MajorRedditor23·· 2 小时前AI 评分60
NeurIPS 2026 论文提出 Authority Bias:模型会因"verified source"改口接受错误答案
LLMs that push back on a wrong user still accept the same wrong answer from a "verified source" - NeurIPS 2026 [R]
AI 导读
作者团队发现,能顶住用户坚持错误答案的 LLM,在同样错误答案被标注为来自"verified source"时大量改口,称之为 Authority Bias。
来源:Reddit r/MachineLearning · reddit.com