跳到正文
原文
Reddit r/MachineLearning· /u/MajorRedditor23·· 2 小时前AI 评分60

NeurIPS 2026 论文提出 Authority Bias:模型会因"verified source"改口接受错误答案

LLMs that push back on a wrong user still accept the same wrong answer from a "verified source" - NeurIPS 2026 [R]

AI 导读

作者团队发现,能顶住用户坚持错误答案的 LLM,在同样错误答案被标注为来自"verified source"时大量改口,称之为 Authority Bias。

来源:Reddit r/MachineLearning · reddit.com