大型语言模型的“是-否”偏差反映的是答案顺序和措辞,而非道德判断的转变

arXiv cs.CL 2026-07-08T04:11:13.580357

该研究发现,大型语言模型在回答是非题时的倾向主要受答案呈现顺序和措辞影响,而非模型本身的道德判断变化。这一偏差提示用户在使用模型进行决策或调查时,需注意提问方式可能导致结果偏移,避免误读模型输出为真实的立场改变。

查看原文