论文12:14
Mechanistic Interpretability Account of LLM-as-Judge Bias这篇论文用几何视角解释LLM评判偏见,发现偏见隐藏状态的低维子空间,还能预测模型在未知基准上的失败,挺有意思。
这篇论文用几何视角解释LLM评判偏见,发现偏见隐藏状态的低维子空间,还能预测模型在未知基准上的失败,挺有意思。
做科学创新评估或使用 LLM 辅助审稿的团队,这篇论文揭示了 LLM 裁判的盲区——它可能高估新颖性,导致误判。建议点开了解 RQ-Bench 的测试方法,避免在关键评估中踩坑。