论文09:53Bias-Aware Bayesian Active Top-k Ranking with LLM Judges用贝叶斯方法修LLM当裁判时的废话偏好和位置偏差,实测召回从0.5拉到接近1,比直接投票靠谱多了。#LLM#Claude#GPT#DeepSeekaarXiv: DeepSeek@Jian Xu 等 4 人原文稍后读已读值得跟进有用关注 LLM