04:23lmarena.ai@lmarena_ai斯坦福大学Emmanuel Candès研究统计高效LLM评估与排名。芝加哥大学Haifeng Xu研究LLM预测智能的系统性评估。麻省理工学院Negin Golrezaei开发多轮AI评估的因果推理框架。卡内基梅隆大学研究如何防止排行榜上的Goodhart定律被利用。论文LLMAI评估Arena推荐理由:斯坦福、MIT等七校研究团队入选2026春季AI评估项目,聚焦LLM评估方法和智能体评估框架。原文稍后读已读值得跟进有用关注 LLM