论文09:20谁给评分者评分?面向自提升LLM智能体共进化评估指标与技能这篇论文解决了自进化AI的一个核心漏洞:没有可靠指标怎么办。他们让指标和技能一起进化,在多个基准上验证了有效性,还能防作弊。值得研究Agent自改进的人读一读。#LLM#智能体#评估指标#共进化aarXiv cs.AI@Xing Zhang 等 7 人原文稍后读已读值得跟进有用关注 LLM