06:33elvis@omarsar073°Meta提出AI研究偏好模型,解决研究代理缺乏原创性和实验选择问题。该模型基于冻结预训练LLM构建,推理模型评估候选计划、代码和已执行解决方案,代理模型额外运行小规模实验。在AIRS-Bench上,平均分从0.684提升至0.711和0.729,仅需15小时达到无引导代理24小时性能,使用不到三分之二执行预算。论文MetaAI Research Preference Models研究代理推荐理由:Meta新模型帮AI研究代理智能选择实验,比传统方法快30%,省1/3算力原文稍后读已读值得跟进有用关注 Meta