论文精选12:42Role-Agent:通过双角色演进让LLM智能体自我进化做 LLM 智能体训练的团队终于有了一个无需外部环境反馈的自我进化方案——Role-Agent 让模型自己当裁判和教练,平均提效 4%+,值得在复杂任务场景中试试。#LLM智能体#自举学习#过程奖励#双角色演进aarXiv cs.AI@Xucong Wang 等 7 人原文稍后读已读值得跟进有用关注 LLM智能体