论文23:48Agent Explorative Policy Optimization 提升多模态智能体推理能力多模态智能体推理是当前 AI 的前沿方向,AEPO 为开发者提供了一种可落地的训练优化思路,做智能体或多模态应用的团队值得关注。#智能体#多模态#推理模型#强化学习AK@_akhaliq原文稍后读已读值得跟进有用关注 智能体