06:11lmarena.ai@lmarena_ai精选LMArena的Agent Leaderboard基于170万+次真实Agent Mode会话分析,新增按任务类型筛选功能,用户可按Code、Work、Chat三类对比模型性能。排行榜同时展示每个模型完成单次任务的实际成本,并标出各性能水平下最省钱的Pareto前沿选项。这一更新让模型选择不再只看分数,还能结合具体场景和花费做决策。AI产品Agent LeaderboardLMArena智能体推荐理由:选模型前先看看这个排行榜,现在能按写代码、干活、聊天分开比,还直接告诉你每单花多少钱,省得自己瞎试。原文稍后读已读值得跟进有用关注 Agent Leaderboard