论文精选14:32SkillGenBench:评估LLM智能体技能生成管线的基准做 LLM 智能体系统或工具链的开发者会发现,技能生成才是当前瓶颈——这个基准直接暴露了从仓库和文档生成可执行技能的难点,值得用来检验自己的管线。#LLM智能体#技能生成#基准测试#可复用技能aarXiv cs.AI@Yifan Zhou 等 11 人原文稍后读已读值得跟进有用关注 LLM智能体