#LLM智能体

共 60 条 · 7 天 7 条 · 30 天 13 条
6月4日
6月3日
论文精选72°10:13
Agent libOS:类库操作系统运行时,为长期运行的LLM智能体提供能力控制

做LLM智能体工程化的团队终于有了一个正经的运行时方案——Agent libOS把智能体当进程管理,解决了长期运行、权限控制和审计的痛点,做智能体框架或生产部署的开发者值得细读。

事件专题
arXiv cs.AI@Yingqi Zhang2 个信源在谈原文
6月2日
5月29日
论文精选72°13:03
GRASP:带回归感知门控的技能提案器,让LLM智能体自我改进不倒退

做LLM智能体自我改进的团队终于有了一个不担心「修好一个、搞坏一个」的方案——GRASP用硬回归预算和门控机制确保每次改进都是净收益,临床场景提升显著,建议做智能体可靠性的开发者点开看看。

arXiv: DeepSeek@Johannes Moll 等 7 人原文
5月28日
5月27日
5月22日
5月21日
5月20日
5月19日
5月18日
论文精选10:35
复合LLM智能体设计成本-性能研究:上下文、推理与层级

做LLM智能体系统设计的工程师和研究者会看到具体数据:什么设计真正有效、什么只是烧token。这篇论文给出了可操作的优先级——先做好状态抽象和任务分解,再考虑推理增强,值得点开对照自己的设计。

arXiv cs.LG@Igor Bogdanov 等 6 人原文
5月17日
5月11日