22:39elvis@omarsar0精选一篇新论文主张自改进智能体在优化自身的同时也应演化其评估基准。研究者实现了一个自进化的Lean证明智能体,其工作流、提示和工具均可被重写。该智能体采用共同进化课程,仅在当前难度被掌握后才引入更难的证明任务。经过15代进化,共同进化智能体在miniF2F上的留出解决率达到45.1%,而种子版本仅为12.7%,固定基准最优版本为32.0%。论文强调将每步奖励锚定在形式验证器上,可避免奖励黑客攻击。论文自改进智能体共同进化形式验证推荐理由:这篇论文提出智能体和基准一起进化,15代后证明正确率从12.7%飙升到45.1%,思路很新。原文稍后读已读值得跟进有用关注 自改进智能体
15:35官方一手marktechpost@Asif Razzaq精选72°Hexo Labs 开源了 SIA,一个自改进循环系统,采用 MIT 许可证。SIA 通过反馈智能体读取每次运行的轨迹,然后重写脚手架或触发 gpt-oss-120b 的 LoRA 权重更新。结合这两种杠杆,在 LawBench、TriMul GPU 内核和 scRNA-seq 去噪任务上,SIA 的表现优于仅更新脚手架的方法。这为 AI 智能体的持续自我优化提供了新范式,开发者可以直接使用或修改。AI模型自改进智能体开源/仓库LoRA 权重更新1 个信源在谈事件专题推荐理由:SIA 解决了智能体无法自主改进代码和模型权重的问题,做 AI 智能体或自动化系统的开发者可以直接用这个开源框架来提升任务性能,值得一试。原文稍后读已读值得跟进有用关注 自改进智能体