#自我改进
共 36 条 · 7 天 0 条 · 30 天 3 条
信息流里打上「自我改进」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月1日
9月29日
9月19日
Sentient 发布 EvoSkill v2,让 AI 代理自我改进无需重新训练
Sentient 的 EvoSkill v2 很酷,它让 AI 代理能自我改进,不用重新训练,直接通过文件学习经验,比如在电子表格修复任务上效果很好。
8月27日
8月24日
8月9日
8月6日
8月5日
8月4日
7月17日
7月15日
7月14日
7月9日
7月7日
7月4日
NVIDIA AI 推出 ASPIRE 机器人框架,零样本成功率 31% 提升 77 点
NVIDIA 搞了个新框架 ASPIRE,自己写程序自己修,LIBERO-Pro 长任务零样本就 31%,还能再提 77 点,做机器人的可以看看。
7月2日
6月29日
6月26日
论文11:39
BINEVAL:将LLM评估分解为二元问题,提升可解释性与自我改进BINEVAL把LLM评估拆成一堆“是/否”问题,结果好理解、易调试,在事实一致性上比UniEval还准,还能自己优化提示词。
6月24日
6月19日
6月14日
6月13日
6月12日
SIA:AI 通过重写设置和更新模型实现自我改进
这项研究解决了 AI 自我改进依赖人工调参的瓶颈,做自动化 Agent 或模型微调的团队值得关注——SIA 的 LoRA 更新思路能低成本让模型学会任务模式,比只改提示更有效。
6月10日
6月8日
6月5日
Anthropic 发布完整博文:Recursive AI 研究新进展
做 AI 智能体或自主推理研究的开发者值得关注——递归自我改进是解决长任务执行瓶颈的关键方向,Anthropic 的这篇博文提供了具体技术细节和实验数据,建议直接阅读原文。
5月30日
5月29日
GRASP:带回归感知门控的技能提案器,让LLM智能体自我改进不倒退
做LLM智能体自我改进的团队终于有了一个不担心「修好一个、搞坏一个」的方案——GRASP用硬回归预算和门控机制确保每次改进都是净收益,临床场景提升显著,建议做智能体可靠性的开发者点开看看。
5月28日
OpenAI 助力税务代理自我改进:处理 7k+ 报税单
税务自动化团队和会计事务所可以看看——OpenAI 代理不仅处理了 7k+ 报税单,还能在使用中自我改进,做财税自动化的开发者值得关注这个案例。
5月21日
产品08:00
Self-improving AI 自动化微调:用 Fireworks Agent 让模型自己改进Omar 把 AI 自我改进从概念变成了可实操的流程——用 Fireworks Agent 自动微调模型,做知识管理或研究自动化的团队可以直接复现,省去手动调参的麻烦。