AITP
精选全部 AI 动态AI 日报Agent 接入关于更新日志信源提报反馈
登录 / 注册
AITOP
全部 AI 动态
AI 相关资讯全量信息流
全部博客资讯推文论文
全部模型产品行业论文技巧
标签:求解器×
6月16日
20:46
AITOP6月16日 20:46
600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI
6月12日
12:57
AITOP6月12日 12:57
Claude代码里藏了个20260612,18个月后的AI记忆革命已经开始倒计时
6月11日
15:28
AITOP6月11日 15:28
1107 vs 303:谷歌悄悄开源了一个“拆打字机”的模型,把大模型速度翻了4倍
15:23
AITOP6月11日 15:23
DiffusionGemma颠覆文本生成?自回归模型的“统治”要结束了
15:07
AITOP6月11日 15:07
每秒1107个token,Google开源的扩散模型为什么能改变本地推理格局?
6月5日
11:38
11:38rohanpaul_ai@rohanpaul_ai
精选72°
一篇新论文挑战了“把最强模型放在进化器位置”的常见做法,指出自我进化智能体的关键在于更好的求解器,而非更大的更新编写模型。研究将“编写有用更新”和“在任务执行中受益于更新”这两个通常混为一谈的任务分开。实验发现,较小的Qwen3.5-9B模型作为进化器,其更新效果与Claude Opus 4.6相当;而昂贵模型更适合作为实际求解任务的智能体。中等规模模型是甜点:既能有效调用和遵循新程序,又不会因自身能力过强而让更新失去提升空间。
论文自我进化智能体LLM智能体模型选择求解器进化器

推荐理由:这篇论文戳破了“越大越好”的直觉,做智能体自我进化的团队会发现,把预算花在求解器上比花在进化器上更划算,值得重新审视你的架构设计。
原文
5月13日
19:12
19:12arXiv cs.AI@Haoyu Wang, Yuliang Song, Tao Li, Zhiwei Deng, Yaqing Wang, Deepak Ramachandran, Eldan Cohen, Dan Roth
精选
该研究提出CP-SynC-XL基准(100个组合问题,4577个实例),评估三种求解器构建范式:原生Python算法搜索、Python+OR-Tools约束建模、MiniZinc+OR-Tools声明式建模。结果显示,Python+OR-Tools正确率最高,而原生Python易产生格式正确但验证失败的方案。提示模型进行搜索优化仅带来1.03-1.12倍的中位加速,但许多实例反而变慢,且正确率在长尾问题上显著下降。代码审计发现,优化提示会导致模型用局部近似替代完整搜索、注入未验证的边界或添加冗余声明式机制,陷入“启发式陷阱”。研究建议:LLM应主要用于形式化变量、约束和目标,而搜索优化需单独验证。
论文LLM组合优化求解器约束建模启发式陷阱

推荐理由:做组合优化或约束求解的开发者,这篇论文用实验数据告诉你为什么别让LLM碰搜索优化——它可能让你的求解器变慢还出错。建议读读,避免踩坑。
原文
精选全部日报登录