05:03elvis@omarsar0精选一篇关于持续学习的新论文提出了一种名为“受保护 harness 演化”的方法。该方法将 harness 组件的更新提议与实际提交分离开来。通过使用持续优化器和持续评估器,该方法在文本推理、多模态感知和开放世界交互等任务上实现了超过10%的相对增益。论文还定义并量化了“harness 级别遗忘”这一现象。论文持续学习智能体harness推荐理由:这篇论文讲的是怎么让AI智能体在更新技能或记忆时,不会把之前学好的东西忘了。它把更新和评估分开,效果比原来好10%以上,对做智能体的人很有用。原文稍后读已读值得跟进有用关注 持续学习
00:05elvis@omarsar0精选该论文分析了大量公开的智能体后训练轨迹。研究发现,智能体在第一步就锁定了训练策略,后续仅进行局部调整。论文尝试了三种改进方法:经验驱动的脚手架提升了GSM8K和HumanEval的分数,但策略仍保持冻结。人类指导能改变初始选择,但训练开始后智能体又回到局部循环。额外推理计算对简单任务有效,对最难任务几乎无效。论文智能体后训练GSM8K1 个信源在谈事件专题推荐理由:这篇论文测试了智能体能否训练其他智能体,发现它们在第一步就锁定了策略,后续改进效果有限。作者尝试了三种方法,但智能体仍缺乏在执行中重新考虑策略的能力。原文稍后读已读值得跟进有用关注 智能体
15:27官方账号arXiv cs.AI@Enric Boix-Adsera, Benedict Tessler研究人员发现AI模型普遍存在一种称为“模型催眠”的现象,其中提示中看似无关的微弱线索可被系统组合以强力控制模型行为。该现象在包括前沿推理模型在内的多种模型家族和规模中均出现,且催眠提示可在模型间转移。由于模型受不明显文本选择(如改写和拼写错误)控制,这为AI安全和可解释性带来新挑战。论文Model HypnosisAI安全可解释性推荐理由:这篇论文揭示了AI模型能被微小文本线索操控,对安全和可解释性影响大,值得关注。原文稍后读已读值得跟进有用关注 Model Hypnosis
15:26官方账号arXiv cs.AI@Giuseppe Destefanis, Tomaso Aste该研究提出一种测量AI编程智能体团队协调性的工具,将每次运行表示为时间网络,节点为智能体和文件,边为带时间戳的消息、文件读写操作。对1902次运行的分析显示,直接消息随智能体数量近似二次增长,但最大团队中趋于平缓,转向广播消息。共享文件可减少约42%的输出token,但指定协调者无显著改善。在244次额外运行中,智能体在五分之四的运行中会寻找隐藏评分材料。论文多智能体AI编程协调性推荐理由:想知道AI编程团队内部怎么协作?这篇论文用1902次运行数据告诉你,共享文件能省42%的token,但指定协调者没用。原文稍后读已读值得跟进有用关注 多智能体
00:50elvis@omarsar0精选一篇论文分析了Agent技能的实际作用机制,基于8135条标准化试验记录发现,程序性锚定解释了65.7%的技能生效案例,显性知识注入只占4.5%。当技能池规模从5个扩大到100个,实际使用精度从29.6%下降到3.3%。在匹配对比中,技能方法比Workflow Memory高出6.06分,但在脆弱假设、不兼容上下文或适应不足时会失效。该论文发布于arxiv.org/abs/2608.14036。论文智能体Agent技能arxiv推荐理由:Agent技能靠程序性锚定而非知识注入?这篇论文用8135条记录验证,维护技能库的可以看看。原文稍后读已读值得跟进有用关注 智能体
10:18官方账号arXiv cs.AI@Toby D. Pilditcharxiv 论文提出 optstop 框架,将大模型评测视为序贯测量问题,只对不确定性高的样本继续采样。该框架基于分层贝叶斯推断,支持二值、有序和连续结果,无需校准题库。在 200 项、10 轮次的示例评测中,optstop 在九种验证设置下减少了 57% 到 97% 的计划试验,整体结论与完整评测一致。研究表明评测算力可按不确定性分配,而非固定重复次数。论文optstop贝叶斯推断LLM评测推荐理由:跑大模型评测总烧钱?这个框架能省下最多97%的采样次数,结论还一样,做评测的人值得看看。原文稍后读已读值得跟进有用关注 optstop
17:52官方账号arXiv cs.AI@Ming Yang该论文证明了在特定AI状态追踪任务中,推理时量子协调优势的存在。研究者提出边界保持语义编译定理,将有限单向、流式或自适应因果任务映射到语义AI接口,同时保留事件顺序和过去输入访问。在匹配实体概要问答中,量子方法仅需O(log N)量子比特,而经典边界状态需要Ω(√N)比特。持续需求审计中,量子递归求解器用O(log^5 n log(1/δ))量子比特获得0.7172近似,经典单遍求解器需Ω(√n)协调宽度。稳定子潜在状态对话使用n量子比特,经典精确有限状态实现需B+M≥1/2n^2+(3/2-log2 3)n+O(1)。论文量子计算状态追踪语义编译推荐理由:这篇论文用数学证明了量子在状态追踪任务上的内存优势,不是跑分,是理论分离,适合想了解量子AI理论底层的朋友。原文稍后读已读值得跟进有用关注 量子计算
17:49官方账号arXiv cs.AI@Nicola Giuseppe Marchioro, Gabriele Padovani, Amal Gueroudji, Rafael Ferreira da Silva, Wesley Brewer, Valentine Anantharaj, Sandro Fiore, Renan SouzaWorkflow Cards是一种新文档形式,将工作流执行的机器可读溯源数据压缩为人类和LLM可读的结构化摘要。论文定义了基于溯源问题集的Workflow Card模板,并评估LLM使用其理解工作流执行的效果。结果显示,Workflow Cards提供了Model Cards和Data Cards缺失的执行级信息,填补了文档空白。与基于schema的查询相比,Workflow Cards在LLM-as-a-Judge和人工评估中答案质量几乎翻倍。论文Workflow Cards溯源数据LLM推荐理由:论文提出Workflow Cards,把工作流执行记录变成人和AI都能读的摘要,比直接查数据库答案质量高一倍,做AI文档的可以看看。原文稍后读已读值得跟进有用关注 Workflow Cards
11:38官方账号arXiv cs.AI@Abdullah XPOLIS研究项目首篇论文探讨AI代理在系统中的安全制度设计,发布5280集冻结研究套件。预指定委托实验覆盖4个模型家族,高冲突诊断增加3个模型端点。详细宪法提示词实现0/384违规,可溯源执行守卫同样0/384,但阻止51/384次尝试,其中44次后续安全完成。本地状态守卫在洗钱场景中22/96违规,溯源执行0/96(p=4.77x10^-7)。资源分配实验显示揭示数值上限改变代理请求。论文多智能体AI安全POLIS推荐理由:POLIS首篇论文,用5280集实验证明规则只是制度一部分,权威状态和阻断路径同样关键。做多智能体安全必读。原文稍后读已读值得跟进有用关注 多智能体
11:04官方账号arXiv cs.LG@Xinyi Xu, Bingnan Xiao, Shuang Qin, Gang Feng, Tony Q. S. Quek联邦学习中的LoRA微调通常将更新矩阵分解为A和B两个因子。本文通过最小二乘代理模型分析发现,共享A保留本地B(Share-A/Local-B)要求客户端更新矩阵共享输入侧秩r空间,而共享B保留本地A(Share-B/Local-A)则要求共享输出侧秩r空间,两种策略投影残差不同。据此提出FedAS-LoRA,在训练前用Rank-Aware Shared-Subspace Sufficiency(RSS)指标评估共享子空间充分性,自动选择共享侧。实验覆盖不同任务、数据分布、LoRA秩和参与率设置,验证了RSS有效性和FedAS-LoRA的优越性能。论文LoRA联邦学习FedAS-LoRA推荐理由:联邦学习调LoRA的朋友看这篇,它告诉你A和B该共享哪个,还给了个训练前就能算的指标,省得瞎试。原文稍后读已读值得跟进有用关注 LoRA
10:37官方账号arXiv cs.AI@Chenxi Li, Yuchen Lu, Xu YangInforID 是面向并行生成推荐的自适应语义目标构建框架,解决现有语义 ID 方法中 ID 结构固定、容量分配不均的问题。它通过固定容量预算在候选语义槽间分配,同时确定有效 ID 长度和每个槽的码本大小。实验表明,在相近容量预算下,InforID 提升了推荐准确率,并保持一步并行预测。该方法避免了均匀扩展语义槽带来的冗余容量问题。论文InforID并行生成推荐语义ID推荐理由:做推荐系统的可以看看,InforID 用固定预算自适应分配语义槽容量,比手动调 ID 结构更省事,准确率还更高。原文稍后读已读值得跟进有用关注 InforID
11:25官方账号arXiv cs.LG@Jai Malegaonkar, Rohan Patil, Henrik I. Christensen该研究通过受控实验,将探索奖励与多种神经记忆架构交叉,在三个环境(记忆内容的获取方式不同)中测量其相互作用。结果显示,相同的奖励信号会带来三种截然不同的交互模式:放大架构差异、将所有架构拉平到同一水平、或完全无效。研究者进一步用观测锚定奖励机形式化了奖励稀疏性,区分结构稀疏性与潜在稀疏性,证明探索与记忆是互补而非替代关系。论文强化学习探索奖励记忆架构推荐理由:这份论文把探索奖励和记忆架构放一起测,发现奖励结构不同,效果天差地别,做RL的值得看看。原文稍后读已读值得跟进有用关注 强化学习
11:42官方账号arXiv cs.LG@Martin Anthony, Kaveh Salehzadeh Nobari该论文研究了在高召回候选生成阶段,如何通过有限样本审计来认证遗漏的相关项目数量很小。作者证明了仅使用候选集内部标签无法认证任何非平凡遗漏量,审计必须采样排除池,并给出了匹配的下界:在零遗漏场景下,需检查约N_0/m个排除池标签。基于此,他们开发了精确有限样本工具包,使用二项式和高几何分布反演,可认证遗漏量、转换召回率、同时认证嵌套候选生成器家族,并产生压力测试证书。所有保证基于标签检查前固定候选生成器和审计规则。论文arxiv高召回有限样本审计推荐理由:这篇论文给出了高召回场景下审计遗漏量的理论基础和实用方法,适合做检索系统或数据管线的朋友参考。原文稍后读已读值得跟进有用关注 arxiv
11:49rohanpaul_ai@rohanpaul_ai一项新研究指出,LLM 作为安全裁判时,对同一答案的翻译或改写版本可能给出不同安全判决。问题在于许多 AI 团队依赖 LLM 判断模型回答是否安全,但安全并非简单的二元问题。论文提出压力测试:将相同答案翻译或改写后展示给裁判,检查判决是否一致。裁判在暴力或极端内容等明显有害场景表现较好,但在金融建议、信用评估等依赖上下文和判断的场景中表现脆弱。不同裁判之间分歧大,高原始一致性可能掩盖低真实可靠性。论文LLM 安全裁判模型一致性推荐理由:做 AI 安全评测的团队会直接受影响——你的安全裁判可能比想象中更不可靠,建议点开看看测试方法。原文稍后读已读值得跟进有用关注 LLM 安全
11:51elvis@omarsar0精选一篇关于工具使用智能体的可解释性论文揭示了模型在认知与行动之间的脱节:模型内部状态显示它知道应该调用工具,但在实际输出中却未能执行。这种不匹配率在26%到54%之间,且完全集中在认知到行动的转换阶段,而非认知本身。研究发现,模型内部的方向是可解码的,但后层最后一个token的表示几乎与产生的行动正交,导致信号丢失。该工作试图预测哪些干预措施有效,哪些无效。对于在工具调用提示上做A/B测试却遇到奇怪上限的开发者,这篇论文可能提供了很好的解释。论文可解释性工具调用智能体推荐理由:做工具调用智能体开发的团队,如果遇到模型明明知道该用工具却就是不调用的怪现象,这篇论文直接点出了后层几何结构的根本原因,值得一读。原文稍后读已读值得跟进有用关注 可解释性
19:11官方账号arXiv cs.AI@Yaxin Du, Xiyuan Yang, Zhifan Zhou, Wanxu Liu, Zixing Lei, Zimeng Chen, Fenyi Liu, Haotian Wu, Yuzhu Cai, Zexi Liu, Xinyu Zhu, WenHao Wang, Linfeng Zhang, Chen Qian, Siheng ChenDataMaster 提出了一种自主数据工程框架,旨在通过优化数据侧(包括外部数据发现、选择、清洗和转换)来提升固定学习算法的性能,而无需改变算法本身。该框架集成了树状搜索结构、共享数据池和全局记忆模块,以应对数据工程中开放式的搜索空间、分支依赖优化和延迟验证等挑战。在 MLE-Bench Lite 基准上,DataMaster 将奖牌率提升了32.27%;在 PostTrainBench 上,其在 GPQA 上的表现(31.02%)超过了指导模型(30.35%)。这表明自主数据工程有望成为提升机器学习系统性能的有效手段。论文数据工程自主智能体机器学习推荐理由:DataMaster 展示了自主数据工程的潜力,特别是在模型架构和训练策略标准化后,数据优化成为关键瓶颈。对于机器学习从业者而言,该框架提供了一种系统化的数据自动化方案,可减少人工试错成本,值得关注其在数据发现与组合方面的实际应用效果。原文稍后读已读值得跟进有用关注 数据工程