#arXiv
这篇 arXiv 论文证明了一个反直觉结论:想让模型“只给模型就能删数据”,可能得让它记住几乎全部训练集,对做遗忘的研究者很有参考价值。
有人把 OpenAI 那篇矩阵乘法论文的方法推到矩形情形,证明 α≥1/2,最短路径算法直接降到 O(n^2.5),做理论算法的可以看看证明思路。
arXiv 上的新论文,教长期智能体把过往推理经验压成一个轻量策略,实验里把 DeepSeek 的推理 F1 从 0.789 拉到 0.868,做智能体记忆的可以看看。
推荐给做在线决策或推荐排序的读者:这篇论文处理了“连续动作组合必须合规”这种常见但少有人形式化的问题,给出了可用的 OFUL 算法和遗憾界证明。
这篇 arXiv 论文搞了个隐空间版 Lagrangian 神经网络,训练不用 ODE 求解器,对没见过的外力也能泛化,做物理建模的可以看看。
做图神经网络的可以看看:一个表示同时搞定校准、OOD 检测和分布偏移,14 个基准 Brier score 最低,不用再各训练一个模型。
一个 arXiv 预印本,用 DTR 官方模拟器实测发现显存预算只差 0.10%,训练开销能差 7.3 倍,还复现了奇怪的可逆 OOM 区间,做省显存训练的可以看看细节。
机电调试场景里怎么防大模型编造计划?这篇论文的做法挺有意思:小模型只管提候选,发布权交给外部验证层,21 个伪造计划全被拦下,但也暴露了防不住错误用户答案的短板。
一篇很脑洞的论文:权重不存了,用 24 字节种子加复二次映射现场算出来,Two-Moons 上拿到 77.67% 准确率,思路挺新鲜。
这篇论文给科学问题生成系统立了个可证伪的考试:用未来文献打分。证据结构优先的生成器比纯 LLM 提示更靠谱,还发现 LLM 评委互相打分虚高,值得做科研工具的人看看。