全部动态
AI 相关资讯全量信息流 · 5478 条
8月17日
论文10:21
使用Neuron Gating和Mixed Activation的紧凑神经架构搜索这篇论文用可微优化替代离散搜索,Neuron Gating和Mixed Activation找紧凑网络,MNIST上0.26M参数就达99.63%准确率,比DARTS表现更好。
论文10:21
PACE-Bench:动态环境下基于代码演进的物理适应基准想看看AI在规则变了之后能不能自己改代码?PACE-Bench 专门测这个,目前最强的 GPT-5.5 也只解决了 Statics 子集的三分之二,离满分还远得很。
统一路径空间视角下的扩散模型强化学习设计
这篇论文把Flow-GRPO、AWM、DiffusionNFT几套方法统一到一个框架里,说清了它们差别只是方差缩减,还在SD3.5-M和Qwen-Image上跑赢了之前的方案。
8月14日
论文12:29
TEMPO:跨内存/计算受限场景的专家并行负载均衡如果你在做MoE推理,TEMPO这个调度器在内存/算力瓶颈混合时能比常规方案快15.5%;不过DeepSeek-V3那种通信瓶颈场景它不灵。
论文12:19
HumanTracker:更符合人类感知的人形运动跟踪基准想评估人形机器人运动跟踪效果?HumanTracker 提供了153小时专业动作数据和更符合人眼判断的 HumanScore,能发现脚滑、触地不准这类关键问题。
QuoteBench:匹配分数掩盖命令路径失败
这篇论文用 QuoteBench 拆穿了只看匹配分数的假象,原来 GPT-5.6-sol 的分数是负 64 和正 60 抵消出来的,部署配置一变排名就翻,评估编程智能体前该看看。
论文11:38
UniTexture:面向视觉-语言-动作模型的跨任务通用对抗纹理拿一个贴了纹理的物体就能让 OpenVLA 和 π0.5 的成功率从 90% 掉到 48%,还能跨模型生效,搞机器人安全的可以看看。
论文11:33
LittleLearner:在小学课程知识范围内训练的5B参数语言模型想搞懂模型知识边界怎么控制?这篇论文用小学课程语料训练了个5B模型,还公开了数据和模型,适合研究预训练数据影响的人看。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档