论文精选73°19:32图神经网络好友推荐系统Facebook团队开源了大型社交图上的GNN推荐系统,用多哈希和时间采样技术,在保持效果的同时大幅降低计算成本。#图神经网络#好友推荐#多哈希嵌入#时间采样aarXiv cs.LG@Maksim Utushkin 等 3 人原文稍后读已读值得跟进有用关注 图神经网络
论文精选73°19:28生成式广告新机制LAMA发布LAMA把广告直接嵌入AI生成过程,实验显示它既赚更多钱又不影响用户体验。#LAMA#生成式广告#token-level#商业搜索aarXiv cs.LG@Hanbing Liu 等 5 人原文稍后读已读值得跟进有用关注 LAMA
论文精选73°19:25进化策略提升LLM推理覆盖范围这篇论文对比了ES和GRPO两种训练方法,发现ES能带来更广泛的推理覆盖,还提出了结合两者优势的GRPO-ES顺序训练策略。#LLM#进化策略#GRPO#推理模型aarXiv cs.LG@Yunpeng Ba 等 10 人原文稍后读已读值得跟进有用关注 LLM
论文精选73°19:25块状生成中的信息下限与模型差距研究这篇论文揭示了块状生成器中信息下限与模型差距的关系,解释了为什么当前生成器仍有很大改进空间。#块状生成#信息下限#模型差距#Qwen3-4BaarXiv cs.LG@Xinwei Qiang 等 5 人原文稍后读已读值得跟进有用关注 块状生成
论文精选19:15分位数时序差分学习有限样本分析强化学习新论文,分析QTD算法的有限样本性能,揭示了波动与样本复杂度的关键区别。#QTD#分布强化学习#时序差分#有限样本分析aarXiv cs.LG@Zijie Cheng 等 4 人原文稍后读已读值得跟进有用关注 QTD
论文精选73°19:14QuantumBoostNet混合架构提升心脏超声视图识别QuantumBoostNet用10量子比特电路提升心脏超声识别准确率,比现有模型表现更好。#QuantumBoostNet#量子计算#心脏超声#医学影像aarXiv cs.LG@Mihai Udrescu-Milosav 等 4 人原文稍后读已读值得跟进有用关注 QuantumBoostNet
论文19:12从声学分布恢复音乐家专家关联网络这篇论文展示了如何利用专家评论中的音乐家关联信息,在缺乏用户数据时实现音乐推荐,并验证了其与声学内容的相关性。#音乐推荐#声学分析#Wasserstein距离#EssentiaaarXiv cs.LG@Elena Badillo-Goicoechea, Fengfeng He原文稍后读已读值得跟进有用关注 音乐推荐
论文精选73°19:10MM-Spectrum:多模态多光谱分子结构解析研究人员提出 MM-Spectrum 框架,解决了多光谱信号异质性问题,在分子结构解析任务中表现优异。#MM-Spectrum#MoE#多模态#分子结构解析aarXiv cs.LG@Hai-tao Yu 等 7 人原文稍后读已读值得跟进有用关注 MM-Spectrum
论文精选73°19:09LEON网络:世界行动模型的显式潜在演化斯坦福团队推出LEON网络,用算子结构改进机器人预测模型,比传统Transformer更关注时间演化。#LEON#WAM#世界行动模型#机器人预测aarXiv cs.LG@Xiaoxiao Lu 等 4 人原文稍后读已读值得跟进有用关注 LEON
论文精选73°19:08算子学习中狄利克雷边界条件强制方法这篇论文解决了算子学习中边界条件处理的难题,适用于任意网格数据和一般几何形状。#算子学习#狄利克雷边界条件#神经网络#PDEaarXiv cs.LG@Andrew M. Stuart, Margaret Trautner原文稍后读已读值得跟进有用关注 算子学习
论文精选73°19:07Circuit Condensation:行为因果电路压缩方法OpenAI新研究提出Circuit Condensation,能将模型行为压缩316倍,让AI内部机制更透明可解释。#Circuit Condensation#mechanistic interpretability#因果电路#模型压缩aarXiv cs.LG@Sai Adith Senthil Kumar原文稍后读已读值得跟进有用关注 Circuit Condensation
论文19:06Transformer注意力头在表格数据学习中的重要性评分这篇论文提出了Transformer注意力头在表格数据中的重要性评分方法,能帮你优化模型结构并提高效率。#Transformer#注意力头#表格数据#重要性评分aarXiv cs.LG@Ahmad Jad Allah 等 4 人原文稍后读已读值得跟进有用关注 Transformer
论文19:04面向可扩展智能体运行时的契约中心架构这篇论文提出了智能体运行时的契约架构,解决了企业AI部署中的协调问题,提出了可测试的假设和实验方法。#智能体#运行时架构#契约设计#企业AIaarXiv cs.AI@Yaxiao Liu 等 6 人原文稍后读已读值得跟进有用关注 智能体
论文精选73°19:02MetaNet:任务条件专家动态分配MetaNet让MoE模型根据任务难度动态分配专家,大幅减少计算量同时保持准确率。#MetaNet#MoE#DeepSeek-MoE-16B-Chat#MMLU1 个信源在谈事件专题aarXiv: DeepSeek@Rongfeng Wang 等 7 人2 个信源在谈原文稍后读已读值得跟进有用关注 MetaNet
论文19:00STILL: 恢复LLM辅助C++反编译中的STL语义STILL让LLM能从剥离的C++代码中恢复STL容器语义,反编译准确率提升60%以上。#STILL#LLM#C++#反编译aarXiv: DeepSeek@Xiaohan Wang, Kevin Leach原文稍后读已读值得跟进有用关注 STILL
论文18:58LLMs4OL 2026挑战:本体学习检索增强与词汇过滤团队用Qwen2.5模型解决本体学习任务,通过词汇过滤提高准确性,但无法提取非分类关系。#LLMs4OL#Qwen2.5-14B-Instruct#本体学习#检索增强aarXiv cs.AI@Shivam Mishra 等 5 人原文稍后读已读值得跟进有用关注 LLMs4OL
论文18:54主动传感技术解析植物胁迫异质性这个机器人平台能精确测量植物叶绿素荧光,为农业检测和植物操作提供了新思路。#植物表型#叶绿素荧光#机器人平台#3D重建aarXiv cs.AI@Ayman Laaroussi 等 3 人原文稍后读已读值得跟进有用关注 植物表型
论文精选73°18:45MoE模型中三种推理优化为何失效论文揭示了MoE模型中三种推理优化为何实际效果不佳,对模型部署有重要参考价值。#Mixture-of-Experts#OLMoE-1B-7B#DeepSeek-V2-Lite#推理优化aarXiv: DeepSeek@Gokulakannan Sakthivel 等 4 人原文稍后读已读值得跟进有用关注 Mixture-of-Experts
论文精选73°18:14GRAIN框架通过不变性奖励强化学习提升图推理MIT团队推出GRAIN框架,用单智能体解决图推理中的标识符和任务表述变化问题,比多智能体方案更快更准。#GRAIN#图推理#强化学习#LLMaarXiv cs.AI@Zike Yuan 等 13 人原文稍后读已读值得跟进有用关注 GRAIN
论文精选73°18:08SWE-Prime:更少轨迹,更好性能SWE-Prime用10%数据训练就能超越全数据效果,解决了软件工程领域模型训练数据质量低的问题。#SWE-Prime#SFT#SWE-Bench#软件工程aarXiv cs.AI@Dewu Zheng 等 10 人原文稍后读已读值得跟进有用关注 SWE-Prime
论文精选73°18:07MCR-Bench:首个多轮代码审查基准测试MCR-Bench揭示了当前LLM在真实代码审查中的不足,特别是跨轮次时间对齐和长程记忆问题。#MCR-Bench#代码审查#LLM#缺陷检测aarXiv cs.AI@Dewu Zheng 等 8 人原文稍后读已读值得跟进有用关注 MCR-Bench
论文精选73°18:06RedEvoAgent:经验驱动的自动红队攻击智能体RedEvoAgent能自动进化攻击技能,比固定攻击方法更有效,还能跨不同AI系统迁移使用。#RedEvoAgent#红队攻击#LLM智能体#AI安全aarXiv cs.AI@Junjie Zhang 等 6 人原文稍后读已读值得跟进有用关注 RedEvoAgent
论文精选73°18:06HALO模型解决异构IMU人体活动识别HALO模型用更少参数实现更高准确率,解决IMU传感异构性问题,适合开放集人体活动识别。#HALO#IMU#人体活动识别#零样本学习aarXiv cs.LG@Zihan Ding 等 3 人原文稍后读已读值得跟进有用关注 HALO
论文精选73°18:04并行分布式推理语言模型性能基础这篇论文帮你搞懂RL-for-LLM的并行训练策略,让DeepSeek-R1、o3这些推理模型训练不再那么烧钱。#RL-for-LLM#PPO#GRPO#推理模型aarXiv: DeepSeek@Maciej Besta 等 10 人原文稍后读已读值得跟进有用关注 RL-for-LLM
论文多源确认精选73°18:01千图假说:代码推理中的任务条件关系物化DeepSeek团队提出千图假说,解决大型代码库推理问题,无需预构建关系图就能达到95.6%成功率。#DeepSeek-V4-Flash#SWE-bench#代码推理#关系物化4 个信源在谈事件专题aarXiv: DeepSeek@Fei Ding5 个信源在谈原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash
论文18:00无监督学习脓毒症严重程度评分研究这项研究用新方法替代了过时的脓毒症评分,能更准确预测患者预后。#脓毒症#SOFA-2#乳酸#医疗AIaarXiv cs.AI@Kevin Zhu 等 21 人原文稍后读已读值得跟进有用关注 脓毒症
论文17:59人格-执行分离:LLM智能体的审计架构模式这篇论文提出PES架构,解决LLM智能体在监管环境下的核心矛盾,人格可自由演变而执行可追溯。#LLM Agents#PES#智能体#审计架构aarXiv cs.AI@Yisen Xi原文稍后读已读值得跟进有用关注 LLM Agents
论文精选73°17:58LeVJEPA:高效可扩展的视频预训练方法LeVJEPA用简单架构实现视频预训练,大幅降低计算量,在图像和运动任务上都表现出色。#LeVJEPA#V-JEPA#视频预训练#ImageNet-1KaarXiv cs.AI@Lukas Kuhn 等 7 人原文稍后读已读值得跟进有用关注 LeVJEPA
论文17:57Stageboost:基于反事实估计的信号推荐模型eBay新模型让商品详情页更智能,高价值商品转化率提升0.58%,电商推荐系统值得参考。#eBay#XGBoost#反事实估计#推荐系统aarXiv cs.AI@Darpan Singhal 等 6 人原文稍后读已读值得跟进有用关注 eBay
论文17:55RCMN框架解析公共话语误导性这篇论文提出了RCMN框架,帮你理解公共话语中的误导性机制,比简单判断真假更深入。#RCMN#misleadingness#公共话语#生成模型aarXiv cs.AI@Peiling Yi原文稍后读已读值得跟进有用关注 RCMN
论文精选73°17:53TransMeme多智能体框架实现跨文化模因再创作TransMeme框架解决了跨文化模因再创作的三大挑战,在中文-英文双向转换任务中表现优异。#TransMeme#多智能体#模因#跨文化aarXiv cs.AI@Jingyi Zheng 等 7 人原文稍后读已读值得跟进有用关注 TransMeme
论文精选73°17:41SCG方法实现视觉编码器自适应扩展JEPA世界模型编码器不再需要预分配最大容量,SCG方法能根据任务需求逐步扩展,显著提升计算和数据效率。#JEPA#Vision Transformer#SCG#世界模型aarXiv cs.AI@Frederik Berenz原文稍后读已读值得跟进有用关注 JEPA
论文17:40AI模型安全扫描器评估研究三款AI安全扫描器实测对比,ModelAudit覆盖率最高,ModelScan分析准确率第一。#ModelScan#ModelAudit#Fickling#AI安全aarXiv cs.AI@Qianlong Lan 等 4 人原文稍后读已读值得跟进有用关注 ModelScan
论文精选73°17:39VPP:提升长上下文LLM推理效率的虚拟流水线并行VPP解决了长上下文LLM推理中流水线气泡问题,在保持短序列性能的同时显著提升长序列吞吐。#VPP#LLM推理#流水线并行#长上下文aarXiv: DeepSeek@Yan Shi 等 10 人原文稍后读已读值得跟进有用关注 VPP
论文精选73°17:38MAELLE模型通过离散流匹配预测化学反应MIT团队新发布的MAELLE模型,能预测化学反应路径和副产物,比现有方法更稳定可靠。#MAELLE#反应预测#离散流匹配#电子占据aarXiv cs.AI@Nguyen Xuan-Vu 等 4 人原文稍后读已读值得跟进有用关注 MAELLE
论文精选73°17:37临床语言模型可审计性研究:概念引导微调CAST让临床模型决策可追溯,能区分真实症状和记录模板,医疗AI透明度提升。#CAST#临床语言模型#稀疏自编码器#可审计AIaarXiv cs.AI@Jin Mu, Guanhua Chen原文稍后读已读值得跟进有用关注 CAST
论文精选73°17:22PAWBench评估视频生成模型概率对齐能力PAWBench首次系统评估视频生成模型作为世界模型的概率对齐能力,揭示了当前模型与理想状态间的差距。#PAWBench#视频生成#世界模型#概率对齐aarXiv cs.AI@Yuandong Pu 等 14 人原文稍后读已读值得跟进有用关注 PAWBench
论文精选73°17:19研究评估人类与大语言模型的心智化能力这篇论文用经济游戏测试了四大模型家族的心智化能力,发现GPT-5能灵活调整推理深度,表现超过人类。#GPT-5#DeepSeek#Gemini 2.0#心智化aarXiv: DeepSeek@Aamir Sohail 等 5 人原文稍后读已读值得跟进有用关注 GPT-5
论文17:18接触式PPG到相机rPPG属性特异性恢复研究这项研究揭示了不同生理属性在接触式PPG到相机rPPG转换中的恢复能力差异,对医疗监测设备开发有重要参考价值。#rPPG#PPG#CHROM#生理监测aarXiv cs.AI@Timothy Oladunni, Farouk Ganiyu-Adewumi原文稍后读已读值得跟进有用关注 rPPG
论文17:08大企业生成式AI使用复杂度研究大企业内部AI使用真实数据,揭示高级员工如何更聪明地使用AI,以及培训效果有限。#生成式AI#大语言模型#企业AI应用#AI使用复杂度aarXiv cs.AI@Nicholas J. Hallman 等 4 人原文稍后读已读值得跟进有用关注 生成式AI