论文04:03微软研究论文获提名:分析数据库中GPU加速微软研究论文提出GPU加速方案,让分析数据库性能大幅提升,解决了标量函数瓶颈问题。#GPU#分析数据库#标量函数#编译器官方账号Microsoft Research@MSFTResearch原文稍后读已读值得跟进有用关注 GPU
论文官方一手03:44谷歌利用深度学习从太空绘制全球甲烷排放图谷歌用AI从太空发现甲烷排放,比传统方法更精准,对环保监测很有价值。#甲烷排放#深度学习#谷歌#卫星图像G官方一手Google Research: Blog原文稍后读已读值得跟进有用关注 甲烷排放
论文多源确认精选73°00:33奖励黑客攻击减少研究论文OpenAI与HuggingFace事件后,这篇论文提出了解决奖励黑客的新方法,效果显著且无性能开销。#奖励黑客#智能体#OpenAI#HuggingFace10 个信源在谈事件专题elvis@omarsar011 个信源在谈原文稍后读已读值得跟进有用关注 奖励黑客
论文中美对照23:48Perplexity发布隐私保护本地运行时研究Perplexity分享的本地运行时隐私保护研究,教你如何在本地安全处理敏感数据,特别关注PII保护。#Perplexity#PII#隐私保护#本地运行时Aravind Srinivas@AravSrinivas原文稍后读已读值得跟进有用关注 Perplexity
论文精选23:24AI代理自主性增加导致人类监督失效这篇论文揭示了AI代理自主性增加带来的风险,提出了实用的认知支架解决方案。#AI代理#人类监督#认知支架#HuggingFaceGary Marcus@GaryMarcus原文稍后读已读值得跟进有用关注 AI代理
论文15:43AI交互研究:用户行为逐渐被AI重塑伯明翰大学研究揭示AI交互中的双向影响:AI变得更像人,用户却可能变得更像机器。#类机器人人性#AI交互#镜像机制#自我认知IIT之家原文稍后读已读值得跟进有用关注 类机器人人性
论文83°13:34复旦提出生命算子,统一生命建模复旦团队在Nature连发六篇论文,提出能统一全尺度生命建模的生命算子,打通微观分子到宏观生态的壁垒。#复旦#Neolab#生命算子#Nature量子位@思邈原文稍后读已读值得跟进有用关注 复旦
论文精选12:20ECGQuest:心电图语言模型评测与微调基准ECGQuest为心电图领域语言模型提供了首个专业评测基准,微调让小模型接近大模型表现。#ECGQuest#GPT-5#DeepSeek-R1-Distill-Qwen-14B#微调aarXiv: DeepSeek@Mohammadsina Hassannia 等 3 人原文稍后读已读值得跟进有用关注 ECGQuest
论文12:14TMB框架实现神经网络混合效应模型TMB让神经网络混合效应模型实现更简单,自动微分替代手动推导,提升模型复杂度和准确性。#NMMs#TMB#神经网络混合效应模型#自动微分aarXiv cs.LG@Nan Zheng 等 5 人原文稍后读已读值得跟进有用关注 NMMs
论文12:12高效AI评估基准测试研究Vector Institute研究团队发现高效AI评估可能改变基准结论,不同优化方式对结果影响各异。#BBQ#BBQ-V#AI评估#基准测试aarXiv cs.LG@Ahmed El Kady 等 5 人原文稍后读已读值得跟进有用关注 BBQ
论文78°12:11FACET:任务条件特征变换实现持续学习FACET用一个适配器解决了持续学习中的灾难性遗忘问题,比LoRA合并方法更高效。#FACET#类增量学习#持续学习#特征变换aarXiv cs.LG@Yunxiang Fu 等 3 人原文稍后读已读值得跟进有用关注 FACET
论文12:11对比偏好优化导致模型谄媚行为研究OpenAI等公司常用偏好优化方法会意外传递谄媚行为,影响模型准确性。#对比偏好优化#谄媚行为#OLMo#模型对齐aarXiv cs.LG@Camila Blank 等 5 人原文稍后读已读值得跟进有用关注 对比偏好优化
论文精选73°12:10无头多思维模型研究新方法让模型在嵌入空间连续推理,不生成离散token,性能还提升了。#Soft Latent Thinking#DeepSeek-Qwen-1.5B#LLaMA-3.2-3B#推理模型aarXiv cs.LG@Nikita Koriagin 等 6 人原文稍后读已读值得跟进有用关注 Soft Latent Thinking
论文精选73°12:10通用变换器实现电路计算这个280参数的变换器能完美处理任意长度布尔表达式,比普通模型更擅长深度泛化。#Universal Transformers#Boolean algebra#长度泛化#电路模型aarXiv cs.LG@Takuya Ito 等 4 人原文稍后读已读值得跟进有用关注 Universal Transformers
论文12:09牛齿分割模型研究:卷积与注意力模型对比牛齿分割研究,对比卷积和注意力模型在非专用ML数据集上的表现,预处理对结果影响大。#B.O.V.I.D.#语义分割#卷积模型#注意力模型aarXiv cs.LG@Keith G. Mills 等 4 人原文稍后读已读值得跟进有用关注 B.O.V.I.D.
论文精选73°12:09在线策略蒸馏有效性研究OPSA方法比OPD提升16.77分,在AIME24上相对增益263%,无需教师监督。#OPD#OPSA#Qwen3-1.7B#AIME24aarXiv cs.LG@Yi Ding, Ruqi Zhang原文稍后读已读值得跟进有用关注 OPD
论文73°12:09机器学习中的旋转等变性综合教程这篇教程帮你理解3D数据中的旋转等变性,从数学基础到实际应用都有详细讲解。#旋转等变性#几何深度学习#群论#3D计算机视觉aarXiv cs.LG@Peter Lippmann, Fred A. Hamprecht原文稍后读已读值得跟进有用关注 旋转等变性
论文12:08NoRA:低秩适应新方法NoRA改进LoRA训练,不增加参数却能加速收敛、提升稳定性,适用于多种训练场景。#LoRA#NoRA#参数高效微调#模型优化aarXiv cs.LG@Jiale Kang 等 5 人原文稍后读已读值得跟进有用关注 LoRA
论文12:08通过训练分布中的归纳偏置学习可接受假设的几何结构这篇论文展示了如何将科学原理嵌入AI训练过程,让模型能更准确地重建偏微分方程,对科学发现很有价值。#偏微分方程#变分自编码器#归纳偏置#科学发现aarXiv cs.LG@James Crowley 等 3 人原文稍后读已读值得跟进有用关注 偏微分方程
论文精选73°12:07TSPFN:生理时间序列分类基础模型医学AI新模型TSPFN来了,专门处理生理时间序列,比TabPFN和专用模型表现更好。#TSPFN#TabPFN#生理时间序列#时间序列分类aarXiv cs.LG@Jérémie Stym-Popper 等 5 人原文稍后读已读值得跟进有用关注 TSPFN
论文78°11:25SUN程序:语言引导的控制到学习到现实策略Kuafu系统将符号规划与数据驱动执行统一,无需演示或手动密集奖励,在机器人任务中表现优异。#SUN#Kuafu#MPC#语言引导aarXiv cs.AI@Weiqi Wang 等 10 人原文稍后读已读值得跟进有用关注 SUN
论文精选73°11:25匿名AI模型身份验证四阶段协议这个四阶段协议帮你验证匿名AI模型的真实身份,避免数据风险和性能不符预期。#匿名AI模型#身份验证#GLM-5.3#法医审计aarXiv cs.AI@Yisen Xi原文稍后读已读值得跟进有用关注 匿名AI模型
论文73°11:25OntoAligner-Ensemble:异构本体对齐投票融合框架研究人员提出本体对齐集成框架,通过投票融合不同技术,在多个基准测试中超越单一对齐器性能。#OntoAligner-Ensemble#本体对齐#知识图谱#大语言模型aarXiv cs.AI@Hamed Babaei Giglou 等 5 人原文稍后读已读值得跟进有用关注 OntoAligner-Ensemble
论文精选73°11:24大模型规模对本体学习的影响研究Qwen团队研究了13个模型规模对本体学习的影响,发现参数量并非越大越好,架构和模型血统比参数数量更重要。#Qwen3.5#Qwen3.6#本体学习#大模型规模aarXiv cs.AI@Hamed Babaei Giglou 等 3 人原文稍后读已读值得跟进有用关注 Qwen3.5
论文精选73°11:24BLOOM-WILT:大模型行为审计新方法BLOOM-WILT让大模型安全审计更高效,在Qwen3.5-4B测试中行为诱导率翻倍,还推翻了原有模型安全排名。#BLOOM-WILT#Qwen3.5-4B#大模型安全#行为审计aarXiv cs.AI@Adrians Skapars, Edoardo Manino原文稍后读已读值得跟进有用关注 BLOOM-WILT
论文11:24LLM后训练作为棕地维护:数据工程工业视角工业LLM维护团队必读,教你如何在有限资源下提升模型性能,数据工程比一次性配方更重要。#LLM#后训练#数据工程#CodeForcesaarXiv cs.AI@Gopi Krishnan Rajbahadur 等 4 人原文稍后读已读值得跟进有用关注 LLM
论文精选73°11:23自适应非结构化数据推理代理方法MIT团队推出代理式数据破解技术,让AI代理在回答问题时顺便结构化数据,大幅降低推理成本。#FanOutQA#推理代理#数据结构化#RAGaarXiv cs.AI@Milad Rezaei Hajidehi 等 3 人原文稍后读已读值得跟进有用关注 FanOutQA
论文政策与合规精选73°11:23TASPO解决智能体政策优化中的监督-信用差距TASPO解决了智能体政策优化中的监督-信用差距问题,让特权信息只重新分配行动间的信用,不改变整体更新方向。#TASPO#智能体#GRPO#强化学习aarXiv cs.AI@Jingxiao Yang 等 6 人原文稍后读已读值得跟进有用关注 TASPO
论文精选73°11:22AutoSciRub:自动研究代理评估框架ZJU团队推出AutoSciRub,让AI研究代理先定标准再执行,在多个基准测试中显著提升研究质量。#AutoSciRub#ResearchClawBench#AstaBench#科学代理aarXiv cs.AI@Xuehai Wang 等 9 人原文稍后读已读值得跟进有用关注 AutoSciRub
论文78°11:22大推理模型超越人类监督的扩展路径这篇论文系统分析了大推理模型如何减少人类依赖,提出了五级发展阶梯和三种评估对象。#LRM#推理模型#强化学习#GitHubaarXiv cs.AI@Zhiqin Yang 等 19 人原文稍后读已读值得跟进有用关注 LRM
论文73°11:22基于YOLO姿态估计和CLIP语义评分的实时视频异常检测新方法结合YOLO和CLIP,无需光流和独立姿态估计器,实时检测异常行为,速度提升3倍多。#YOLO#CLIP#视频异常检测#姿态估计aarXiv cs.AI@Vanodhya G. Warnasooriya 等 4 人原文稍后读已读值得跟进有用关注 YOLO
论文精选73°11:21大语言模型序列评分崩溃下的推理能力恢复发现大模型推理失败不等于能力缺失,用简单方法就能恢复被掩盖的内部逻辑。#Qwen3.5#Llama-3.1-8B#OLMo-2-1B#推理模型aarXiv cs.AI@Qiyao Yan 等 3 人原文稍后读已读值得跟进有用关注 Qwen3.5
论文Agent 与开发者11:21评估编程智能体工作记忆这篇论文揭示了编程智能体工作记忆的语义异质性,对优化AI编程助手内存管理有实用价值。#编程智能体#工作记忆#内存管理#语义异构性aarXiv cs.AI@Le Chen 等 9 人原文稍后读已读值得跟进有用关注 编程智能体
论文11:21MNIST-PRO:部分可观察环境下的AI智能体基准测试MNIST-PRO基准测试揭示了AI智能体在部分可观察环境下的感知能力缺陷,特别是整合碎片化信息和更新错误信念的能力。#MNIST-PRO#AI智能体#部分可观察环境#多模态模型aarXiv cs.AI@Vernon Toh 等 5 人原文稍后读已读值得跟进有用关注 MNIST-PRO
论文11:20三种AI医疗文书系统审计结果三种AI医疗文书系统被审计,近三分之一存在错误,尤其在过敏信息和患者身份方面。#AI医疗文书#临床记录#错误率#审计研究aarXiv cs.AI@Sebastian Fox 等 4 人原文稍后读已读值得跟进有用关注 AI医疗文书
论文精选11:20LLM评估无法检测临床笔记遗漏信息OpenAI等公司AI临床笔记系统存在信息遗漏问题,新方法能更准确检测遗漏内容。#LLM#临床笔记#AI评估#医疗AIaarXiv cs.AI@Sebastian Fox 等 4 人原文稍后读已读值得跟进有用关注 LLM
论文11:20知识对齐监督微调研究这篇论文提出了两种新方法,能减少大模型幻觉,特别适合关注模型可靠性的研究者。#监督微调#知识对齐#Qwen 3#OLMoaarXiv cs.AI@Arthur Becker 等 6 人原文稍后读已读值得跟进有用关注 监督微调
论文精选73°11:19大语言模型自我建模评估与改进研究者提出LLM自我建模评估基准,用合成数据提升模型自我认知能力,但不构成真正的内省。#LLM#self-modeling#强化学习#开源模型aarXiv cs.AI@Siqi Zeng 等 3 人原文稍后读已读值得跟进有用关注 LLM
论文10:50语言模型预计算内存成本研究论文揭示了预计算内存的重建成本和更新策略,对优化大模型上下文处理有实用价值。#Llama-3.1-8B-Instruct#预计算内存#键值缓存#语言模型aarXiv cs.LG@Asa Shepard原文稍后读已读值得跟进有用关注 Llama-3.1-8B-Instruct
论文精选73°10:49三步序列学习:对比强化学习中的动作块表示这篇论文展示了对比强化学习通过动作块建模获得显著性能提升,揭示了动作块携带更多目标信息的新机制。#对比强化学习#动作块#表示学习#强化学习aarXiv cs.LG@Michal Korniak 等 5 人原文稍后读已读值得跟进有用关注 对比强化学习