全部动态
AI 相关资讯全量信息流 · 5478 条
9月18日
RetireOPD:一种用于强化学习智能体的自退火策略蒸馏方法
朋友,这是篇挺有意思的论文,讲的是怎么用一种叫RetireOPD的新方法来训练AI智能体,效果比直接用强化学习好不少,在几个任务上都有明显提升。
研究不同分布偏移对神经PDE代理模型预训练增益的影响
这个研究很具体,不是泛泛而谈,而是用真实数据(254,909个样本)和具体模型(RANS解)测试了预训练在神经PDE代理模型中的价值,对做相关研究的人应该有用。
Paint-Anything:图像生成与编辑中统一任意颜色控制
朋友,DeepSeek 新出的这个 Paint-Anything 工具很厉害,能让你在生成和编辑图片时指定任意十六进制颜色,比之前的方法效果提升很大。
论文提出新方法评估机器学习模型解释方法
这篇论文提出了一个很棒的新思路,通过将解释转化为预测器来评估解释质量,而不是用那些难以比较的指标。作者测试了多种解释方法,结果很有意思,比如在特征相关时SHAP表现更好。
联邦学习结合分片数据并行加速大模型训练
这是篇挺有意思的技术论文,作者把联邦学习的思想用在了大模型训练上,在 512 块 A100 上跑 Llama3.1 8B 时,数据吞吐量提升了 8.04 倍,挺厉害的。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档