这个研究很具体,不是泛泛而谈,而是用真实数据(254,909个样本)和具体模型(RANS解)测试了预训练在神经PDE代理模型中的价值,对做相关研究的人应该有用。
论文
arXiv 与期刊里的 AI 论文,每篇附中文摘要与推荐理由 · 5350 篇
9月18日
研究不同分布偏移对神经PDE代理模型预训练增益的影响
Paint-Anything:图像生成与编辑中统一任意颜色控制
朋友,DeepSeek 新出的这个 Paint-Anything 工具很厉害,能让你在生成和编辑图片时指定任意十六进制颜色,比之前的方法效果提升很大。
论文提出新方法评估机器学习模型解释方法
这篇论文提出了一个很棒的新思路,通过将解释转化为预测器来评估解释质量,而不是用那些难以比较的指标。作者测试了多种解释方法,结果很有意思,比如在特征相关时SHAP表现更好。
联邦学习结合分片数据并行加速大模型训练
这是篇挺有意思的技术论文,作者把联邦学习的思想用在了大模型训练上,在 512 块 A100 上跑 Llama3.1 8B 时,数据吞吐量提升了 8.04 倍,挺厉害的。
GPT模型存在性别歧视转化问题,安全训练后表面无歧视但内容实质未改善
朋友间推荐:看这篇论文,作者发现GPT模型在安全训练后,针对女性的歧视内容被转化而非减少,比如GPT-5会把乳腺癌和男性权利扯上关系,挺有意思的。
AdaRepair-Mem:自适应经验编排用于代码库级程序修复
这是篇关于代码修复的论文,提出了AdaRepair-Mem框架,通过更智能地检索和利用历史修复经验来提升LLM的代码修复能力,解决了现有方法中记忆资源不均衡、记忆量与效果不匹配以及记忆阶段不匹配的问题。
BioPhys-Bridge 基准数据集发布,用于评估跨学科生物物理研究中的科学推理能力
朋友发了这个新基准数据集,专门用来测试模型在生物物理领域的科学推理能力,比之前的基准更复杂,能看出不同模型在这个专业领域的真实水平。