全部动态
AI 相关资讯全量信息流 · 5084 条
9月18日
Paint-Anything:图像生成与编辑中统一任意颜色控制
朋友,DeepSeek 新出的这个 Paint-Anything 工具很厉害,能让你在生成和编辑图片时指定任意十六进制颜色,比之前的方法效果提升很大。
论文提出新方法评估机器学习模型解释方法
这篇论文提出了一个很棒的新思路,通过将解释转化为预测器来评估解释质量,而不是用那些难以比较的指标。作者测试了多种解释方法,结果很有意思,比如在特征相关时SHAP表现更好。
联邦学习结合分片数据并行加速大模型训练
这是篇挺有意思的技术论文,作者把联邦学习的思想用在了大模型训练上,在 512 块 A100 上跑 Llama3.1 8B 时,数据吞吐量提升了 8.04 倍,挺厉害的。
GPT模型存在性别歧视转化问题,安全训练后表面无歧视但内容实质未改善
朋友间推荐:看这篇论文,作者发现GPT模型在安全训练后,针对女性的歧视内容被转化而非减少,比如GPT-5会把乳腺癌和男性权利扯上关系,挺有意思的。
AdaRepair-Mem:自适应经验编排用于代码库级程序修复
这是篇关于代码修复的论文,提出了AdaRepair-Mem框架,通过更智能地检索和利用历史修复经验来提升LLM的代码修复能力,解决了现有方法中记忆资源不均衡、记忆量与效果不匹配以及记忆阶段不匹配的问题。
BioPhys-Bridge 基准数据集发布,用于评估跨学科生物物理研究中的科学推理能力
朋友发了这个新基准数据集,专门用来测试模型在生物物理领域的科学推理能力,比之前的基准更复杂,能看出不同模型在这个专业领域的真实水平。
研究团队提出新算法解决最小跨度抗带宽问题
研究团队提出新算法解决最小跨度抗带宽问题,在哈维尔-博因格稀疏矩阵集合上的测试中,并行SAT方法在MSCABL上表现最佳,增量SAT方法在MSABL上表现最佳,且在无孔约束下,SAT方法与CPLEXCP相比表现竞争,显著优于CPLEXMIP和Gurobi,尤其对于MSCABL。
研究揭示视觉语言模型抗干扰能力与提示词冗长的关系
这个研究挺有意思的,它发现给AI模型问问题的时候,用更详细、更啰嗦的描述,能让模型在处理有问题的图片时更不容易出错,比如把‘有猫吗?’改成‘请仔细看并回答:有猫吗?’。
9月17日
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档