论文
arXiv 与期刊里的 AI 论文,每篇附中文摘要与推荐理由 · 5350 篇
9月11日
研究评估英语-约鲁巴语代码切换语音的ASR和音频语言模型
这个研究很实用,它详细分析了不同AI模型在处理英语和约鲁巴语混合语音时的表现差异,特别是那些切换点错误率的数据,对做相关研究或评估模型的人很有参考价值。
文本到图像系统通过修改提示词引入文化偏见
朋友间推荐:最近发现一个挺有意思的研究,他们分析了 DALL-E-3、Imagen-4 这些大模型,发现它们在生成图片前会偷偷修改你的提示词,而且这个修改过程本身就会引入文化偏见,比如把非西方语境简化成刻板印象,挺有意思的。
多语言模型在乌尔都语生成中存在文化语言缺陷
朋友,这篇论文挺有意思的,它专门测试了GPT-5.1、Qwen-3-Max和DeepSeek-3.1这三个大模型在生成乌尔都语故事时的表现,发现它们在文化方面确实很弱。
研究LLM训练的电力弹性特性,提出Power Flexibility Index(PFI)指标
这是关于如何让AI训练更节能的研究,作者通过大量实验数据,提出了一个叫PFI的指标,能帮助在功率受限时优化训练效率,挺实用的。
DeFiFlowBench 测试并改进自然语言 DeFi 工作流合成中的安全执行
这个研究团队做了个 DeFiFlowBench 基准测试,用 207 个提示测试了自然语言 DeFi 工作流合成,发现直接、受限和少样本提示在 5% 价格影响下会有 14-19 次不安全执行。他们还提出了 Koan-Safe 模型,在 75 个测试上比最佳基线好很多,能避免不安全执行。
一种用于可信碰撞严重程度预测的无分布认证框架
这个研究挺有意思,他们开发了一个框架,能给你任何碰撞严重程度模型一个分布无关的保证,比如预测的置信区间,而且这个保证在5.2百万条数据上测试过,效果还不错。