论文

arXiv 与期刊里的 AI 论文,每篇附中文摘要与推荐理由 · 5350 篇
9月11日
文本到图像系统通过修改提示词引入文化偏见

朋友间推荐:最近发现一个挺有意思的研究,他们分析了 DALL-E-3、Imagen-4 这些大模型,发现它们在生成图片前会偷偷修改你的提示词,而且这个修改过程本身就会引入文化偏见,比如把非西方语境简化成刻板印象,挺有意思的。

arXiv cs.AI@Aleksandra Urman 等 10 人原文
DeFiFlowBench 测试并改进自然语言 DeFi 工作流合成中的安全执行

这个研究团队做了个 DeFiFlowBench 基准测试,用 207 个提示测试了自然语言 DeFi 工作流合成,发现直接、受限和少样本提示在 5% 价格影响下会有 14-19 次不安全执行。他们还提出了 Koan-Safe 模型,在 75 个测试上比最佳基线好很多,能避免不安全执行。

arXiv cs.LG@Abhinav Rajeev Kumar 等 4 人原文