7月28日
12:12
12:12官方账号arXiv cs.AI@Zhenhan Gao, Marvin Muñoz Barón, Umm-e Habiba, Daniel Graziotin, Stefan Wagner
一篇针对34名程序员的用户研究发现,在AI代码审查中提供详细解释(条件A)获得最高信任评分(3.99/5),但仅提供审查反馈(条件B)反而获得最高同意率(89.22%),说明更多解释会促使开发者更频繁地质疑AI建议。无解释(条件C)的信任和同意率均最低。解释程度并未显著影响审查耗时。该研究为设计可信的AI代码审查系统提供了实证依据。
推荐理由:这篇论文告诉你:给AI代码审查加解释,反而可能让人更不听话。详细解释信任高但同意率低,这结论挺反直觉的。
7月8日
10:16
10:16官方账号arXiv cs.AI@Marcelo Arenas, Pablo Barceló, Diego Bustamante, Jose Caraball, María Alejandra Schild, Bernardo Subercaseaux
论文提出ExplAIner查询语言,可统一表达溯因、对比、特征和距离等多种解释查询。它基于FOIL语言扩展,解决了FOIL无法表达最优性解释查询且决策树评估复杂的问题。ExplAIner的查询评估属于布尔层次结构,对确定性可分解布尔电路可在多项式时间内完成。引入优化片段Opt-FOIL,可通过固定次数SAT求解器调用计算最小解释。
推荐理由:这篇论文提出了一种新查询语言ExplAIner,能统一处理各种模型解释查询,还证明计算效率高,对做形式化XAI的人很有用。