AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

OpenAI Moderation API

共 1 条相关 AI 资讯
9月1日
09:10
09:10官方账号arXiv cs.AI@Minkyu Kim, Juhwan Choi, YoungBin Kim
精选73°
研究评估了23,080个跨五种英语方言的提示对,发现文本到图像安全护栏存在方言惩罚现象。NSFW-T过滤器过度标记良性方言提示,LatentGuard过度标记有毒提示,偏差差距高达+28.29个百分点。OpenAI内容审核API则未能检测到这些提示。像素级生成器基本不受方言影响,偏见主要出现在文本处理环节。
论文文本生成图像方言偏见安全护栏

推荐理由:论文揭示了AI图像生成系统对非标准方言用户的系统性歧视,可通过重新训练减轻。
原文
精选全部日报登录