论文精选10:38VLM在模糊输入下系统性压制女性表征,LALS揭示内部编码与输出脱耦做AI公平性研究或模型对齐的团队,这篇论文直接戳破了VLM在模糊输入下的性别偏见黑箱——LALS方法让你能逐层看到模型内部编码与输出的脱耦,建议做模型审计的开发者点开看看具体实验设计。#视觉语言模型#性别偏见#LALS#模型对齐aarXiv cs.AI@Arnau Marin-Llobet 等 3 人原文稍后读已读值得跟进有用关注 视觉语言模型