AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

文化偏见

共 1 条相关 AI 资讯
8月4日
11:49
11:49官方账号arXiv cs.LG@Iaroslav Chelombitko, Ekaterina Chelombitko, Mika Hämäläinen
一项研究对18个开源大模型进行跨文化神话知识探测,覆盖8个架构家族。模型能准确识别宙斯、朱庇特、托尔,但在芬兰、斯拉夫、埃及或中国神话中表现明显下降。研究者使用线性探针、logit lens、激活修补等方法,发现残差流能清晰区分文化,但解码器将特定文化token坍缩为主导传统。失败发生在读出阶段而非表征阶段,且解码行为受提示语言门控。论文发布了逐实体分解框架、跨文化基准及18个模型的预测结果。
论文开源模型多模态LLM

推荐理由:这篇论文用18个模型告诉你:LLM其实知道芬兰神话,但输出时故意不说。想看AI文化偏见的根源,读这篇。
原文
精选全部日报登录