主要来源Decoder
查看原文事件专题 · 多源确认
俄语宣传骗过AI模型有多容易?新基准测试揭示
爱沙尼亚语言研究所发布了一项基准测试,用于评估AI语言模型对俄语宣传的抵抗力。测试涵盖了GPT-4o、Claude 3.5 Sonnet、Llama 3.1等8个模型,发现部分模型在30%的测试样本中会生成亲俄内容。Meta的Llama 3.1 70B表现最差,错误生成率高达42%;而OpenAI的GPT-4o错误率最低,仅为12%。该基准测试还包含一个包含1000个样本的俄语宣传语料库,用于衡量模型对政治操纵的脆弱性。
当前结论
想知道你用的AI会不会被俄语宣传带跑偏?爱沙尼亚语言研究所测了8个主流模型,GPT-4o最扛打,Llama 3.1中招率最高。看看你的AI排第几。
11 个信源53° AI 热度最后更新 2026/6/16 11:28:13
证据链
相关来源 1Jim Fan
查看原文相关来源 2OpenAI Blog
查看原文相关来源 3shao__meng
查看原文相关来源 4@koltregaskes
查看原文相关来源 5宝玉
查看原文相关来源 6marktechpost
查看原文相关来源 7AI Will
查看原文相关来源 8Aadit Sheth
查看原文相关来源 9lmarena.ai
查看原文相关来源 10berryxia
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。