论文12:03InfoOps Bench:检测大模型被用于信息操作用的安全基准这个基准让你看到哪些大模型最容易被带偏去搞信息战,测了17个模型,差距能到85个百分点,挺颠覆直觉的。#InfoOps Bench#GLM 5.2#AI安全#基准测试aarXiv cs.AI@Dorian Quelle 等 4 人原文稍后读已读值得跟进有用关注 InfoOps Bench