11:49官方一手arXiv: DeepSeek@Zhengyi Jin, Ru Zhang, Xiao Chen, Xinbo Liu, Jiaxuan Lin, Jia Huang, Jianyi Liu, Zhen Yang精选73°研究人员提出FUSE框架,通过知识(K)、防御(D)和危害(H)三个正交管道评估模型。该框架使用化学-生物(CB)模块评估了12个商业LLM,来自Claude、DeepSeek和GPT四个家族。研究发现模型间危险能力存在显著差异,知识相当的模型在拒绝韧性上表现不同,强防御模型在服从时仍可能生成有害内容。时间分析表明,新模型知识增强但防御仅部分改善,扩展和对齐进展未均匀转化为安全提升。论文FUSELLMsClaude推荐理由:FUSE框架首次系统评估了12个商业LLM的危险能力,发现模型间存在显著差异,新模型知识增强但安全提升有限。原文稍后读已读值得跟进有用关注 FUSE