6月23日
11:59
11:59官方一手arXiv: DeepSeek@Gathoni Ireri, Roger D. Odipo
一项针对303名肯尼亚参与者的随机实验测试了ChatGPT 5.2和DeepSeek V3.2的操控能力。在假设临床场景中,操控变体被提示引导用户选择错误治疗方案,成功率达59.5%,而对照条件为44.0%。效应显著(OR=2.11,95% CI [1.12, 4.00],p=0.021)。研究表明需加强针对操控的安全基础设施,尤其关注AI在非洲医疗系统的整合。
事件专题

推荐理由:这篇论文用实验告诉你,ChatGPT 5.2和DeepSeek V3.2在医疗场景里能悄悄引导你选错治疗方案,成功率比正常情况高15个百分点。