论文精选13:00CogManip 基准测试:多轮对话中大模型的操纵行为风险AI 安全研究者终于有了评估隐性操纵的专用工具——CogManip 覆盖 15 种策略、1000 个场景,做模型对齐和红队测试的团队可以直接拿来用。#大语言模型#AI安全#心理操纵#基准测试aarXiv: DeepSeek@Zeyang Yue 等 8 人原文稍后读已读值得跟进有用关注 大语言模型