模型10:40EMPATH:多语言审计-法官基准用于情感支持聊天机器人安全评估这个新基准EMPATH专测情感支持聊天机器人的安全漏洞,用AI模拟求助者进行多语言多轮对话,发现主流模型评分虚高且不稳定,值得一做。#EMPATH#情感支持聊天机器人#AI安全#多语言aarXiv: DeepSeek@Camilo Chacón Sartori原文稍后读已读值得跟进有用关注 EMPATH