论文中美对照官方一手04:03OpenAI 发布 MentalHealthBench:评估 AI 心理健康对话的安全性OpenAI 做了个心理健康对话评测集,专门测模型遇到自伤、焦虑这类敏感问题时答得稳不稳,各家模型能拿它来横向对比。#MentalHealthBench#OpenAI#AI安全#心理健康10 个信源在谈事件专题官方一手OpenAI Blog11 个信源在谈原文稍后读已读值得跟进有用关注 MentalHealthBench
模型Agent 与开发者多源确认03:56OpenAI 发布 MentalHealthBench 心理健康对话基准OpenAI 和 80 多位临床医生一起做了个心理健康对话评测基准,还开源了方法,做模型评测的可以拿来直接跑。#OpenAI#MentalHealthBench#基准测试#AI安全10 个信源在谈事件专题官方账号OpenAI@OpenAI11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI