HealthBench
general · 首次出现 2026-05-22 · 最近出现 2026-09-04 · 累计提及 31
综述
相关报道
9 条在档- OpenAI发布GPT-6 Astra模型Greg Brockman
- OpenAI GPT-6 Astra 多项基准测试领先elvis
- GPT-6 Astra在多项基准测试中领先OpenAI
- Google DeepMind发布Co-Scientist研究论文elvis
- 临床LLM中证据充分性提示的安全增益依赖于评判模型arXiv cs.AI
- 百川发布新一代医疗增强大模型 M4:登顶 OpenAI 医疗评测,超越 GPT-5.5IT之家
- RubricsTree:面向个人健康代理的可扩展开放式评估框架arXiv cs.AI
- MDIA:多智能体诊断管线在HealthBench上超越ChatGPT for CliniciansarXiv: OpenAI
- 百川开源新一代医疗大模型Baichuan-M3,全面超越GPT-5.2百川智能 Baichuan