主要来源Greg Brockman
查看原文事件专题 · 多源确认
OpenAI 发布 GeneBench-Pro 基准,GPT-5.6 Sol 在生物分析判断任务上大幅进步
OpenAI 推出 GeneBench-Pro,一个用于评估 AI 在计算生物学中处理判断密集型分析能力的基准。其问题需要人类专家 20-40 小时完成。GPT-5.6 Sol 在该基准上实现了显著提升,标志着模型在混乱生物数据中导航、选择分析路径和做出专业判断方面的进步。
当前结论
OpenAI 搞了个新基准 GeneBench-Pro,专门测模型做复杂生物分析时的判断力,GPT-5.6 Sol 表现很亮眼,比之前强不少。
11 个信源83° AI 热度最后更新 2026/7/1 05:33:19
证据链
相关来源 1OpenAI
查看原文相关来源 2@koltregaskes
查看原文相关来源 3IT之家
查看原文相关来源 4小互
查看原文相关来源 5量子位
查看原文相关来源 6AI Will
查看原文相关来源 7pandaily
查看原文相关来源 8techcrunch
查看原文相关来源 9The Rundown AI
查看原文相关来源 10Marc Andreessen
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。