事件专题 · 多源确认

OpenAI 发布 GeneBench-Pro 基准,GPT-5.6 Sol 在生物分析判断任务上大幅进步

OpenAI 推出 GeneBench-Pro,一个用于评估 AI 在计算生物学中处理判断密集型分析能力的基准。其问题需要人类专家 20-40 小时完成。GPT-5.6 Sol 在该基准上实现了显著提升,标志着模型在混乱生物数据中导航、选择分析路径和做出专业判断方面的进步。

当前结论

OpenAI 搞了个新基准 GeneBench-Pro,专门测模型做复杂生物分析时的判断力,GPT-5.6 Sol 表现很亮眼,比之前强不少。

11 个信源83° AI 热度最后更新 2026/7/1 05:33:19

证据链

相关来源 10Marc Andreessen
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情