主要来源OpenAI
查看原文事件专题 · 多源确认
OpenAI 发布 GeneBench-Pro 基准测试,考验AI处理生物数据判断力
OpenAI推出GeneBench-Pro,这是一个面向AI agent的研究级基准测试。该基准要求agent在混乱的生物数据中导航并选择正确的分析路径。它旨在衡量AI在真实计算研究中的判断能力,而非简单准确率。
当前结论
想看看AI分析生物数据能多聪明?OpenAI这个新测试专考agent的判断力,挺有意思的。
11 个信源63° AI 热度最后更新 2026/6/30 17:10:23
证据链
相关来源 1Greg Brockman
查看原文相关来源 2IT之家
查看原文相关来源 3向阳乔木
查看原文相关来源 4@koltregaskes
查看原文相关来源 5AI Will
查看原文相关来源 6@OpenAIDevs
查看原文相关来源 7Pandaily
查看原文相关来源 8小互
查看原文相关来源 9vLLM
查看原文相关来源 10techcrunch
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。