主要来源elvis
查看原文事件专题 · 多源确认
OpenAI 发布 LifeSciBench,专测 AI 在生命科学研究中的能力
OpenAI 推出 LifeSciBench,一个针对生命科学研究的基准测试,包含 750 个专家编写的任务,覆盖 7 个生物学研究工作流。该基准由 173 位来自生物技术和制药领域的科学家共同开发,旨在衡量 AI 在真实世界科研场景中的表现。结果显示通用模型在复杂结构处理上仍有不足,而专用模型在科学研究中优势明显。
当前结论
OpenAI 联合 173 位科学家搞了个新基准 LifeSciBench,750 个专家任务专测 AI 搞科研的能力,比通用模型靠谱多了。
11 个信源62° AI 热度最后更新 2026/6/18 15:23:21
证据链
相关来源 1OpenAI
查看原文相关来源 2marktechpost
查看原文相关来源 3@koltregaskes
查看原文相关来源 4Jim Fan
查看原文相关来源 5Fireworks AI
查看原文相关来源 6宝玉
查看原文相关来源 7arXiv: OpenAI
查看原文相关来源 8lmarena.ai
查看原文相关来源 9Greg Brockman
查看原文相关来源 10berryxia
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。