主要来源Stanford AI Lab
查看原文事件专题 · 多源确认
GPT-6 Astra在Terminal-Bench-Science基准测试中表现优异
GPT-6 Astra在Terminal-Bench-Science 0.1基准测试中得分为64.6%。这一成绩比GPT-5.6的22.4%提升了42.2个百分点。Terminal-Bench-Science基准测试发布仅一周就被OpenAI采用。该基准测试旨在解决世界 toughest的科学挑战。
当前结论
OpenAI刚发布的GPT-6 Astra在科学基准测试中得分暴涨42%,远超前代模型。
11 个信源73° AI 热度最后更新 2026/9/3 21:56:12
证据链
相关来源 1OpenAI
查看原文相关来源 2elvis
查看原文相关来源 3Greg Brockman
查看原文相关来源 4orange.ai
查看原文相关来源 5IT之家
查看原文相关来源 6shao__meng
查看原文相关来源 7Simon Willison’s Weblog
查看原文相关来源 8The Rundown AI
查看原文相关来源 9Decoder
查看原文相关来源 10@OpenAIDevs
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。