事件专题 · 多源确认

OpenAI发布GPT 5.6,ParseBench测试文档理解

OpenAI今日发布GPT 5.6系列模型。Llama Index在ParseBench基准上进行测试,评估文档理解能力。新模型在阅读文本和表格方面表现优异,但在图表和布局上仍有困难。Luna版本比Sol版本便宜约6倍,但性能下降微小,表明增加推理token不一定改善视觉理解。

当前结论

OpenAI刚发了GPT 5.6,Llama Index实测:读文字表格很强,看图表还差点意思。便宜6倍的Luna版性价比很香。

11 个信源88° AI 热度最后更新 2026/7/9 22:48:21

证据链

相关来源 4Simon Willison’s Weblog
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情