主要来源Jerry Liu
查看原文事件专题 · 多源确认
ExtractBench测试20+模型文档提取
ExtractBench测试20多个模型在文档提取任务上的表现,Qwen 3.8模型表现最佳,GLM-5.3-flash和qwen 3.8 flash新版本也刚刚发布。测试结果基于统一F1的“价值准确性”指标,不包含视觉定位和置信度评分。
当前结论
ExtractBench最新测试了20多个模型,Qwen 3.8模型表现抢眼,新版本GLM-5.3-flash和qwen 3.8 flash也值得关注。
11 个信源53° AI 热度最后更新 2026/8/26 17:21:40
证据链
相关来源 1Geek
查看原文相关来源 2OpenRouter
查看原文相关来源 3IT之家
查看原文相关来源 4ollama
查看原文相关来源 5Paul Couvert
查看原文相关来源 6lmarena.ai
查看原文相关来源 7elvis
查看原文相关来源 8shao__meng
查看原文相关来源 9The Rundown AI
查看原文相关来源 10量子位
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。