事件专题 · 多源确认

百度开源 Unlimited OCR 再登 HuggingFace 总榜前三,获 Yann LeCun 转发

百度开源的 Unlimited OCR 模型再次登上 HuggingFace 全球模型总趋势榜第三名,超过 GLM-5.2。该模型仅 30 亿参数,支持 32K 上下文,可一次性解析 100 页 PDF 且无需分页,40 页后错误率低于 0.11。它采用 R-SWA 机制保持 KV Cache 恒定,解决了长文档 OCR 的显存和效率问题。目前 GitHub Star 超 1.65 万,HuggingFace 下载量达 224 万。

当前结论

百度开源了个 30 亿参数的 OCR 模型,能一次读完 100 页 PDF,不用分段处理,海外开发者都说好,Yann LeCun 都转了。

3 个信源79° AI 热度最后更新 2026/7/22 08:27:23

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情