主要来源berryxia
查看原文事件专题 · 多源确认
百度开源 Unlimited OCR,一次推理处理多页文档
百度开源的 Unlimited OCR 模型采用 R-SWA 注意力机制,支持 32K 上下文窗口,一次前向推理即可完成几十页文档的转录。其核心卖点是 One-Shot Long-Horizon Parsing,无需分页处理,KV Cache 大小恒定。技术报告提到该模型融合了来自 DeepSeek-OCR 的高压缩编码器,且部分核心贡献者与 DeepSeek 有渊源。
当前结论
百度搞了个挺牛的 OCR 模型,能一口气读几十页,不像以前那样一页一页循环。开源了,谁都能试试。
7 个信源62° AI 热度最后更新 2026/6/23 02:33:48
证据链
相关来源 1小互
查看原文相关来源 2arXiv: DeepSeek
查看原文相关来源 3向阳乔木
查看原文相关来源 4Jerry Liu
查看原文相关来源 5Pandaily
查看原文相关来源 6AK
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。