主要来源小互
查看原文事件专题 · 多源确认
百度开源Unlimited OCR:一次推理处理数十页PDF
百度开源的Unlimited OCR模型采用参考滑动窗口注意力(R-SWA)技术,能在32K上下文内一次前向推理处理数十页文档,无需分页。模型仅3B参数、500M激活,显存和算力不随页数增长。传统逐页OCR需要拼接结果,而R-SWA模拟人类连续抄写,始终记忆固定大小的文本。该模型据称基于DeepSeek OCR核心贡献者开发,已在标准长度文档上测试。
当前结论
百度开源了一款OCR模型,3B参数就能一次处理几十页PDF,不用切页,比传统逐页OCR强太多。
9 个信源56° AI 热度最后更新 2026/6/24 03:51:04
证据链
相关来源 1berryxia
查看原文相关来源 2向阳乔木
查看原文相关来源 3Jerry Liu
查看原文相关来源 4marktechpost
查看原文相关来源 5IT之家
查看原文相关来源 6arXiv: DeepSeek
查看原文相关来源 7Pandaily
查看原文相关来源 8AK
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。