主要来源berryxia
查看原文事件专题 · 多源确认
百度开源Unlimited-OCR,一次处理几百页文档,速度超快
百度在Hugging Face上开源了Unlimited-OCR模型,其核心创新是R-SWA(Reference Sliding Window Attention),让KV Cache保持恒定,避免随页数爆炸。该模型可一次性解析单张图或多页PDF,在OmniDocBench上获得93分,比DeepSeek-OCR高出6个百分点。它取代了传统“分块+拼接”流程,实现端到端长文档理解,输出质量更高。
当前结论
百度开源了Unlimited-OCR,几百页文档一次搞定,不用分块拼接,速度稳准狠,OmniDocBench上93分压了DeepSeek-OCR一头。
6 个信源72° AI 热度最后更新 2026/6/22 16:47:32
证据链
相关来源 1arXiv: DeepSeek
查看原文相关来源 2小互
查看原文相关来源 3向阳乔木
查看原文相关来源 4Pandaily
查看原文相关来源 5AK
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。