主要来源Jerry Liu
查看原文事件专题 · 多源确认
百度开源Unlimited OCR:3B参数、单次处理40+页,表格解析SOTA
Unlimited OCR是百度开源的OCR模型,总参数量3B,仅500M激活。它在表格解析和阅读顺序方面表现优秀,在OmniDocBench v1.5和v1.6上达到SOTA。核心创新是Reference Sliding Window Attention(R-SWA),能保持恒定KV缓存大小,单次前向传递处理40+页文档。与PaddleOCR-VL-1.6对比显示,它在语义格式和图表方面略有不足。
当前结论
百度开源了Unlimited OCR,3B参数却只有500M激活,表格解析超强,能一次性读完40页文档,比PaddleOCR-VL-1.6强在表格和阅读顺序上。试试看?
8 个信源53° AI 热度最后更新 2026/6/24 23:24:42
证据链
相关来源 1marktechpost
查看原文相关来源 2向阳乔木
查看原文相关来源 3小互
查看原文相关来源 4berryxia
查看原文相关来源 5IT之家
查看原文相关来源 6Pandaily
查看原文相关来源 7AK
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。