主要来源berryxia
查看原文事件专题 · 多源确认
百度开源Unlimited OCR,一次性解析多页文档
百度开源了Unlimited OCR模型,采用R-SWA(参考滑动窗口注意力)机制,一次前向推理即可处理32K上下文的文档,数十页PDF无需分块。与传统逐页处理的OCR不同,其KV Cache大小恒定,不随长度增长。模型灵感源于人类抄书行为,仅维护近128个状态。技术报告核心贡献者中,技术总监YY疑为DeepSeek前员工。
当前结论
百度开源的Unlimited OCR能一口气读完几十页PDF,不用切块,快又准。技术总监YY可能是DeepSeek出走的,有意思。
7 个信源67° AI 热度最后更新 2026/6/23 00:05:44
证据链
相关来源 1小互
查看原文相关来源 2arXiv: DeepSeek
查看原文相关来源 3向阳乔木
查看原文相关来源 4Pandaily
查看原文相关来源 5Jerry Liu
查看原文相关来源 6AK
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。