主要来源向阳乔木
查看原文事件专题 · 多源确认
百度发布 Unlimited OCR,基于 R-SWA 机制实现长文档连续解析
百度推出的 Unlimited OCR 采用 Reference Sliding Window Attention (R-SWA) 机制,将解码阶段 KV Cache 控制在恒定规模,仅用 30 亿参数模型即可连续解析数十页文档。该项目开源次日即登上 GitHub Trending 和 HuggingFace 模型下载趋势榜双第一,目前 GitHub Star 突破 1.65 万,HuggingFace 下载量超 224 万。Yann LeCun 也关注到该项目。
当前结论
百度这个 Unlimited OCR 通过 R-SWA 机制解决了长文档 OCR 的拼接问题,30 亿参数就能处理几十页,开源后社区反响超火,连 LeCun 都点赞了。
3 个信源78° AI 热度最后更新 2026/7/22 13:04:30
证据链
相关来源 1berryxia
查看原文相关来源 2marktechpost
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。