事件专题 · 多源确认

百度发布 Unlimited OCR,基于 R-SWA 机制实现长文档连续解析

百度推出的 Unlimited OCR 采用 Reference Sliding Window Attention (R-SWA) 机制,将解码阶段 KV Cache 控制在恒定规模,仅用 30 亿参数模型即可连续解析数十页文档。该项目开源次日即登上 GitHub Trending 和 HuggingFace 模型下载趋势榜双第一,目前 GitHub Star 突破 1.65 万,HuggingFace 下载量超 224 万。Yann LeCun 也关注到该项目。

当前结论

百度这个 Unlimited OCR 通过 R-SWA 机制解决了长文档 OCR 的拼接问题,30 亿参数就能处理几十页,开源后社区反响超火,连 LeCun 都点赞了。

3 个信源78° AI 热度最后更新 2026/7/22 13:04:30

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情