21:44向阳乔木@vista8百度在GitHub上开源了UnlimitedOCR项目,代码仓库已公布。模型权重托管在HuggingFace,可直接下载。该工具基于文心大模型实现OCR识别功能,支持多种场景的文字提取。AI模型UnlimitedOCR百度文心大模型2 个信源在谈事件专题推荐理由:百度开源了UnlimitedOCR,基于文心大模型做OCR,代码和模型都公开了,直接就能下下来用。原文稍后读已读值得跟进有用关注 UnlimitedOCR
12:40小互@imxiaohu精选百度发布新 OCR 模型 UnlimitedOCR,支持单次推理解析数百页文档,同时保持高吞吐速度。在 OmniDocBench v1.5 基准上,其准确率达到 93%,比原始 DeepSeek-OCR 基线提升 6 个百分点。模型已开源,可在 Hugging Face 和 GitHub 下载。AI模型UnlimitedOCRBaiduOmniDocBench8 个信源在谈事件专题推荐理由:百度新出的 UnlimitedOCR 能一次处理几百页,速度还很快,直接比 DeepSeek-OCR 高了 6 个点,真正好用。原文稍后读已读值得跟进有用关注 UnlimitedOCR
14:46向阳乔木@vista876°百度发布Unlimited OCR,模拟人类抄书注意力模式,每生成一个token时参考完整图像和提示词,但输出侧仅回看前128个token。KV缓存固定为128长度,避免长文档推理时内存爆炸。在超长文档OCR任务上效果显著,已在GitHub和Hugging Face开源。AI模型UnlimitedOCR百度OCR6 个信源在谈事件专题推荐理由:百度开源了一个超聪明的OCR方案,用固定128 token缓存模拟人眼抄书,长文档不爆内存,快去试试!原文稍后读已读值得跟进有用关注 UnlimitedOCR