老哥把PP-OCRv6做成了Mac本地工具,一键切换模型大小,还能批量导出,离线用超方便。
开发者发布了一个开源的本地OCR工作台,基于PP-OCRv6模型,在Mac上利用CoreML加速。提供Tiny(1.5MB)、Small、Medium(34.5MB)三个模型,支持图片上传、批量处理和导出CSV/Markdown/Excel。完全本地运行,苹果硅芯片自动启用CoreML加速,Intel Mac和Linux可用CPU。还包含浏览器版Tiny模型和与OmniDocBench、Apple Vision对比的评测脚本,在弯曲表面、点阵字体等难例场景表现良好。
兄弟们,肝出来了!并且全部免费开源了! 我把PP-OCRv6直接做成了本地工作台,在Mac上用Co…
兄弟们,肝出来了!并且全部免费开源了!
我把PP-OCRv6直接做成了本地工作台,在Mac上用CoreML加速,一键就能切换Tiny、Small、Medium三个模型大小!
Tiny只有1.5MB适合极致轻量,Medium 34.5MB主打精度,中间Small做平衡。
支持图片上传、批量处理、结果导出CSV/Markdown/Excel,历史记录自动保存。
整个东西完全本地跑,隐私安全,不用上传任何数据。
最爽的是在苹果硅上自动开启CoreML加速,Intel Mac和Linux也能CPU跑。
还专门做了浏览器版Tiny模型,零依赖直接在网页里就能用OCR。
附带评测脚本,能跟OmniDocBench和macOS自带Apple Vision对比,实际测试在弯曲表面、点阵字体、低对比度这些难搞场景表现都不错。
以前做本地OCR最烦的就是模型下载、环境配置、精度和速度权衡,现在我把这些全封装好了。
开发者、研究者、需要离线处理文档的人直接clone就能用。
这其实是我自己日常做OCR时踩了很多坑后,顺手做的东西。
希望能帮到同样有这个需求的朋友。