
Umi-OCR 插件完整指南3 分钟安装7 个 OCR 引擎快速选型【免费下载链接】Umi-OCR_pluginsUmi-OCR 插件库项目地址: https://gitcode.com/gh_mirrors/um/Umi-OCR_plugins你是不是也遇到过这种情况扫描的合同无法直接选中文本想识别一页带公式的文档结果出来的文字全是乱码Umi-OCR 解决了认不出的问题而当你想要更好的识别效果时需要的是一套更合适的引擎。Umi-OCR 插件库就是为开源识别软件 Umi-OCR 准备的 OCR 引擎插件集合v2 以上版本支持以插件形式导入把文件夹放进指定目录即可加载。下面带你完成安装、选型和调优。30 秒认识 Umi-OCR 插件它不是独立的识别软件而是给 Umi-OCR 换装的引擎组件插件库共收录 7 个 OCR 插件PaddleOCR-json、RapidOCR-json、Pix2Text、TesseractOCR、ChineseOCR、WechatOCR、MistralOCR除 MistralOCR 走云端 API 外其余插件都在本地 CPU 上运行图片不出电脑全部支持 Windows 7 64 位PaddleOCR-json 额外支持 Linux x64仓库自带一个可运行的最小开发示例 demo_AbaOCR/写自己的插件可以参考它快速上手3 分钟安装完成Windows到 Umi-OCR 插件库的 Releases 发布页下载对应平台的预编译包解压得到一个插件文件夹如win7_x64_PaddleOCR-json将整个文件夹复制到 Umi-OCR 安装目录的UmiOCR-data/plugins下启动 Umi-OCR在全局设置拉到最底部即可看到该插件⚠️ 官方把这件事强调了三遍不要直接下载仓库源代码使用一定要用预编译包否则里面缺少可执行文件。Linux# 进入插件目录 cd UmiOCR-data/plugins # 下载 linux_x64 平台包并解压 tar -v -xf linux_x64_PaddleOCR-json_xxx.tar.xz # 完成启动 Umi-OCR 测试即可 插件文件夹名必须是纯 ASCII 字符且不能和 Python 已有模块重名否则加载不出来。 Umi-OCR 的 Paddle 版、Rapid 版已自带对应插件只有想换用其他引擎时才需要手动装。按需选择哪个 OCR 插件适合你日常识别追求准确电脑配置不差主要处理中英日韩文档 → PaddleOCR-json性能与准确率俱佳还支持 mkldnn 数学库加速老电脑、内存有限 → RapidOCR-json相当于 PaddleOCR 的轻量版CPU 兼容性好、内存占用低特殊场景文档里有数学公式论文、作业、公式推导→ Pix2Text支持中英文/公式/混合排版小语种多、想自己导入语言包 → TesseractOCR老牌开源模型自带排版识别模型只认纯中文 → ChineseOCR轻量级模型简单直接想体验微信的识别技术 → WechatOCR离线本地调用电脑配置低但要多语言高精度且能联网 → MistralOCR云端 API 识别配置调优不同用户的最佳设置每个插件的配置分两类全局配置所有标签页通用如线程数、API 密钥和局部配置每个标签页独立如识别语言。挑三种典型场景说清楚。高配电脑8 核 16G 内存→ PaddleOCR-json# 全局配置 启用 MKL-DNN 加速开 # 大幅提速但内存占用更高 线程数8 # 按物理核心数设上限 16 内存占用限制8192 MB # 超过即清理默认取总内存一半 内存闲时清理60 秒 # 局部配置 语言/模型库简体中文 纠正文本方向关 # 图片有倾斜再开 限制图像边长960默认 # 调大更精细但更慢低配/老电脑 → RapidOCR-json线程数2 语言/模型库只选需要的语言 纠正文本方向关 限制图像边长1024默认学术/公式文档 → Pix2Text启用文字识别开 启用数学公式开 限制图像边长1216 # 608 最快4864 最精细 用 MistralOCR 的话记得在全局配置填API 密钥、设超时时间默认 30 秒范围 5~120配置定义见 MistralOCR/。效果对比一览插件识别速度内存占用准确率适用场景PaddleOCR-json⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐高配电脑高质量识别RapidOCR-json⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐老电脑日常使用Pix2Text⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐数学公式学术文档TesseractOCR⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐多语言复杂排版ChineseOCR⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐纯中文文档WechatOCR⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐想试微信 OCRMistralOCR⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐云端识别多语言星级为相对水平。TesseractOCR 的英文准确率优秀、中文稍差所以准确率一栏打了折。踩坑指南新手常见问题速查装完插件为什么没出现确认文件夹在UmiOCR-data/plugins下而不是多套了一层确认文件夹名是纯 ASCII没有空格、中文确认没有和 Python 已有模块重名重启 Umi-OCR还不行就看日志里的具体报错为什么识别速度慢限制图像边长调回默认值让大图先压缩再识别线程数与核心数匹配盲目拉高反而更慢老电脑直接换 RapidOCR-jsonPix2Text 插件体积大、首次加载慢属正常现象为什么中文识别不准检查局部配置里是否选对了语言/模型库图片模糊或有倾斜时先开纠正文本方向、提高对比度中文文档优先用 PaddleOCR-jsonTesseractOCR 的中文是短板同一张图换不同插件各跑一次对比效果为什么内存占用高PaddleOCR-json 设置内存占用限制如 4096 MB超限自动清理内存闲时清理设为 60 秒空闲时释放内存内存紧张直接换轻量级 RapidOCR-json最后手段关闭 MKL-DNN 加速速度会降低一些老电脑为什么启动不了 PaddleOCR-jsonCPU 必须带AVX 指令集凌动 Atom、安腾、赛扬 Celeron、奔腾 Pentium 均不支持可直接运行插件里的PaddleOCR-json.exe自测输出OCR init completed.即通过不兼容就换 RapidOCR-json它无硬件特殊要求用 TesseractOCR 插件要注意什么它自带排版识别模型效果比 Umi 内置的排版解析器好所以要在标签页设置里把排版解析方案设为不做处理否则会被二次处理排版反而乱掉进阶自己动手扩展插件库自带最小开发示例 demo_AbaOCR/一个完整的阿巴 OCR——输入任何图片都返回阿巴阿巴专门用来演示流程。在它基础上改就是你自己的插件。demo_AbaOCR/ ├── __init__.py # 插件入口定义 PluginInfo ├── aba_ocr.py # OCR 接口类 ├── aba_ocr_config.py # 全局/局部配置定义 └── i18n.csv # 多语言翻译表开发分 4 步提取配置项在aba_ocr_config.py里把配置分成全局API 密钥、线程数和局部语言两组构造接口类在aba_ocr.py实现start/stop/runPath/runBytes/runBase64按统一的code data格式返回结果注册入口在__init__.py的PluginInfo中声明group、global_options、local_options、api_class放置插件文件夹丢进UmiOCR-data/plugins重启即生效 翻译表i18n.csv必须保存为utf-8 编码用 Excel 编辑过要检查一下再保存。需要完整插件源码做二次开发时克隆仓库git clone https://gitcode.com/gh_mirrors/um/Umi-OCR_plugins一句话决策高配电脑追求最佳效果 → PaddleOCR-json低配老电脑 → RapidOCR-json要识别数学公式 → Pix2Text多语言文档 → TesseractOCR纯中文文档 → ChineseOCR想试微信的识别技术 → WechatOCR低配但要多语言高精度 → MistralOCR没有最好的 OCR 插件只有最适合你需求的插件。总结与资源装好插件只要三步下载预编译包、放进UmiOCR-data/plugins、重启软件。选型先看硬件再看场景最后看语言调优抓住线程数、内存限制、图像边长这三个参数就覆盖了大部分速度问题。现在就可以动手挑一个插件装好找几张含文字和公式的图对比一下效果。插件总览与安装说明README.mdPaddleOCR-json 详细部署含源码部署、硬件自测win_linux_PaddleOCR-json/README.md插件开发文档与示例demo_AbaOCR/插件源码仓库见进阶一节的 git clone 命令装好一个想换随时换祝你识别命中率永远是 100%。【免费下载链接】Umi-OCR_pluginsUmi-OCR 插件库项目地址: https://gitcode.com/gh_mirrors/um/Umi-OCR_plugins创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考