
Umi-OCR 使用指南免费离线 OCR 文字识别软件完整介绍【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费开源、完全离线的 OCR 文字识别软件。它把截图、本地图片和 PDF 扫描件中的文字转成可编辑文本全部识别过程在本地完成数据不出机器适合需要频繁把纸质和图像资料数字化的用户。基础信息说明许可证MIT见 LICENSE支持平台Windows 7 x64、Linux x64开发语言PythonQt/QML 界面主要依赖PyStand 定制运行环境PaddleOCR 或 RapidOCR 引擎插件准备与启动系统要求Windows 7 及以上的 64 位系统或 x64 架构的 Linux 发行版无需额外安装运行库。获取方式下载发布包的.7z压缩或.7z.exe自解压包下载渠道见 README.md自解压包适合没有装压缩软件的电脑。解压后直接双击Umi-OCR.exe启动绿色版不写注册表也方便迁移到其他电脑。首次启动界面语言会跟随系统自动切换进入“全局设置”标签页可创建桌面快捷方式、设置开机自启也可手动调整语言、主题和字体。确认 HTTP 服务为开启状态默认开启。后续要使用命令行或接口调用时依赖它且默认仅监听本机回环地址。功能走查截图识别单张图片适用时机想从网页、电子书或其他软件界面里快速取一段文字且不想把内容上传到任何在线服务。操作要点打开“截图 OCR”标签页按快捷键框选屏幕区域即可识别也可以在别处复制图片后直接粘贴进来。左侧预览栏在图上标出文本块支持划选复制右侧记录栏可编辑、多选并合并复制多条识别结果按Esc可取消截图。批量转换扫描图片适用时机有一个文件夹的 jpg、png、webp、tiff 等图片需要一次性转成文本。操作要点把图片拖入“批量 OCR”页面无数量上限支持递归导入子文件夹。选择输出格式txt、jsonl、md、csv 即 Excel和保存目录点击“开始任务”即可每个文件会显示耗时与置信度。图片上有水印或固定位置的页眉干扰时用“忽略区域”功能右键绘制矩形框框内文本块会在任务中被跳过遇到像素超大的长图先在页面设置中调高“限制图像边长”的数值避免识别变慢或失败。处理 PDF 扫描件适用时机纸面扫描生成的图片型 PDF 无法搜索、需要转成可检索文档时。操作要点文档识别页支持 pdf、xps、epub、mobi 等格式。可以选择对整页做 OCR或直接提取文档自带文本层输出“双层可搜索 PDF”——既保留原始排版又能全文检索。同样支持设定忽略区域来排除页眉页脚并可配置任务完成后自动关机或休眠适合夜间跑大批量文档。此外软件内置二维码标签页截图、粘贴或拖入图片可读取二维码与条形码支持 QRCode、PDF417、EAN13 等 19 种协议一图多码也可以输入文本反向生成二维码图片。关键配置对日常使用影响最大的设置都集中在“全局设置”页和任务页的右侧设置栏常用的五项如下设置项作用推荐值OCR 引擎决定识别质量与兼容性追求精度选 PaddleOCR老旧环境或 Win7 选 RapidOCR识别语言库决定能识别的文字种类默认简体中文遇到其他语种文档时切换对应语言库限制图像边长控制超大长图的加载与识别压力保持默认批量长图任务时调高数值排版解析方案整理识别文本的换行与顺序通用场景选“多栏-按自然段换行”HTTP 服务启用命令行与接口调用开启主机保持“仅本地”如果个别机器上出现截图闪烁或界面错位可在全局设置中切换“渲染器”或关闭硬件加速。批量任务量很大时引擎默认线程与内存会控制在系统资源的一半以内一般无需手动干预。场景化用法文档归档把归档多年的纸质材料扫描成图片后整批拖入批量识别输出双层可搜索 PDF。原文的排版保留内容可以直接搜索和复制过去需要数天的人工录入现在主要耗时只剩扫描与识别任务本身。学习与笔记快捷键随时框选网页、课件、电子书里的文字复制后直接进笔记或文档。全程离线涉密的合同、病历、内部资料也可以放心处理。资料整理把收据、票据或带文字的产品图片按文件夹整理批量导出 txt 或 csv 后交给表格处理省掉逐张点开手抄的过程。常见问题问识别结果和预期不符怎么办答先确认图片清晰度再核对所选语言库是否与文档语种一致文字倾斜的文档可在页面设置中启用方向校正。问超大长图识别慢或失败答这类图片受“限制图像边长”约束在对应任务页设置中调高该数值即可。问识别结果怎么保存答批量任务可选 txt、jsonl、md、csv兼容 Excel等格式支持存到原目录或指定目录截图识别的结果可直接从记录栏复制。问使用过程会上传数据吗答识别全部在本地完成HTTP 服务默认只监听本机回环地址不经过物理网卡不访问外网。写在最后Umi-OCR 适合需要离线、可批量文字识别的个人与小团队截图取词、扫描归档、PDF 转可搜索文档这几个高频需求都能覆盖。它的边界在于识别质量依赖所选离线引擎与语言库目前不支持 macOS 平台HTTP 接口对并发支持有限不建议高并发调用。更多功能细节可查阅 README.md版本迭代记录见 CHANGE_LOG.md自动化调用可参考 命令行手册 与 HTTP 接口手册遇到问题可以在项目 Issue 页面提交反馈。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考