尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

Umi-OCR:免费开源的离线OCR工具,截图、批量图片与PDF转文本一站完成

Umi-OCR:免费开源的离线OCR工具,截图、批量图片与PDF转文本一站完成 Umi-OCR免费开源的离线OCR工具截图、批量图片与PDF转文本一站完成【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款开源、免费的离线 OCR 软件全部识别在本地完成不联网、不上传、无收费功能。它面向三类用户日常需要截图转文字的办公族、需要批量识别图片的开发者以及要处理扫描版 PDF 的人。支持 Windows 7 x64 与 Linux x64解压后运行Umi-OCR.exe即可使用核心能力覆盖离线OCR、批量识别图片、PDF转文本、二维码扫描与生成并内置中、英、日、韩等多国语言识别库。为什么选它和常见的替代方案放在一起看差异比较直观方案网络依赖费用部署成本云端 OCR 服务必须上传图片按量计费有免费额度需申请密钥、写请求收费桌面软件多数需联网激活买断或订阅安装激活流程自行部署开源模型可离线免费装依赖、调环境门槛高Umi-OCR完全离线完全免费解压即用隐私敏感文档合同、病历、内部资料从不出本机断网环境也能正常工作。成本代码全部开源识别张数无上限没有会员和验证码。省事内置 RapidOCR / PaddleOCR 离线引擎多语言模型库随包携带不需要自己配模型文件。功能一览功能适用场景上手成本截图OCR随手截取屏幕文字、代码、聊天记录转文本低快捷键唤起即可批量OCR一次性识别几百张本地图片低拖入图片点开始任务文档识别扫描版 PDF 转文本或输出双层可搜索 PDF中支持 pdf/xps/epub/mobi 等格式二维码图片中扫码支持一图多码、19种码制文本生成二维码图片低排版解析多栏文档、代码截图按正确顺序输出文本中在识别页选择预设方案忽略区域排除水印、页眉页脚干扰中用矩形框圈定忽略范围命令行 / HTTP 接口接入脚本与自动化流程中需读一遍接口文档主界面一览左侧是截取的图片预览右侧是识别出的文本方便当场核对识别效果。场景实测随手截图识别输入屏幕上任意一段文字代码、文档、聊天记录。操作打开截图OCR标签页按快捷键框选区域也可以直接在别处复制图片后粘贴进来。输出文字出现在右侧记录栏可直接编辑、划选复制。识别排版不理想时在页面设置里切换排版解析方案即可多栏文档选多栏-按自然段换行代码截图选单栏-保留缩进。右侧设置/记录面板中识别结果逐条列出右键可复制、全选多条记录也能合并复制。批量识别图片输入一个文件夹里几百张 jpg / png / webp / tif 图片。操作在批量OCR页添加文件夹顶部进度条开始跑结果可保存为 txt、jsonl、md、csvExcel任务完成后可自动关机或待机适合挂机处理。输出每张图对应一份识别文本。左侧为待识别图片列表右侧显示各图片的识别状态与结果顶部进度条实时反映批量任务进度。两个批量场景的实用技巧图片自带水印或 LOGO在批量页右栏打开忽略区域编辑器用右键画矩形框把水印位置包进去。注意只有整个文本块落在框内才会被忽略框画得尽量大一些。超长图、超大图识别不全把设置→文字识别→限制图像边长的数值调高默认压缩边长会牺牲细节。扫描件转可编辑文本输入扫描版 PDF也支持 xps、epub、mobi、fb2、cbz。操作进入文档识别页添加文件勾选输出格式页眉页脚干扰同样用忽略区域排除。输出纯文本或双层可搜索 PDF——原文层保留底下叠加一层 OCR 文本能直接 CtrlF 搜索。Umi-OCR 支持多国界面语言首次启动会跟随系统自动切换识别引擎内置简体中文、English、繁體中文、日本語、한국어、Русский 等语言库处理外文扫描件前先在识别设置里选对语言模型。进阶玩法命令行入口就是主程序Umi-OCR.exe前提是全局设置里允许 HTTP 服务默认开启主机保持仅本地即可通信走本机回环不出网卡。最小示例umi-ocr --path D:/photo.png其他常用指令--screenshot鼠标截屏识别、--clipboard识别剪贴板图片、--show/--quit显示主窗口 / 关闭软件。完整参数见 docs/README_CLI.md。HTTP 接口适合把 OCR 嵌进自己的脚本。默认端口1224把图片转成 Base64 后 POST 即可curl -X POST http://127.0.0.1:1224/api/ocr -H Content-Type: application/json -d {image: base64图片}接口还支持文档识别与二维码识别/生成。两点提醒后端并发能力弱不要并发调用长时间连续调用偶发ECONNREFUSED时重试即可。详见 docs/http/README.md。避坑清单识别结果缺字、错字 → 图片本身模糊或边长被压缩→ 换清晰图源限制图像边长调高数值。水印、页眉页脚混进结果 → 干扰文字被当成正文→ 用忽略区域框掉且框要完整包住整个文本块。多栏文章输出顺序混乱 → 引擎按视觉位置而非阅读顺序输出→ 切换排版解析预设方案多栏/单栏、换行策略按文档类型选。外文识别效果差 → 语言模型没选对→ 在识别设置中把语言/模型库切到对应语言。命令行或 HTTP 调用无响应 → 全局设置里 HTTP 服务被关掉→ 重新勾选允许 HTTP 服务主机设仅本地。截图时界面闪烁、UI 错位 → 显卡硬件加速冲突Windows 常见→ 全局设置→界面和外观→渲染器换渲染方案或关闭硬件加速。资源Umi-OCR 用离线 免费 可脚本化三件事把 OCR 的门槛压到很低日常识别到批量自动化都能覆盖。仓库克隆git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR发行版下载含 v2.1.5仓库根目录Umi-OCR_Rapid_v2.1.5.7z更新日志CHANGE_LOG.md命令行手册docs/README_CLI.mdHTTP 接口手册docs/http/README.md【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表