尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

Umi-OCR 离线 OCR 软件使用指南:3 个场景把图片变文字,免费不上传

Umi-OCR 离线 OCR 软件使用指南:3 个场景把图片变文字,免费不上传 Umi-OCR 离线 OCR 软件使用指南3 个场景把图片变文字免费不上传【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR想复制一张图里的文字在线工具要你先把图传上别人的服务器手动敲进文档又太慢。Umi-OCR 是一个免费、开源、完全离线的 OCR 软件——识别引擎整套装在你电脑上图片不离开硬盘不注册、不限额、不上传。能力总览主窗口由可自由开合的标签页组成核心能力可以概括成四件事能力入口典型用途截图 OCR截图OCR标签页屏幕上的字随手抓走支持快捷键截图、粘贴图片批量 OCR批量OCR标签页几百张图片一次拖入结果导出 txt / csv / md / jsonl文档识别文档识别标签页扫描版 PDF 转文字输出双层可搜索 PDF二维码二维码标签页识别 19 种码制也能反向生成二维码先给一张地图日常取字用截图页归档材料用批量页和文档页剩下的时间不用打开它。截图 OCR屏幕上的字随手取走入口打开截图OCR标签页按全局快捷键唤起截图框框住文字结果立刻出现在右侧记录栏在别处复制的图片比如聊天窗口里的图也可以直接粘贴进来识别。关键设置识别语言库决定引擎认哪种文字在文字识别设置里选或按需下载。排版解析方案决定引擎吐出的零散文字块按什么顺序拼成段落。拿不准就选多栏-按自然段换行覆盖面最广代码截图切到单栏-保留缩进行首缩进和行中空格基本保住。记录栏里的文字可以直接手动修正还能划选多条记录一起复制识别完顺手整理即可。一条老手建议竖排文字从右到左的栏排版解析能自动处理但前提是识别语言库选对——界面语言和识别语言是两回事界面用中文、日常识别日文书籍完全可以搭配。批量拖入图片几百张一次识别入口切到批量OCR标签页把图片或文件夹直接拖进窗口。jpg、png、webp、bmp、tif、tiff 都收数量没有上限。关键设置结果导出任务跑完可导出txt、jsonl、md、csv四种格式其中 csv 用 Excel 直接打开。暂停任务v2.1.2 起支持中途想休息不用整晚开着——软件不退出待机/休眠后接着跑。任务完成自动关机/待机过夜挂机批量识别时很实用。一条老手建议如果每张图片都有固定位置的水印或 LOGO在右侧设置打开忽略区域编辑器按住右键在图上画多个矩形框框住的区域识别时自动排除。记住机制只有整个文本块完全落在框内才会被忽略不是按单个字符——画框宁可大一点把水印可能出现的位置全包住。扫描件 PDF 转双层可搜索 PDF入口打开文档识别标签页拖入文件支持pdf、xps、epub、mobi、fb2、cbz六种格式典型场景就是扫描版 PDF。关键设置提取模式默认优先提取 PDF 自带文本层速度快、零识别误差纯扫描页才自动切 OCR也可以强制整页 OCR或反过来只提取原文本。双层可搜索 PDF输出文件底层是原图、上层是透明文字外观和扫描件一模一样文字却能搜索、复制、划线——归档历史合同、数字化旧书直接顶用。v2.1.2 起还能输出单层纯文本 PDF体积小、好编辑。按页码范围设置忽略区域页眉页脚在这里同样能排掉任务完成可设自动关机/待机。一条老手建议手头有旋转过方向的扫描件用 v2.1.5 及以上——该版本修复了PDF 旋转页面文本错位的问题并优化了数万个文件的大文件夹加载。把产出调干净排版方案与引擎选择OCR 引擎出来的文字块本身没有先后全靠排版解析安排顺序选对方案输出才符合阅读习惯方案适用场景多栏-按自然段换行两栏/三栏的论文书籍最常用多栏-总是换行 / 无换行每行独立或整段强制合并成一行单栏-按自然段换行单栏文档段落自然断行单栏-保留缩进代码截图专用保住行首缩进不做处理引擎原始输出不整理引擎与语言方面内置Rapid-OCR兼容性好和PaddleOCR速度快一些两套引擎在全局设置里随时切换。识别不准或报错先换引擎再调别的往往见效更快。界面语言管按钮菜单长什么样中文、繁中、英文、日文、俄语、葡萄牙语等由社区译者维护识别语言库管引擎认哪种文字在各标签页文字识别设置里单独选。路径全局设置 → 语言/Language。最容易踩的几个坑出问题时别逐条背报错按现象 → 原因 → 解法对号入座打不开 / 双击闪退→ 杀软把内置的本地识别引擎当成威胁拦截了。把软件目录加入杀毒白名单首次启动前做这一步最稳。水印还在结果里→ 忽略区域框没包全。按整块文字忽略而不是按字符宁大勿小另外确认配置已保存。长图识别缺胳膊少腿→ 默认限制图像边长把图裁了。去文字识别设置里调高限制图像边长而不是放大原图——过度放大只会增加噪声、反降准确率。截图时界面闪烁、错位→ 显卡渲染兼容问题。全局设置 → 界面和外观 → 渲染器切换渲染方案或关闭硬件加速通常即好。命令行敲了没反应→ Umi-OCR 靠本地 HTTP 服务做进程间通信默认开启仅监听本地环回数据不出机器。确认服务已开启且入口要用主程序Umi-OCR.exe备用启动器不支持命令行。进阶接入命令行与 HTTP 接口命令行模式入口就是主程序指令支持简写--screenshot可写--sc两条最常用的直接复制umi-ocr --screenshot --clip umi-ocr --path D:/扫描件.png --output result.txt第一条截屏识别、结果直接进剪贴板第二条把指定图片识别结果存成 txt。配合快捷键工具可以实现按一个键自动截指定区域并识别。完整参数见命令行手册。HTTP 接口启动后本地服务提供图片 OCR、文档识别、二维码三类接口几十行代码就能封装成小工具实现上传图片 → 返回 JSON 结果详见HTTP 接口文档。引擎想再折腾项目另有独立插件库可切换更多识别后端公式识别也在路线图上版本演进记录在更新日志v2.1.0 加入文档识别v2.1.2 支持单层纯文本 PDF 与任务暂停v2.1.3 登陆 Linux 并支持 Docker 部署v2.1.4 起 PaddleOCR 插件默认把内存限制在系统总内存的一半以内。写在最后免费、开源、完全离线Umi-OCR 把屏幕上的文字还到你手里——图片不离开硬盘从随手截一张图到几百张图片批量归档、扫描件转可搜索 PDF都不需要上传任何东西。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表