
Umi-OCR 离线 OCR 教程零联网截图和批量图片识别一次跑通【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR上周帮同事把一摞扫描的合同转成电子版全程没碰过键盘图拖进去文字就出来了。用的是 Umi-OCR一个免费开源、完全离线的 OCR 工具截图圈一下、图片拖一批文字直接变成可复制的文本。它做的事情其实不复杂截图 OCR、批量识别本地图片、PDF 文档识别、扫二维码外加命令行和 HTTP 接口。和那些网页版识别服务最大的区别只有一个字——离线。识别引擎和语言库全部打包在发布包里文档不用上传到任何服务器不联网、不限次数、不要钱。解压双击跑起来从项目仓库下载.7z压缩包没有解压软件的电脑可以直接下.7z.exe自解压包解压到任意目录。双击Umi-OCR.exe无需安装第一次打开会按系统语言自动切换界面。打开全局设置标签页在语言 / Language里换成你顺眼的语言主题里挑浅色或深色顺手可以勾上开机自启。截图圈一下文字就进剪贴板你要达成的网页上有一段复制不了的文本或者视频里闪过一段字幕想把它变成可编辑的文字。怎么操作打开截图OCR标签页在右侧设置里确认快捷键一项有按键没有就按一下录制然后按快捷键唤起截图。用鼠标框选屏幕上的目标区域左侧预览栏立刻出现截图右侧记录栏里出现识别出的文字每段带置信度和时间戳。在预览图上划选文字可直接复制在记录栏里划选多条记录右键复制整段拿走。结果长什么样剪贴板里是排好顺序的纯文本粘贴到备忘录、IDE 或者 Word 里就能用。识别代码截图时把文本后处理的排版解析方案切到单栏-保留缩进缩进和空格都会原样保留。把一文件夹扫描件跑成文本你要达成的十几页扫描的 PDF 已经转成图片想一次性拿到全部文字。怎么操作切到批量OCR标签页点选择图片或者直接把文件夹拖进来。支持jpg、png、webp、bmp、tiff这些常见格式数量不设上限。右侧设置里选好保存文件类型txt给人看csv丢进 Exceljsonl给程序处理排版解析方案默认是多栏-按自然段换行双栏排版的论文用这个最省心。点开始任务顶上的进度条会显示耗时和百分比列表里每张图单独记一行耗时和状态码。结果长什么样右侧记录区按文件名分段列出全部文字点任意一条可以把对应结果存成文件任务跑完还能勾选自动关机夜里挂着跑第二天收结果。处理带水印或页眉页脚的文档时在批量页的设置里进忽略区域编辑器按住鼠标右键在图上画几个矩形框把水印、LOGO 圈住任务就会跳过这些区域里的文字。用命令行把识别塞进脚本里习惯终端的话入口就是Umi-OCR.exeumi-ocr --screenshot唤起截图识别umi-ocr --clipboard识别剪贴板里的图片umi-ocr --path D:/images D:/one.png识别文件夹或指定图片可多路径混着传结果想要写进文件命令后面加上-- result.txt参数都能用前几个字母简写比如--sc就是--screenshot。详细用法在 命令行手册 里程序化调用可以看 HTTP接口手册。几个容易踩的坑特别大的图识别不全时去设置→文字识别→限制图像边长把数值调高默认 960 会对大图压缩。忽略区域是按整个文本块生效的不是按单个字画框时宁可画大一点把水印可能出现的位置全包进去。命令行和 HTTP 接口都依赖本地 HTTP 服务默认开启主程序没开着的时候这些指令是不灵的。截图OCR 页里支持粘贴在别处复制了图片直接粘贴进来就能识别不用另存文件。老显卡上如果出现截图闪烁、界面错位去全局设置→界面和外观→渲染器换个渲染方案或者关掉硬件加速。开头那摞合同从拖图到存成txt前后没超过十分钟。想继续往下走就去翻翻命令行手册和HTTP接口手册。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考