十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Umi-OCR 使用指南:免费离线的OCR软件,从一张截图到整本PDF

Umi-OCR 使用指南:免费离线的OCR软件,从一张截图到整本PDF Umi-OCR 使用指南免费离线的OCR软件从一张截图到整本PDF【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR凌晨对着屏幕一份扫描合同里的文字你想复制却发现那只是一张图片剪贴板纹丝不动。把文档上传到在线识别网站又能解决吗隐私和网速都成了顾虑。Umi-OCR 是另一条路一款免费、开源的离线OCR软件识别全部在本机完成不联网、不上传解压就能跑Windows 与 Linux 通用。它的定位很直接——把「图片里的字」变成「能编辑、能搜索的文字」并且一次覆盖截图、批量导入、扫描件、二维码四类最常用场景。下面按「先跑通、再分场景、最后谈技巧与集成」的顺序带你过一遍。解压即用三步完成第一次识别Umi-OCR 的发布包是.7z压缩包或.7z.exe自解压包后者在没有压缩工具的电脑上也能直接展开。它无需安装解压后双击Umi-OCR.exe即启动官方提供 Windows 7 x64 与 Linux x64 版本。启动后建议先到「全局设置」页把基础项调好语言首次运行会跟随系统自动切换也可在全局设置 → 语言/Language手动指定支持简体中文、繁体中文、英语、日语等。主题与字体内置多套亮/暗主题还能调整界面字号与字体。快捷方式与自启可一键添加桌面/开始菜单入口并设置开机自启。调好之后打开「截图OCR」标签页按下快捷键截一块区域右侧就会跳出识别出的文字。到这里你其实已经完成了第一次完整的文字识别。把屏幕上的文字一键抠出来截图识别是最轻量的用法打开「截图OCR」标签页用快捷键唤起截图框选范围后即出结果。它的几个细节比较实用高亮定位识别出的文字会在图片上高亮方便核对哪些被认出来、哪些没有。右键快捷操作可复制文字、复制整张图片、显示/隐藏文字也能划选复制。记录可编辑右侧识别记录支持直接改写并可划选多条一起复制。贴入也识别在别处复制了一张图片直接粘贴进来即可识别。更关键的是「文本后处理 → 排版解析方案」它决定输出文字的换行与顺序多栏-按自然段换行多数场景适用自动识别多栏并按自然段换行。单栏-保留缩进专门用于代码截图保留行首缩进与行内空格。其余还有「总是换行 / 无换行」等预设且都能自动处理横排与从右到左的竖排竖排仍需引擎本身支持。对代码、日志这类内容「保留缩进」方案能尽量还原原始格式。整目录的图片一次批量识别当对象从「一块截图」变成「几百张图片」就轮到批量页。把本地图片或整个文件夹拖进来即可要点如下常见格式都收jpg、jpe、jpeg、jfif、png、webp、bmp、tif、tiff。没有数量上限一次可导入数百张图片排队处理。进度与置信度可视任务进度条清晰每张图会标出识别耗时与准确度方便挑出可疑结果。多种输出结果可存为txt、jsonl、md、csv(Excel)。长图大图若识别像素极大的长图可在「页面设置 → 文字识别 → 限制图像边长」中调高数值。省电收尾支持任务完成后自动关机或待机适合夜间挂机处理。把扫描件PDF转成可编辑、可搜索的文档「文档识别」标签页面向扫描文档一次可处理多个文件支持pdf、xps、epub、mobi、fb2、cbz。它的价值在于对纯图片扫描件做OCR或直接抽取已有文本层。输出双层可搜索PDF既有视觉层又叠了文本层全文可检索、可复制而不是一张死图。同样支持忽略区域用来排除页眉页脚。支持任务完成后自动关机/休眠。顺手把二维码也收了除了文字Umi-OCR 把二维码与条形码也纳入同一套流程扫码截图、粘贴或拖入本地图片即可读取支持一图多码。生成输入文本生成二维码图片可指定纠错等级等参数。协议覆盖识别与生成共支持19 种协议涵盖QRCode、DataMatrix、Aztec、PDF417、Code128、Code39、EAN13等。识别不准先调这三处遇到效果不理想的结果通常不必换工具先把下面三件事理顺预处理图片增强文字与背景的对比、裁掉无关区域、控制分辨率、校正倾斜都能明显提升识别率。设置忽略区域当文档带水印、印章或页眉页脚时在批量识别页右栏打开忽略区域编辑器按住右键画多个矩形框框内文字会被整体忽略。框尽量画大些把水印可能出现的位置都包住。注意只有完全落在框内的整块文本会被忽略而不是单个字符。选对引擎内置 PaddleOCR 与 RapidOCR 两种引擎可在「切换OCR插件」中调整。一般规律是——追求精度、处理正式文档或多语言混合时偏向 PaddleOCR追求吞吐、批量处理大量简单文档时偏向 RapidOCR。接入你的工作流命令行与HTTP接口对进阶使用者Umi-OCR 提供了命令行与 HTTP 两种外部调用方式方便嵌进自动化脚本。架构上它采用标签页 插件的组织方式OCR 引擎、后处理、格式转换等都以插件形态存在可按需切换。命令行入口就是主程序常用指令如下可用umi-ocr --help查看全部umi-ocr --path D:/scans # 识别指定文件或整个文件夹中的图片 umi-ocr --screenshot --output test.txt # 截图并把结果写入文件HTTP 接口默认在本地环回开启可用于跨进程调用、获取函数返回值等场景。完整参数请查阅 命令行手册 与 HTTP 接口手册。翻译、插件与参与Umi-OCR 的本地化通过 Weblate 平台协作已贡献的语言包括简体中文、繁体中文、英语、日语、葡萄牙语、俄语等。项目同时开放插件机制允许扩展新的 OCR 引擎、文本后处理逻辑、输出格式等能力。如果你也想参与路径有四条提 Issue 反馈问题、通过 Weblate 贡献翻译、编写插件扩展功能、提交 Pull Request 改进代码。项目还在持续规划中后续方向包括表格图片转 Excel、固定区域识别、离线/图片翻译、历史记录、GPU 离线识别等欢迎持续关注。小结Umi-OCR 把「免费、离线、批量」三件事做在同款软件里截图识别、批量图片识别、扫描件 PDF 转双层可搜索 PDF、二维码识别与生成配合 PaddleOCR / RapidOCR 双引擎与多语言界面足以覆盖个人与团队的日常文字识别需求。它解压即用、不依赖网络既适合偶尔抠一张图的临时需求也适合整目录、整批文档的数字化任务。若你正需要一款离线文字识别、批量图片识别、PDF 转可编辑文档的工具可以从文档识别与命令行手册开始把 Umi-OCR 接进你的工作流。核心关键词离线OCR软件、免费OCR、截图文字识别、批量图片识别、PDF转可搜索PDF、二维码生成、开源OCR、命令行OCR、双引擎OCR。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表