十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Umi-OCR 评测:免费离线OCR工具,一张截图、整本PDF都能识别

Umi-OCR 评测:免费离线OCR工具,一张截图、整本PDF都能识别 Umi-OCR 评测免费离线OCR工具一张截图、整本PDF都能识别【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 解压即用截图识别、批量图片识别、PDF扫描件识别全部离线完成不经过任何云服务识别数据留在自己电脑里。它开源免费界面按标签页组织每个功能对应一页。下面按先干什么、再干什么的顺序把它的用法和坑一次讲清。软件装好后你能得到什么Umi-OCR 支持 Windows 7 x64 和 Linux x64发布包解压后双击Umi-OCR.exe启动没有安装步骤。功能全景一张表模块能做什么适合的场景截图OCR快捷键唤出截图识别也支持粘贴图片进来快速抓取屏幕上的文字、代码批量OCR拖入整文件夹jpg/png/webp/bmp/tif 等无数量上限大批量扫描图片转文本文档识别pdf、xps、epub、mobi 等格式可输出双层可搜索PDF纸质档案电子化二维码识别二维码/条形码19种协议、一图多码也能从文本生成二维码图片扫码、批量生成内部二维码外部调用命令行、HTTP接口自动化脚本、系统集成两个值得留意的细节多语言首次启动按系统语言自动切换界面也可以在全局设置→语言里手动改支持繁中、英语、日语等。引擎可切换内置 RapidOCR兼容性好和 PaddleOCR速度稍快两套离线引擎在全局设置里切换。第一次使用截图识别只要三步打开「截图OCR」标签页然后按下截图快捷键在屏幕上划选区域不截图的话把别处复制的图片直接粘贴进来也可以几秒后出结果左栏是图片预览鼠标划选就能复制右栏是识别记录文字可直接编辑选中多条记录可一起复制记录栏顶部有自动滚动开关连续截图时不用手动往下翻影响结果质量的关键是「文本后处理-排版解析」。引擎原始输出只是一堆文字块排版方案负责把它们排成能读的顺序。常用预设多栏-按自然段换行适合大部分场景自动识别多栏布局、按自然段重组单栏-保留缩进给代码截图用的保留行首缩进和行内空格多栏-总是换行每句都换行适合排版密集的文档拿代码截图举例选「单栏-保留缩进」后缩进结构原样保留直接粘进编辑器就能用整文件夹批量识别的做法切到「批量OCR」标签页把文件夹或若干图片拖进去点开始任务。支持输入jpg, jpe, jpeg, jfif, png, webp, bmp, tif, tiff识别结果可保存为输出格式适合场景txt最通用人读jsonl结构化程序处理md保留排版文档整理csvExcel表格数据导入表格软件这个页面有两个容易漏掉的功能忽略区域扫描件上水印、LOGO 位置固定时很好用。在右栏设置进忽略区域编辑器按住右键画一个或多个矩形框框内的文字会在任务中按整个文本块跳过。框尽量画大把水印可能出现的位置全包进去。任务完成后自动关机/待机挂机跑一整夜大文件集的场景勾上这个能省电。要识别像素很大的长图时先把「页面设置→文字识别→限制图像边长」的数值调高再开始任务否则可能被截断处理。PDF扫描件识别与双层可搜索PDF「文档识别」标签页接收pdf, xps, epub, mobi, fb2, cbz文件两条路径扫描件走OCR可以输出双层可搜索PDF——文字层可搜索可复制图像层保留原貌。这是把纸质档案电子化最省事的做法。已有文字层的PDF直接提取原文比跑OCR快得多。和批量页一样支持设置忽略区域常用在排除页眉页脚和页码。也支持任务完成后自动关机/休眠。二维码既能扫也能生成「二维码」标签页双向都有识别截图、粘贴或拖入图片读出其中的二维码和条形码支持一图多码协议覆盖 QRCode、EAN13、DataMatrix、PDF417 等19种。生成输入文本生成二维码图片协议和纠错等级都可以调。外部调用命令行和HTTP接口想把自己的脚本接进来Umi-OCR 提供两个入口命令行主程序Umi-OCR.exe本身就是入口截图并复制结果到剪贴板一行指令就够参数支持前缀简写--screenshot可简写为--scumi-ocr --screenshot --clip umi-ocr --path D:/img1.png -- result.txtHTTP接口在「全局设置→服务」里允许HTTP服务默认开启主机选仅本地即可之后按接口文档从自己的程序里调图片OCR、文档识别、二维码等接口。命令行靠本地回环的HTTP连接把指令传给后台进程所以指令没反应时先确认HTTP服务是开着的。常见问题与解决截图时界面闪烁、UI错位现象截屏瞬间屏幕闪、界面元素错位。 原因界面默认用显卡加速渲染个别显卡驱动兼容性不好。 解决全局设置→界面和外观→渲染器换一种渲染方案或关闭硬件加速。命令行指令执行无反应现象跑umi-ocr --screenshot等指令没有动作。 原因命令行依赖本地HTTP服务通信服务没开时指令到不了处理进程。 解决全局设置页「服务」部分允许HTTP服务再试一次。超长图、大图识别不完整现象像素很大的长图识别结果缺内容。 原因软件默认限制图像边长防止内存爆掉。 解决页面设置→文字识别调高「限制图像边长」后再开始任务。关闭软件后进程残留现象退出时任务管理器里还有 Umi-OCR 进程。 原因关闭瞬间有HTTP客户端未断开连接网络子线程在等连接释放。 解决等所有HTTP连接自行关闭或在任务管理器里手动结束进程。功能迭代情况见 更新日志指令与接口细节查 命令行手册 和 HTTP接口手册。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表