十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Umi-OCR 免费离线 OCR 软件完整指南:从截图到批量识别 5 分钟上手

Umi-OCR 免费离线 OCR 软件完整指南:从截图到批量识别 5 分钟上手 Umi-OCR 免费离线 OCR 软件完整指南从截图到批量识别 5 分钟上手【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款开源免费的离线 OCR 文字识别软件解压即可运行不联网也能把截图、图片、PDF 里的文字提取成可复制的文本。适合你吗先说清楚它适合干什么屏幕上有字但复制不了网页图片、聊天记录里的代码、视频字幕框一下就能变成文本有一堆图片要转文字几十张、几百张截图或扫描件拖进去批量处理结果导出成 txt、csvExcel、md、jsonl手里只有 PDF 扫描件想在里面搜索、复制文字它可以生成双层可搜索 PDF——也就是图片下面垫了一层真实文字既能看图又能检索。一个明确的局限它的识别引擎全部跑在你本机速度取决于你的 CPU处理几百张高清大图会比云端接口慢一些另外它目前支持 Windows 7 x64 和 Linux x64Mac 暂不支持。拿到第一个结果3 分钟跑通第一次截图识别从项目的发布渠道下载.7z压缩包仓库里也有 Umi-OCR_Rapid_v2.1.5.7z解压不需要安装双击Umi-OCR.exe启动Linux 下运行umi-ocr.sh。首次打开时界面语言会跟随你的系统自动切换打开截图OCR标签页按下截图快捷键用鼠标框选屏幕上的文字松开鼠标识别结果立刻出现在右侧记录栏直接划选复制即可。如果你刚才在别处复制过一张图片也可以跳过框选直接把图片粘贴进 Umi-OCR 进行识别。从按下快捷键到复制文字整个过程通常不超过 10 秒。真实场景演练场景一代码截图还原缩进原样保留目标把一张代码截图变成可以直接运行的代码不想逐字重敲。操作截图后在文本后处理的排版解析方案里选单栏-保留缩进这个模式会原样保留行首缩进和行中空格然后复制结果。得到什么带缩进、空格的代码文本粘贴进编辑器就能用。场景二一文件夹图片批量转文字目标把整个文件夹里的扫描件、照片一次性转成文本。操作在批量OCR标签页把图片全部拖进去点开始任务。支持 jpg、png、webp、bmp、tif 等常见格式没有数量上限。得到什么每张图片对应一条识别记录可整体导出为 txt、jsonl、md 或 csvExcel。任务完成前软件会显示进度和每张的耗时完成时还可以设置自动关机/待机睡前挂上任务第二天收结果。场景三PDF 扫描件变成可搜索文档目标把整本扫描版 PDF 变成能搜索、能复制的电子版。操作在文档识别标签页导入 pdf、epub、mobi 等文件选择输出为双层可搜索 PDF。得到什么一个既能显示原页面图像、又能全文检索和复制文字的新 PDF纸质资料直接变成电子档案。三个让人眼前一亮的细节忽略区域图片角落有水印、页眉页脚时在编辑器里用鼠标框出这些位置识别时整个区域被跳过。它替我省的是——不用再事后一行行删水印混进结果的脏字符排版解析多栏排版的页面直接识别文字顺序容易跳来跳去。选多栏-按自然段换行方案它会按阅读顺序自动重排横排、竖排从右到左都能处理二维码二合一既能扫码截图、粘贴或拖入图片一图多码也能输文本生成二维码图片还支持 19 种码制省去另外装一个扫码工具。想要更多把识别能力接进你的工作流界面操作之外Umi-OCR 还留了两条自动化通道命令行模式支持--path、--output、--clip等参数一行命令就能批量识别一个文件夹含子文件夹并写入文件配合脚本或定时任务可以无人值守。示例umi-ocr --path 扫描件目录 --output 输出.txtHTTP 接口让其他程序远程调用图片识别、文档识别、二维码生成等功能默认只监听本地改到局域网地址后即可部署到服务器使用。完整的参数和接口说明分别整理在 docs/README_CLI.md 和 docs/http/README.md进阶时直接翻这两份文档即可。另外全局设置里可以一键切换中、英、日、俄等十多种界面语言多个亮/暗主题和字体大小也都能调。常见坑命令行没反应命令行依赖软件内置的 HTTP 服务默认开启。在全局设置页确认服务处于开启状态主机选仅本地即可截图时屏幕闪烁、界面错位多半是渲染器兼容问题到全局设置 → 界面和外观 →渲染器换一个渲染方案或关闭硬件加速超大长图识别失败到批量页面设置 → 文字识别 → 限制图像边长把数值调高再跑一次。跑通第一次截图识别后挑几张开着水印的图片试试忽略区域就能体会批量任务的省心了。遇到 bug 可以提 Issue 反馈项目也长期欢迎译者参与界面多语言翻译从 CHANGE_LOG.md 可以看到每个版本的更新细节。让 Umi-OCR 成为你桌面上随取随用的文字提取工具就从今天的第一张截图开始吧。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表