
一次搞定的免费离线OCRUmi-OCR 把截图、图片和扫描PDF都变成文字【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR你有没有过这样的经历截图里有一段关键说明想复制却复制不出来只能一个字一个字敲进文档或者手里攒了几十份扫描版合同想找一句条款只能在图片里靠肉眼翻。Umi-OCR 是一款免费开源的离线 OCR 软件解压之后直接运行识别过程全部在本机完成文档不经过任何网络。它支持 Windows 7 x64 与 Linux x64覆盖截图识别、批量图片文字提取、PDF 扫描识别和二维码扫描生成这几件最常用的事。三步跑起来第一步获取程序。仓库提供长期维护的发布包.7z或免装压缩软件的.7z.exe自解压包从源码获取的话执行git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR也可以。第二步Windows 上双击Umi-OCR.exeLinux 上运行umi-ocr.sh没有安装步骤。第三步打开后界面语言会跟随系统自动切换直接切到截图OCR标签页按一次截图快捷键你就完成第一次识别了。想从截图里抠出一段文字打开截图OCR标签页按下快捷键屏幕变暗框选你要的区域松手后文字立刻出现在右侧记录栏选中复制即可全程不到三秒。左侧的预览图上可以直接用鼠标划选复制识别记录栏里的文字也能编辑、可以多条记录合并划选。如果你是在别处复制过一张图片粘贴进来同样能识别。比较有意思的是文本后处理 - 排版解析方案识别多栏排版的文章时选多栏-按自然段换行段落顺序会按阅读习惯整理如果是代码截图选单栏-保留缩进缩进和空格都能原样保留这对从教程截图里搬代码非常实用。把一整个文件夹的图片批量转成文字打开批量OCR标签页选择图片jpg、png、webp、bmp、tiff 等常见格式都能进数量没有上限几百张一起丢进去任务照常跑。列表上能看到每张图的耗时和识别置信度顶部有进度条右侧记录栏滚动显示各张的识别结果。任务完成后结果可以存成 txt、jsonl、md或者 csvExcel四种格式方便后续整理。如果你要识别的图片像素特别大记得去页面的设置→文字识别→限制图像边长把数值调高否则大图会被压缩影响效果。把扫描版PDF变成可以搜索的文档文档识别标签页处理 pdf、xps、epub、mobi、fb2、cbz 这几类文件。对原生 PDF 它直接提取文本对扫描版它逐页 OCR还能输出双层可搜索 PDF——看起来还是原来的扫描件但选中文字、全文检索都正常这是处理纸质档案数字化时很省事的一点。扫描件如果每页都有页眉页脚可以用忽略区域把那些位置框掉文字就不会混进结果里。文件多的话还能设置任务完成后自动关机晚上挂机跑一批第二天起来收结果。亮点深挖离线、可换引擎、还能被脚本调用Umi-OCR 的识别能力来自插件化的 OCR 引擎默认带 RapidOCR 和 PaddleOCR 两套在全局设置里随时切换把新引擎的插件文件夹放进UmiOCR-data/plugins目录重启也能用引擎特点更适合RapidOCR兼容性好安装即用日常截图、简单页面、老机器PaddleOCR精度和语言覆盖更好正式文档、多语言混排它不只给人点按钮用。命令行和 HTTP 接口让它能被脚本调用比如umi-ocr --screenshot触发一次截图识别umi-ocr --path D:/scans则直接扫完一个文件夹文件夹里的子目录也会递归搜索。详细说明在 命令行手册 和 HTTP接口手册 里后者还支持把识别服务暴露到局域网给其他设备用。需要留意的是文档里明确写了并发支持较弱拿它当高并发服务用不合适跑任务型脚本倒是绰绰有余。 几条提效小技巧第一次用就留意界面语言对不对不对的话去全局设置→语言手动改繁中、英文、日语都在里面。批量任务如果总被水印干扰进批量页右栏的忽略区域编辑器按住右键把水印位置框成矩形框内的文字块整块忽略。截图时遇到界面闪烁或 UI 错位多半是显卡加速渲染的锅在界面和外观→渲染器里换个方案或关掉硬件加速试试。识别大图前先把限制图像边长调大。最后大批量文件配任务完成后自动关机比自己盯着省事得多。它不适合谁说点实话Umi-OCR 只支持 Windows x64 和 Linux x64如果你是 macOS 用户它目前没有对应版本它的 HTTP 接口对并发不友好也不适合作为生产环境里的识别服务对超精细的手写体和复杂表格云端商业 OCR 往往仍更准。如果你需要在 Mac 上工作或要跑高并发的在线服务它可能不是最合适的选择。但对偶尔截屏取字、攒批图片转文字、把手头扫描件变成可搜索 PDF这类本地场景它免费、安静、不上传任何东西这几件事做得足够可靠。工具的价值在于你真的会天天打开它。去下载一份解压跑起来下次再遇到截图里复制不出的文字三秒钟就该有答案了。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考