
Umi-OCR三步把扫描 PDF 变成可搜索文档的免费离线 OCR【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR读扫描版论文想抄一句话文字选不中、CtrlF 也搜不到。Umi-OCR 是一款免费、全程离线的 OCR 文字识别工具把截图、批量图片、扫描 PDF 直接变成可复制、可搜索的文字识别过程全部在本地完成。这是什么工具解压即用的免费离线 OCR是什么开源免费的 OCR 软件全程不联网、不上传文档不为识别次数付费怎么跑Windows 7 x64 及以上用Umi-OCR.exeLinux x64 用umi-ocr.sh解压后双击即用无需安装内置语言库简中、繁中、英文、日文等多国语言引擎自带 Rapid-OCR兼容性好与 Paddle-OCR速度稍快两种可选支持输入jpg、png、webp、tif 等图片以及 pdf、xps、epub、mobi、fb2、cbz 文档从启动到第一次出识别结果5 步从项目发行版页面下载.7z压缩包并解压需要源码则git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR双击Umi-OCR.exe启动Linux 用umi-ocr.sh首次运行界面语言按系统自动切换打开截图OCR标签页按快捷键框选屏幕区域等识别完成文字自动进剪贴板右侧识别记录可编辑、可划选需要落盘的文件走批量OCR或文档识别标签页导出 txt、csv 或双层 PDF能力拆解四个标签页各管一类取字任务截图 OCR从屏幕任意位置取字网页、PPT、课件里禁止复制的文字截一张图就能拿走。操作路径截图OCR标签页 → 按快捷键截屏Esc 取消→ 左侧预览划选原文复制右侧识别记录里编辑文字。在别处复制了图片直接粘贴进 Umi-OCR 即可识别代码截图把文本后处理设为单栏-保留缩进行首空格和缩进都会保留多次截图的结果会累加进识别记录最后一次性划选复制批量 OCR几百张图片排队识别一文件夹扫描件、截图要批量转文字交给任务队列跑就行。操作路径批量OCR标签页 → 拖入图片jpg、png、webp、tif 等→ 点开始任务 → 完成后把结果导出为 txt、jsonl、md 或 csv(Excel)。图片有固定位置水印时在右侧设置栏进入忽略区域编辑器按住右键画矩形框框内文字不会出现在结果里要进 Excel 汇总的选 csv 导出格式Excel 直接打开长任务可开启任务完成后自动关机/待机睡前挂着跑完文档识别把扫描 PDF 变成可搜索文档扫描版 PDF 搜不到也复制不了重新录入要几个小时这个标签页直接输出双层可搜索 PDF。操作路径文档识别标签页 → 导入 PDF也支持 xps、epub、mobi、fb2、cbz→ 识别完成后导出。输出的双层 PDF 原扫描外观保留上面叠一层透明文字支持全文检索、CtrlF 定位和直接复制。用忽略区域排除页眉页脚文字框尽量包住可能出现的全部位置可设任务完成后自动关机/休眠原 PDF 自带文本层时可直接提取不走识别二维码标签页识别与生成都在一处图里的二维码、条形码不方便用手机扫直接读出来反过来输入文本也能生成码图片。操作路径二维码标签页 → 拖入图片、粘贴或截图读取内容生成侧输入文本设纠错等级和尺寸后导出图片。支持一图多码覆盖 QRCode、EAN13、PDF417 等 19 种编码协议也可用命令行调用umi-ocr --qrcode_read D:/xxx.png参数见命令行手册端到端工作流三条从扫描件到可检索的完整路径一学期扫描件变成可检索文献库。把百页扫描 PDF 导入文档识别识别语言设为中文忽略区域框掉页码和页眉开始任务。完成后导出双层可搜索 PDF之后在 PDF 阅读器里直接 CtrlF 定位图 3或参考文献里的一句话。200 张发票截图汇总进 Excel。发票截图全部拖入批量OCR标签页文本后处理选单栏系列导出格式选 csv开始任务。跑完用 Excel 打开 csv金额、日期两列一求和不用手工录入。把识别挂进自己的脚本。开发者两条路让 Umi-OCR 常驻脚本走HTTP接口调用或命令行umi-ocr --path识别整个文件夹的图片--output写文件、--clip进剪贴板参数详见命令行手册。设置与调优速查影响识别效果的几个选项文本后处理截图/批量OCR标签页 → 多栏版面选多栏-按自然段换行段落顺序自动理顺竖排版面同一预设也能处理忽略区域批量识别页右侧设置栏 → 编辑器 → 右键画框框得越完整水印和页眉页脚去得越干净限制图像边长批量识别页 → 设置 → 文字识别 → 调高数值避免大图、长图被压缩导致识别不全OCR 引擎全局设置 → 切换插件Rapid-OCR 求兼容Paddle-OCR 求稍快的速度识别语言文字识别设置 → 指定文档主要语言多语言资料按主语言切换后再识别界面语言/主题全局设置 → 语言、主题首次运行自动匹配系统可随时手改高频问题5 个常见情况问多栏版面的识别顺序是乱的。答引擎按文本块位置输出文本后处理里选多栏系列预设会把顺序理顺。问结果里总有水印文字。答忽略区域没框到批量 OCR 的忽略区域编辑器里把矩形框画大包住水印可能出现的全部位置。问长图、大图只识别出一部分。答默认限制图像边长会压缩大图识别前把数值调高即可。问截图闪烁、界面错位。答显卡加速渲染不兼容全局设置 → 界面和外观 → 渲染器换渲染方案或关掉硬件加速。问不联网能用吗。答全程本地离线识别语言库随发行版内置不需要下载模型或联网。Umi-OCR 是一款解压即用的免费离线 OCR 工具截图取字、批量图片文字提取、三步把扫描 PDF 变成可搜索文档。去项目发行版页面下载一份把积压的扫描件跑完一批遇到 bug 或功能建议直接到项目里提 Issue。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考