
Linux 离线 OCR 指南Umi-OCR 桌面入口、批量识别与二维码实战【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款开源免费的离线文字识别工具截图 OCR、批量 OCR、PDF 文档识别、二维码扫描与生成都在本地完成全程不经过网络。对处理内部文档、合同扫描件、代码截图等不宜上传云端的内容或者干脆不想依赖在线服务的用户来说这是一套完整的 Linux 桌面 OCR 工具链。 安装、启动与桌面入口配置从官方发布渠道拿到 Linux 版.7z发行包解压到固定目录比如/opt/Umi-OCR目录里有一个umi-ocr.sh启动脚本赋予执行权限后直接运行即可无需安装编译。想让软件常驻应用菜单再补一份桌面入口配置把下面内容存到~/.local/share/applications/umi-ocr.desktop之后在启动器里搜 Umi-OCR 就能启动。[Desktop Entry] TypeApplication NameUmi-OCR Comment开源离线 OCR 文字识别工具 Exec/opt/Umi-OCR/umi-ocr.sh Terminalfalse CategoriesUtility;Office;Graphics;首次启动时界面语言会跟随系统自动选择不顺手的话进全局设置在语言/Language下拉框改即可主题、字号也能一并调整。 截图 OCR框选屏幕直接出文字打开截图OCR标签页用快捷键框选屏幕区域识别结果实时出现在右侧记录栏。左侧图片预览上可以直接拖拽划选文字记录条目也能跨条划选批量复制。文本后处理提供多栏/单栏、自然段换行等方案多栏排版、竖排文字都能按阅读顺序输出代码截图选保留缩进方案还能保住空格结构。 批量识别工作流图片批量处理走批量OCR标签页导入 jpg、png、webp、tiff 等常见格式一次丢几百张也没有数量上限结果可导出为 txt、jsonl、md、csvExcel四种格式。遇到超大长图处理慢去页面设置把限制图像边长调高即可。整批图片带同一位置水印或页眉页脚时打开忽略区域编辑器按住右键画若干矩形把干扰文字框住识别时整块排除。 二维码识别与生成二维码标签页两边都能用。扫码侧支持截图、粘贴或拖入本地图片一张图里多个码也都能读出来生成侧输入文本直接产出二维码图片还可以指定纠错等级。⚡ 效率进阶命令行、别名与右键识别桌面操作之外Umi-OCR 暴露了命令行入口常用指令包括umi-ocr --screenshot截屏识别、--path指定图片或文件夹路径批量识别输出可用--clip进剪贴板、--output写文件umi-ocr --path ~/Pictures/scan --output ~/ocr_out.txt在~/.bashrc或~/.zshrc里加别名日常调用更短alias ocr/opt/Umi-OCR/umi-ocr.sh alias ocr-batchocr --path文件管理器集成则基于前面的.desktop条目做 MIME 关联在文件管理器中为图片类型注册用 Umi-OCR 识别的右键动作选完文件后脚本调用--path即可不同桌面环境的注册方式略有差异思路一致。 识别慢、点不动、排版乱症状速查症状排查动作点桌面图标无反应终端直接运行umi-ocr.sh看报错检查脚本可执行权限与依赖库是否齐全界面闪烁、UI 错位全局设置 → 渲染器切换渲染方案或关闭硬件加速批量任务排队很慢分批导入限制图像边长调高以处理超大长图结果顺序乱、换行怪换文本后处理方案多栏/单栏、自然段换行或保留缩进所有界面参数都落在发行版目录内的UmiOCR-data/.settings文件里换机迁移时整目录复制即可语言、主题、忽略区域等设置原样保留。Umi-OCR 把离线 OCR 的完整链路装进了桌面单张截图秒出文本整批扫描件本地跑完敏感内容不出本机。命令行细节与 HTTP 接口用法可以翻仓库里的 docs/README_CLI.md 和 docs/http/ 两篇手册。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考