Umi-OCR 完整指南:免费离线的批量图片转文字工具
2026/8/31 14:26:30 网站建设 项目流程

Umi-OCR 完整指南:免费离线的批量图片转文字工具

【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片,PDF文档识别,排除水印/页眉页脚,扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR

手边堆着一批扫描图、聊天截图或文档照片,想把里面的文字全部提取出来,又不想把图片传到网上?Umi-OCR 是一款免费开源的离线 OCR 软件,批量图片转文字、截图 OCR 识别、PDF 文档识别全部在本地电脑完成,文件不出机器,也没有按次计费。

能帮你解决什么

市面上大多数文字识别服务要么一次只能喂一张图,要么必须把图片上传到云端。Umi-OCR 的做法恰好相反:

  • 数据留在本地。所有识别都在你自己的电脑上运行,合同扫描件、含客户信息的截图这类敏感材料可以放心处理。
  • 一次喂一堆。批量页面没有图片数量上限,几百张图可以排成一个任务慢慢跑,跑完还能自动关机或待机。
  • 输出是"能读的文字",不是一堆乱序字符。内置的排版解析方案会区分单栏/多栏、横排/竖排,把识别结果按自然段整理好再给你。
  • 不止 OCR。同一个窗口里还能截图识别、读 PDF 扫描件、扫码和生成二维码,工具集齐后不用再装第二套软件。

3 分钟快速上手

先下载发布包(.7z 或 .7z.exe 自解压包均可),解压后双击Umi-OCR.exe启动,全程无需安装。第一次打开时界面语言会跟随系统自动切换,想改的话去"全局设置"里手动选。再切到"批量OCR"标签页,把图片选进来,点开始任务——识别结果就会出现在右栏,可以直接复制或导出为 txt、md、csv 等格式。

核心功能拆解

截图 OCR:从屏幕到文字只需一下

打开截图页后按快捷键框选屏幕任意区域,文字立刻出现在右栏记录里;在别处复制图片也能直接粘贴进来识别。左侧预览区支持鼠标划选复制,右侧记录可以编辑、多选合并复制。

批量 OCR:把"一张张处理"变成"一整个文件夹处理"

支持 jpg、png、webp、bmp、tif 等常见格式,支持结果导出为 txt、jsonl、md、csv(Excel)。对超大长图,可以在"页面设置 → 文字识别 → 限制图像边长"里调高数值再跑任务。

文档识别:PDF 扫描件变可搜索文档

支持 pdf、epub、mobi 等格式,既能对扫描件做 OCR,也能提取原有文本,最终可输出双层可搜索 PDF——视觉上还是原扫描件,文字却可以被 Ctrl+F 搜索。页眉页脚干扰同样可以用忽略区域排除。

二维码:扫码和生成都在一页

拖入图片即可识别二维码或条形码,支持一图多码和 19 种码制;反过来输入一段文本也能生成二维码图片,还能调纠错等级。

一个真实场景:整理一批带水印的会议截图

假设你有 40 张会议记录截图,每张右下角都带水印,顶部有日期条,你最终需要一份干净的 txt 纪要。

操作路径是这样的:进入批量 OCR 页,把 40 张图一次性导入任务列表;在右栏设置里打开"忽略区域"编辑器,按住右键把水印和顶部日期条各框一个大矩形——只有完全落在框内的文本块会被跳过,正文不受影响;排版方案选"多栏-按自然段换行"(普通文档选"单栏-按自然段换行"),输出格式选 txt,启动任务。任务跑完后,每份结果单独成文件,也可以合并导出。整个过程不用离开这台电脑,也不需要联网。

进阶小妙招

  1. 忽略区域画大一点。矩形框要完全包裹住水印可能出现的所有位置,且它是按"整个文本块"生效的——框住半个词也不会生效,宁大勿小。
  2. 识别语言别只勾一个。中英混排的截图就同时勾选中文和英文,否则识别质量会明显下降;竖排文字还需要引擎本身支持。
  3. 界面闪烁或 UI 错位时切渲染器。软件默认用显卡加速渲染,如果截屏时闪屏,去"全局设置 → 界面和外观 → 渲染器"换一种渲染方案,或关掉硬件加速即可。

常见问题速解

必须联网才能用吗?不用。Umi-OCR 完全离线运行,引擎和语言库都随发布包一起给到本地,断网状态下批量转文字照常工作。

一次能放多少张图?没有硬性上限,几百张也没问题。机器会忙一阵,所以任务页支持设置"完成后自动关机/待机",睡前排好任务再睡觉是常见用法。

识别出来的顺序是乱的怎么办?别手动拼,先用"文本后处理"里的排版解析方案(多栏/单栏、按自然段/总是换行/无换行)整理;代码截图选"单栏-保留缩进"可以保住缩进和空格。

相关资源

  • 项目总览与使用说明:README.md
  • 命令行调用手册(适合自动化批处理):docs/README_CLI.md
  • HTTP 接口文档(把 OCR 能力接进自己的程序):docs/http/README.md
  • 翻译相关文件目录:dev-tools/i18n/

Umi-OCR 的价值不在功能多,而在于把"截图、图片、PDF 转文字"这件高频小事做成了一次到位的离线方案——解压、导入、开始,三步之后你拿到的就是整理好的文本。

【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片,PDF文档识别,排除水印/页眉页脚,扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询