电脑软件免费

Umi-OCRv2.1.5

开发者:hiroi-sora

开源免费的离线 OCR 工具:截图/批量/PDF 识别、二维码扫描,本地 CPU 运行、不上传数据。

开源、免费、离线——把图片/截图/PDF 里的文字"抠"出来这件事,Umi-OCR 做到极简、极省心。

访问官网
WindowsLinuxOCR文字识别截图识别PDF识别二维码开源免费离线
发布时间:2026/08/18
浏览 3 次
Umi-OCR 预览

界面预览

核心功能

  • 截图 OCR:快捷键框选屏幕任意区域,秒出可复制文字
  • 批量 OCR:拖入一批图片自动排队识别,输出 txt / jsonl / md / csv
  • 文档识别:PDF / XPS / EPUB / MOBI 转双层可搜索 PDF(保留原图 + 可选中文字)
  • 二维码扫描:支持 19 种协议,含 QR / 条形码 / Aztec / DataMatrix
  • 二维码生成:可生成 19 种协议 + 自定义纠错等级
  • 忽略区域:批量识别时框选水印 / LOGO / 页眉页脚自动跳过
  • 多语言界面:中、英、日、繁中等十几种语言自动切换
  • 文本后处理:段落合并 / 单行多行 / 竖排 / 不做处理
  • 命令行与 HTTP 接口:可写脚本、被其他软件嵌入
  • 开机自启、窗口置顶、标签页锁定等便捷设置

适合谁用

["运营 / 自媒体:把截图、扫描件、图片里的文字"抠"出来""学生 / 研究者:处理扫描版教材、文献、笔记""老照片 / 老书 / 旧 PDF 抢救:转可搜索可复制的电子版""隐私敏感岗位:处理合同 / 身份证 / 内部资料不传云端""低配 / 老电脑用户:CPU 即可不需要显卡""会写脚本的开发者:命令行 + HTTP 接口能嵌进自己的工具链"]

优点

  • 完全免费、开源(MIT 协议),无广告无内购
  • 完全离线:图片不传任何服务器,隐私友好
  • CPU 即可运行,不需要显卡,对老机器友好
  • 原生简体中文界面,从 Win7 到 Win11 一直支持
  • GitHub 46k+ Star,持续维护到 v2.1.5(2025 三周年)
  • 支持批量 OCR + PDF 转可搜索 PDF + 二维码等高频功能
  • 忽略区域功能可批量跳过水印 / LOGO / 页眉页脚
  • 提供命令行 + HTTP 接口,可被脚本与其他软件嵌入

不足

  • 不做表格识别(导出 Excel):官方远期计划,暂未实现
  • 不做公式识别:issue #254 长期未完工
  • 不支持 macOS:仅 Windows x64 与 Linux x64
  • Paddle 引擎不兼容奔腾 / 赛扬 / 凌动 / Atom CPU(需用 Rapid)
  • 截图 OCR 需要按快捷键 / 拖图,比在线工具多一步操作(换来完全离线)

璇垣判断

在线 OCR 工具要么收费、要么传云端、要么带水印。Umi-OCR 完全相反:MIT 协议、CPU 即可、原生简中、46k+ Star、模型本地跑——把"图片→文字"这件具体的事做到极致。

不太适合

需要专业表格识别(导出 Excel)、数学公式识别、macOS 平台,或对版式还原有严苛要求——这些请用 ABBYY、Mathpix、Adobe Acrobat Pro 等专业商业软件。Umi-OCR 专注"识别出文字",不擅长"还原原貌"。

开始前须知

  • ·完全免费开源(MIT 协议),个人与商用均无限制、无广告、无内购。
  • ·完全本地运行:图片不传任何服务器;首次启动下载约 100MB 模型后即可断网使用。
  • ·无需账号
  • ·支持中文
  • ·上手门槛低

Umi-OCR 是一款免费、开源、完全离线的桌面 OCR 工具。基于 PaddleOCR 与 RapidOCR 引擎,支持截图识别、批量图片识别、PDF 转可搜索文档、二维码扫描/生成等。CPU 即可运行,不依赖显卡,对老旧机器友好。

它能做什么

  • 截图 OCR:快捷键框选屏幕任意区域,秒出可复制文字。
  • 批量 OCR:拖入一批图片,自动排队识别,导出 txt / jsonl / md / csv。
  • 文档识别:PDF / XPS / EPUB / MOBI,输出双层可搜索 PDF(保留原图 + 可选中文字)。
  • 二维码:扫描屏幕中 19 种协议(含 QR / 条形码 / Aztec / DataMatrix 等),也能生成。
  • 忽略区域:批量识别时框选水印 / LOGO / 页眉页脚,自动跳过。
  • 多语言界面:中、英、日、繁中等十几种语言,首次启动按系统语言自动切换。
  • 命令行与 HTTP 接口:可写脚本、被其他软件嵌入调用。

它不能做什么

  • 不做表格识别(导出 Excel):v2.1 之前一直标"远期计划",暂未实现。
  • 不做公式识别:复杂数学公式认不出(issue #254 长期未完工)。
  • 不做版式还原:多栏 / 竖排能识别出文字,版面顺序可能需后处理。
  • 不支持 macOS:仅 Windows x64 与 Linux x64(Debian / Ubuntu 测试通过)。

开始前需要知道

  • 完全免费、开源(MIT 协议),GitHub 46k+ Star,无广告无内购。
  • 完全离线:首次启动自动下载约 100MB 识别模型,之后不联网;图片不传任何服务器。
  • CPU 即可,不需要显卡——对老电脑 / 低配本子友好。
  • 原生简体中文,从 Windows 7 x64 一直支持到 Windows 11。
  • 两种引擎:Paddle(快、占内存,不兼容奔腾/赛扬/凌动)与 Rapid(稍慢、内存低、兼容性好)。低配机器选 Rapid。
  • 最新稳定版 v2.1.5(三周年),本文截图来自官方 README 真实界面(v2.0.0 前后),v2.1.x 整体界面一致。

首次使用建议

  1. 去 GitHub Releases 选对应系统的安装包:Windows 选 Paddle 或 Rapid,Linux 选 tar.xz。
  2. 双击 .7z.exe 自解压,进入文件夹双击 Umi-OCR.exe 启动——免安装、不写注册表。
  3. 首次启动会自动下载约 100MB 识别模型,请保持联网,之后即可完全离线。
  4. 按默认 Win+Alt+C 截图 OCR;切到"批量 OCR"标签处理多图;切到"批量文档"处理 PDF。

资源入口

官网入口请使用页面顶部“访问官网”;以下为补充资源,网盘链接不代表官方下载。

GitHub Releases(Windows + Linux + Docker)
官方文档 / 命令行手册

评论区

欢迎分享真实使用体验。评论先审后发,请勿发布广告、联系方式或攻击性言论。

评分(可选)
0/500

加载评论中…

相关工具

免费Ventoy
Ventoy
WindowsLinux电脑端

免费开源的多 ISO 启动盘制作工具:一次安装,拖入即启动,免格式化。

浏览 20·更新 08-21官网
电脑软件查看档案
免费Joplin
Joplin
WindowsmacOSLinux电脑端

开源、免费、跨平台的 Markdown 笔记工具,支持端到端加密与多后端同步。

浏览 6·更新 08-20官网
电脑软件查看档案
免费Upscayl
Upscayl
WindowsmacOSLinux电脑端

开源、免费的本地 AI 图像放大工具:跨 Win/Mac/Linux,把模糊图一键变清晰,本地运行不传图。

浏览 0·更新 08-20官网
电脑软件查看档案
免费LosslessCut
LosslessCut
WindowsmacOSLinux电脑端

开源无损视频/音频剪辑:极速快剪、合并、提取,不重新编码、画质零损失。

浏览 5·更新 08-16官网
电脑软件查看档案