
GitHub 46k StarUmi-OCR从零部署完整教程 · 新手照着做就能跑起来 · 效率工具指南 · 原创教程摘要Umi-OCR 是 GitHub 4.6 万 Star 的免费开源离线 OCR 软件本地运行不上传、隐私安全。本文介绍 Windows 下载解压、截图 OCR、批量 OCR、PDF 文档识别、二维码识别与生成、以及插件扩展 7 种 OCR 引擎的完整用法。图片里有一大段字想复制出来在线 OCR 网站要么收费、要么得把图片传上去隐私堪忧。Umi-OCR 是一个免费、开源、完全离线的 OCR 工具图片文字一键提取本地运行不上传。本文要点免费、开源、离线 OCR本地运行不上传隐私安全解压即用无需安装 Python、无需配置环境支持截图 / 批量 / PDF 文档 / 二维码识别可插件扩展 7 种 OCR 引擎按需切换。一、GitHub 项目数据项目数据Star46,6064.6 万主要语言Python技术栈Python Qt 离线 OCR 引擎最新版本v2.1.5许可证MIT二、它能解决什么问题你的痛点Umi-OCR 怎么解决图片/截图里的文字想复制截图 OCR快捷键框选即识别扫描件 PDF 想转成文字批量文档识别输出「双层可搜索 PDF」几百张图片要批量提字批量 OCR一次性处理几百张在线 OCR 怕隐私泄露完全离线图片不上传断网也能用三、部署解压即用Umi-OCR 无需安装下载便携包解压即用。虽然简单但每一步都写清楚① 下载三选一国内优先蓝奏云渠道地址说明蓝奏云hiroi-sora.lanzoul.com/s/umi-ocr国内推荐免注册不限速GitHubgithub.com/hiroi-sora/Umi-OCR/releases/latest国内下载极慢约 20KB/sSourceForgesourceforge.net/projects/umi-ocr备用渠道② 选择版本v2.1.5Windows 二选一版本文件大小特点Rapid 版Umi-OCR_Rapid_v2.1.5.7z.exe98.6 MB兼容好低配老电脑适用Paddle 版Umi-OCR_Paddle_v2.1.5.7z.exe128.1 MB性能好CPU 需 AVX 指令集③ 解压启动.7z.exe是自解压包双击解压解压后双击Umi-OCR.exe启动首次自动按系统语言切换界面。④ 可选Scoop 命令行安装scoop bucket add extras scoop install extras/umi-ocr# Rapid 引擎# 或 scoop install extras/umi-ocr-paddle # Paddle 引擎四、怎么用重点场景 1截图 OCR —— 屏幕文字随手识别打开「截图」标签页按快捷键F4可在全局设置改唤起截图框选要识别的区域右侧即显示识别结果。也可以复制别处的图片粘贴进 Umi-OCR 识别。场景 2批量 OCR —— 几百张图片一次提完切到「批量」标签页导入本地图片支持 jpg/png/webp/bmp/tif 等一次性识别几百张结果可导出txt / jsonl / md / csv(Excel)。支持任务完成后自动关机/待机。场景 3批量文档 —— 扫描件 PDF 转「双层可搜索 PDF」「文档」标签页支持pdf / xps / epub / mobi / fb2 / cbz对扫描件做 OCR 提取文字或输出「双层可搜索 PDF」PDF 里嵌入文字层之后可搜索、复制、高亮。场景 4二维码 —— 扫码 生成「二维码」标签页截图/粘贴/拖入含二维码的图片读取其中内容支持一图多码、19 种协议也能输入文本生成二维码图片。场景 5全局设置全局设置里可一键添加快捷方式/开机自启、切换界面语言繁中/英/日、切换亮暗主题、调整字号字体、切换 OCR 插件、调整渲染器解决截图闪烁/UI 错位。场景 6两个实用功能文本后处理排版解析识别结果按「多栏/单栏、自然段换行、保留缩进」等方案整理排版代码截图选「单栏-保留缩进」可保留行首缩进忽略区域批量 OCR 时右键绘制矩形框排除水印/LOGO 处的文字避免干扰识别结果。五、插件扩展进阶Umi-OCR v2 支持以插件形式导入 OCR 引擎。安装三步从插件库 Umi-OCR_plugins 的Releases下载插件压缩包⚠️ 别下仓库源码解压后把插件文件夹放进软件目录的UmiOCR-data/plugins打开软件 → 全局设置 → 切换 OCR 插件。可用 OCR 引擎插件插件自带于特点PaddleOCR-jsonPaddle 版性能好CPU 需 AVX 指令集RapidOCR-jsonRapid 版轻量、兼容好、低配适用Pix2Text需安装支持中英文/数学公式/混合排版TesseractOCR需安装老牌多语言英文准自带排版识别chineseocr需安装轻量中英文WechatOCR需安装离线调用微信 OCRmistral.ai需安装云端 API需联网六、踩坑记录实测坑 1GitHub Releases 下载极慢现象实测 300 秒只下 6.2 MB约 20KB/s98.6 MB 完整包需 1 小时以上。原因GitHub release 资产走 objects.githubusercontent.com CDN国内直连极慢。解决走蓝奏云国内推荐免注册不限速或 SourceForge。坑 2git clone 源码仓库超时现象git clone 180 秒超时.git 已 57MB。原因主仓库约 275MB含 Qt 资源、模型等大文件。解决不需要源码部署直接下载发行版即可。七、功能验证已实测通过本机 Windows 实测以下功能均正常截图 OCR ✅、批量 OCR ✅、批量文档 ✅、二维码 ✅、全局设置 ✅。断网状态下识别仍可用验证离线引擎正常。八、常见问题Q1真的是免费、离线、不用联网吗是的。项目 MIT 开源免费OCR 引擎在本地运行图片不上传断网也能识别。这也是它对比在线 OCR 网站的核心优势。Q2Rapid 版和 Paddle 版怎么选低配/老电脑选 Rapid兼容好、内存低高配电脑选 Paddle性能更好、识别更快但 CPU 需支持 AVX 指令集。Q3能识别竖排文字、数学公式吗横排竖排都能自动处理数学公式需安装 Pix2Text 插件支持中英文/数学公式/混合排版。Q4PDF 扫描件能直接转文字吗能。用「文档」标签页对扫描件 OCR可输出「双层可搜索 PDF」嵌入文字层之后可搜索复制。九、总结Umi-OCR 是一款免费、开源、离线的 OCR 神器解压即用、功能全截图/批量/PDF/二维码、可插件扩展。如果你经常要提取图片或扫描件里的文字又在意隐私不想上传图片到在线网站强烈推荐一试。项目地址[hiroi-sora/Umi-OCR] (https://github.com/hiroi-sora/Umi-OCR)标签Umi-OCR、OCR、文字识别、离线OCR、Python、效率工具