v2.1.5 · 完全免费 · 开源 MIT 协议

把图片里的文字
一行一行取出来

Umi-OCR 是一款离线运行的免费开源 OCR 工具。截图、图片、扫描版 PDF,全部在本地识别,不上传、不联网、不留痕。

支持 100+ 语言,Paddle 与 Rapid 双引擎可选,拖入文件夹自动批量处理,输出 TXT / JSONL / MD / CSV。

功能 一览

左右滑动查看全部功能

01 / 06

截图 OCR

快捷键框选即识别,识别结果实时出现在记录栏。支持剪贴板粘贴图片。

Ctrl+Alt+C 框选识别
02 / 06

批量图片识别

拖入整个文件夹,自动逐张处理,无数量限制。支持 JPG/PNG/WEBP/TIF。

03 / 06

PDF 双层文档

扫描版 PDF 提取文字,生成可搜索的双层 PDF,文字可选中复制。

04 / 06

二维码 / 条码

识别 19 种条码类型和二维码,也支持生成二维码图片。

05 / 06

公式识别

识别数学公式,输出 LaTeX 格式,可直接粘贴到 Markdown 文档。

∑ ∫ √x² dx
06 / 06

排版解析

多栏布局、竖排文字自动按正确顺序输出。代码截图保留缩进。

双引擎 对比

根据电脑配置选择适合你的版本

对比项 Paddle 引擎版 Rapid 引擎版
安装包体积约 128 MB约 98.5 MB
识别精度更高推荐良好
运行速度很快
内存占用中等
CPU 要求需支持 AVX兼容性更好
适用场景高配电脑 · 追求精度老旧电脑 · 追求流畅
截图OCR 批量OCR 批量文档 二维码
发票
识别结果
发票号码:00123456
开票日期:2026-09-22
金额:¥ 1,280.00
税额:¥ 166.40
合计:¥ 1,446.40

项目 数据

开源社区持续维护,稳定可靠

K+
GitHub Stars
开源社区认可
+
支持语言
中英日韩俄德法
OCR 引擎
Paddle / Rapid
%
离线运行
数据不出本机

常见 问题

开发者与用户高频疑问解答

Umi-OCR 是免费的吗?
完全免费,开源 MIT 协议。所有功能不需要付费,不存在会员或订阅。可以自由使用、修改和分发。
支持哪些操作系统?
支持 Windows 7 x64 及以上版本和 Linux x64。软件为免安装绿色版,解压双击即可运行,不写注册表、不产生残留。
能识别竖排文字吗?
支持。排版解析方案中有“竖排-从右到左”选项,适合识别古籍、海报、竖排标题等场景。
代码截图能保留缩进吗?
可以。选择“单栏-保留缩进”方案,行首缩进和行中空格都会保留,识别出来的代码可以直接使用。
能通过 API 调用吗?
支持命令行调用和 HTTP 接口两种方式。可以在设置中开启 HTTP 服务,通过 POST 请求调用识别功能,方便集成到自动化流程。
识别结果支持哪些输出格式?
批量 OCR 支持输出 TXT、JSONL、Markdown、CSV 四种格式。批量文档支持输出双层可搜索 PDF 和 TXT。
会上传我的图片到服务器吗?
不会。所有识别过程完全在本地进行,不需要联网。断网状态下所有功能正常使用。这是 Umi-OCR 隐私安全的核心保障。
识别准确率如何提升?
使用 Paddle 引擎版精度更高。在设置中可以调整“忽略区域”排除水印,选择合适的排版解析方案。图片清晰度越高,识别效果越好。

离线 OCR,就在这里

截图秒识别 · 批量图片转文字 · PDF双层文档 · 100+语言 · 完全免费