免费下载
v2.1.5 · 三周年版本 MIT 开源协议 Windows / Linux 100% 离线运行

Umi-OCR 文字识别工具
免费,开源,可批量

适用于 Windows7 x64 及 Linux x64 的离线 OCR 软件。支持截图 OCR、批量 OCR、PDF 文档识别、二维码与数学公式识别,100+ 语言离线识别,图片不上传服务器。

0K+
GitHub Stars
0+
支持语言
0%
离线运行
0广告
纯净无捆绑

#功能说明5 大核心功能

Umi-OCR 提供五种主要文字识别功能,覆盖日常提取文字的绝大多数场景。所有识别过程都在本地完成,图片不会上传到任何服务器。

截图 OCR Win+Alt+C

按下快捷键唤起截图工具,截取屏幕任意区域后自动识别。左侧预览可划选局部,右侧记录可编辑、复制、导出。

批量 OCR

一次性导入数百张图片,多线程并发识别,支持 jpg png webp 等格式,结果可导出 txt / jsonl / md / csv。

PDF / 文档识别

导入 PDF 或扫描件图片,逐页识别文字,保留原文档段落结构,输出可编辑的 TXT 或 Markdown 文件。

二维码识别

扫描图片或截图中的二维码,识别内容可复制,支持一图多码批量提取,可扫描整个目录内所有图片。

数学公式识别 实验性

识别图片中的数学公式,输出 LaTeX 格式代码,可直接粘贴到 Typora / Overleaf 渲染。支持复杂多行公式识别,与截图 OCR 快捷集成。

隐私保护:所有识别过程都在本地完成,图片不会上传到任何服务器。首次启动时已内置识别模型,无需联网下载。

#产品介绍界面预览

截图 OCR 与批量 OCR 两种模式,覆盖日常文字提取与大批量处理场景。

截图 OCR · 即截即识

按 Win+Alt+C 唤起截图,识别结果实时显示,可编辑、复制、导出。

Umi-OCR · 截图 OCR
预览 · Preview
截图区域(可划选局部)
识别结果 · Result
Umi-OCR 是一款免费开源的
离线 OCR 文字识别软件,
支持截图、批量、文档识别。
# 128 characters

批量 OCR · 多线程并发

一次性导入数百张图片,后台并发识别,结果可批量导出为多种格式。

Umi-OCR · 批量 OCR
01screenshot_2026_01.png已完成
02screenshot_2026_02.png已完成
03screenshot_2026_03.png已完成
04screenshot_2026_04.png识别中
05screenshot_2026_05.png等待中

命令行与 HTTP 接口

提供命令行与 REST 接口,方便脚本化批量处理或与其他软件集成。

# 单张图片 OCR
Umi-OCR.exe --path "image.png" --output "result.txt"

# 启动 HTTP 服务(默认端口 1224)
Umi-OCR.exe --server

# 调用接口
POST http://127.0.0.1:1224/api/ocr
Content-Type: application/json
{ "base64": "..." }

#下载与版本v2.1.5

Umi-OCR 提供两个引擎版本,可根据电脑配置与使用场景选择。

版本 体积 特点 适用场景
Paddle 版 约 128 MB 精度更高,模型更大 复杂文档、专业场景
Rapid 版 约 97 MB 速度更快,体积更小 快速任务、低配电脑
Linux 版 AppImage Ubuntu / Debian / Fedora Linux 桌面环境
兼容性:Paddle 版不兼容奔腾 / 赛扬 / 凌动 CPU。如果启动报错 0xc0000142,请换用 Rapid 版。

Windows 下载

Linux 下载

#项目数据GitHub 真实数据

Umi-OCR 由 hiroi-sora 发起并维护,是 GitHub 上活跃的开源 OCR 项目之一。

36K+
GitHub Stars
100+
支持语言
100%
离线运行
0
广告与捆绑

#常见问题7 条

关于下载、安装、使用的常见疑问。点击任意卡片展开答案。

Umi-OCR 是免费的吗?+
完全免费且开源,采用 MIT 协议。无任何付费内容,无广告、无捆绑。
识别会上传图片到服务器吗?+
不会。Umi-OCR 100% 本地离线运行,识别过程全部在电脑上完成,图片不上传服务器。首次启动已内置识别模型。
Paddle 版和 Rapid 版有什么区别?+
Paddle 版精度更高,约 128MB,适合复杂文档,但不兼容奔腾/赛扬/凌动 CPU;Rapid 版更快更小,约 97MB,兼容性好,适合快速任务。Paddle 报错 0xc0000142 请换 Rapid。
支持哪些操作系统?+
支持 Windows 10 / 11 与 Linux(Ubuntu / Debian / Fedora 等)。Windows 提供 7z 压缩包,Linux 提供 AppImage 与 tar.gz。
识别结果可以导出什么格式?+
截图 OCR 支持 TXT、Markdown;批量 OCR 支持 TXT、jsonl、Markdown、CSV;文档识别支持 TXT、Markdown。全部保留识别排版。
如何排除水印或页眉页脚?+
使用「忽略区域」功能:右键绘制矩形框覆盖水印、页眉、页脚,Umi-OCR 会自动跳过这些区域,只识别正文内容。
支持哪些语言?+
内置 100+ 种语言的识别模型,涵盖简体中文、繁体中文、英语、日语、韩语、法语、德语、西班牙语等主流语言,以及部分小语种。

#开源协议

Umi-OCR 采用 MIT License 协议开源。您可以自由使用、修改、分发本项目,包括商业用途,只需保留原作者的版权声明。

项目源代码托管于 GitHub:github.com/hiroi-sora/Umi-OCR