截图 OCR Win+Alt+C
按下快捷键唤起截图工具,截取屏幕任意区域后自动识别。左侧预览可划选局部,右侧记录可编辑、复制、导出。
适用于 Windows7 x64 及 Linux x64 的离线 OCR 软件。支持截图 OCR、批量 OCR、PDF 文档识别、二维码与数学公式识别,100+ 语言离线识别,图片不上传服务器。
Umi-OCR 提供五种主要文字识别功能,覆盖日常提取文字的绝大多数场景。所有识别过程都在本地完成,图片不会上传到任何服务器。
按下快捷键唤起截图工具,截取屏幕任意区域后自动识别。左侧预览可划选局部,右侧记录可编辑、复制、导出。
一次性导入数百张图片,多线程并发识别,支持 jpg png webp 等格式,结果可导出 txt / jsonl / md / csv。
导入 PDF 或扫描件图片,逐页识别文字,保留原文档段落结构,输出可编辑的 TXT 或 Markdown 文件。
扫描图片或截图中的二维码,识别内容可复制,支持一图多码批量提取,可扫描整个目录内所有图片。
识别图片中的数学公式,输出 LaTeX 格式代码,可直接粘贴到 Typora / Overleaf 渲染。支持复杂多行公式识别,与截图 OCR 快捷集成。
截图 OCR 与批量 OCR 两种模式,覆盖日常文字提取与大批量处理场景。
按 Win+Alt+C 唤起截图,识别结果实时显示,可编辑、复制、导出。
一次性导入数百张图片,后台并发识别,结果可批量导出为多种格式。
提供命令行与 REST 接口,方便脚本化批量处理或与其他软件集成。
# 单张图片 OCR
Umi-OCR.exe --path "image.png" --output "result.txt"
# 启动 HTTP 服务(默认端口 1224)
Umi-OCR.exe --server
# 调用接口
POST http://127.0.0.1:1224/api/ocr
Content-Type: application/json
{ "base64": "..." }
Umi-OCR 提供两个引擎版本,可根据电脑配置与使用场景选择。
| 版本 | 体积 | 特点 | 适用场景 |
|---|---|---|---|
| Paddle 版 | 约 128 MB | 精度更高,模型更大 | 复杂文档、专业场景 |
| Rapid 版 | 约 97 MB | 速度更快,体积更小 | 快速任务、低配电脑 |
| Linux 版 | AppImage | Ubuntu / Debian / Fedora | Linux 桌面环境 |
0xc0000142,请换用 Rapid 版。Umi-OCR 由 hiroi-sora 发起并维护,是 GitHub 上活跃的开源 OCR 项目之一。
关于下载、安装、使用的常见疑问。点击任意卡片展开答案。
Umi-OCR 采用 MIT License 协议开源。您可以自由使用、修改、分发本项目,包括商业用途,只需保留原作者的版权声明。
项目源代码托管于 GitHub:github.com/hiroi-sora/Umi-OCR