🔒 完全离线 · 无隐私泄露

开源离线 OCR
截图·PDF·批量识别

Umi-OCR 是一款免费、开源、离线的文字识别工具。无需联网,无需上传,保护您的隐私安全。支持截图识别、PDF 批量处理、本地图片转文字,Windows 与 Linux 均可流畅运行。

50k+ GitHub Stars
100% 离线运行
0 数据上传
umi-ocr 预览
# 截图识别 - 本地推理
Umi-OCR 支持离线 OCR
# 识别结果
开源离线 · 批量 PDF · 无隐私泄露
# 引擎: PaddleOCR / 快速
识别完成,共 4 行,耗时 0.32s

为效率而生的 OCR 工具

从截图到批量 PDF,从图片到文本,Umi-OCR 提供完整离线识别方案,完全免费。

📸

截图秒识别

快捷键截图即时识别,自动复制结果到剪贴板,无缝衔接工作流。支持多屏与高 DPI,识别准确率高。

📄

PDF 批量 OCR

批量导入 PDF 或图片文件夹,一键提取全部文字,保留段落结构,支持生成双层可搜索 PDF。

🔐

完全离线

所有识别均在本地完成,无需联网,不发送任何数据。保护商业机密与个人隐私,符合企业安全要求。

⚡

轻量高效

基于 PaddleOCR 优化,启动快,占用低,普通办公电脑也能流畅运行,支持 Windows / Linux。

🌐

多语言支持

内置简体中文、繁体中文、英文、日文、韩文等多语言识别库,可自由切换或混合识别。

🧩

开源 & 免费

代码完全开源,MIT 协议,无任何广告或付费限制。可自行编译、二次开发,社区活跃。

哪里需要文字识别,哪里就有 Umi-OCR

无论是办公、学习还是开发,Umi-OCR 都能帮您从图片和 PDF 中快速提取文字。

📚 学习与资料整理

快速将教材、论文、扫描版书籍中的文字提取出来,方便整理笔记、翻译和检索。支持批量处理,一次导入整个文件夹,自动输出文本文件。

  • 扫描版 PDF 一键转文字
  • 截图识别公式与英文
  • 批量导出 TXT / JSON

💼 办公与自动化

从发票、合同、报表中提取关键信息,结合脚本实现自动化录入。离线运行保证企业数据不出内网,满足合规要求。

  • 发票号码、金额批量识别
  • 合同关键条款提取
  • 支持命令行调用,融入工作流

轻量、快速、稳定

在普通办公电脑上,Umi-OCR 也能在秒级完成识别任务,不占用过多系统资源。

0.3s
单张截图识别
1080P 截图平均耗时
50+
每分钟 PDF 页数
批量模式下的处理速度
200MB
内存占用
典型工作负载下

您可能想了解

关于 Umi-OCR 的离线能力、使用方式和兼容性,这里有一些解答。

Umi-OCR 真的完全离线吗?

是的,所有识别模型均打包在本地,运行时不发送任何网络请求。您可以断网使用,数据始终留在您的电脑上。

支持哪些操作系统?

提供 Windows 10/11 和主流 Linux 发行版(Ubuntu、Debian、Fedora 等)的安装包,同时支持源码编译。

能否识别表格或手写体?

支持常规印刷体识别,表格可保留大致结构。手写体识别依赖模型,建议使用印刷体以获得最佳效果。

如何批量处理 PDF?

在软件中选择“批量识别”标签,添加 PDF 文件或整个文件夹,设置输出格式后点击开始即可。

下载 Umi-OCR

适用于 Windows 10/11 与主流 Linux 发行版。免费、开源、离线,即刻体验高效的文字识别。

Windows Linux 免安装
立即下载

相关搜索