从截图到批量 PDF,从图片到文本,Umi-OCR 提供完整离线识别方案,完全免费。
快捷键截图即时识别,自动复制结果到剪贴板,无缝衔接工作流。支持多屏与高 DPI,识别准确率高。
批量导入 PDF 或图片文件夹,一键提取全部文字,保留段落结构,支持生成双层可搜索 PDF。
所有识别均在本地完成,无需联网,不发送任何数据。保护商业机密与个人隐私,符合企业安全要求。
基于 PaddleOCR 优化,启动快,占用低,普通办公电脑也能流畅运行,支持 Windows / Linux。
内置简体中文、繁体中文、英文、日文、韩文等多语言识别库,可自由切换或混合识别。
代码完全开源,MIT 协议,无任何广告或付费限制。可自行编译、二次开发,社区活跃。
无论是办公、学习还是开发,Umi-OCR 都能帮您从图片和 PDF 中快速提取文字。
快速将教材、论文、扫描版书籍中的文字提取出来,方便整理笔记、翻译和检索。支持批量处理,一次导入整个文件夹,自动输出文本文件。
从发票、合同、报表中提取关键信息,结合脚本实现自动化录入。离线运行保证企业数据不出内网,满足合规要求。
在普通办公电脑上,Umi-OCR 也能在秒级完成识别任务,不占用过多系统资源。
关于 Umi-OCR 的离线能力、使用方式和兼容性,这里有一些解答。
是的,所有识别模型均打包在本地,运行时不发送任何网络请求。您可以断网使用,数据始终留在您的电脑上。
提供 Windows 10/11 和主流 Linux 发行版(Ubuntu、Debian、Fedora 等)的安装包,同时支持源码编译。
支持常规印刷体识别,表格可保留大致结构。手写体识别依赖模型,建议使用印刷体以获得最佳效果。
在软件中选择“批量识别”标签,添加 PDF 文件或整个文件夹,设置输出格式后点击开始即可。
适用于 Windows 10/11 与主流 Linux 发行版。免费、开源、离线,即刻体验高效的文字识别。