最新版本 v2.1.5 | 集成 Paddle/Rapid 引擎 | 无需安装
使用快捷键即时捕获并识别屏幕任意区域的文字,自动复制到剪贴板,极大提升工作效率。
一次导入数百张图片,无数量限制。支持 JPG、PNG、WebP 等格式,结果可导出为 TXT、CSV。
从扫描版 PDF 中提取文字,创建可搜索的双层 PDF 文档,解决文档无法复制的痛点。
所有识别过程在本机 CPU 完成,数据永不上传。采用 MIT 开源协议,无隐藏费用与订阅。
Umi-OCR 是一款基于 PaddleOCR 及 RapidOCR 引擎构建的、专为 Windows 和 Linux 平台设计的离线文字识别工具。它完美解决了日常办公、学习研究中常见的“图片文字无法选中”、“扫描 PDF 无法复制”、“截图内容需要提取”等难题。与传统的在线 OCR 服务不同,Umi-OCR 的核心优势在于 100% 离线运行。这意味着您无需担心网络延迟,更无需担忧机密文档、身份证件或私人聊天截图被上传至第三方服务器,从而彻底杜绝了数据泄露的风险。它解压即用,无需安装,绿色便携,是电脑端不可或缺的效率软件[citation:1][citation:4]。
这是 Umi-OCR 最受用户喜爱的功能之一。无论您是在浏览网页时遇到了无法复制的文本,还是在观看教学视频时需要记录笔记,只需按下全局快捷键(默认为 Win+Alt+C 或 F4),鼠标框选目标区域,Umi-OCR 便能在一秒内将识别结果呈现在右侧记录栏中。识别结果不仅支持直接编辑,还自动同步至剪贴板,让“截图-复制-粘贴”的操作无缝衔接。针对代码截图或竖排文字,Umi-OCR 还内置了强大的文本后处理功能,能够智能合并段落或保留缩进,最大程度还原原文排版[citation:3][citation:9]。
面对海量的截图或扫描件,Umi-OCR 的批量 OCR 标签页展现了惊人的生产力。您可以一次性将包含数百张图片的整个文件夹拖入软件,软件会自动按照顺序进行识别,并且没有数量限制。对于学术研究或法务工作者常遇到的扫描版 PDF,Umi-OCR 的文档识别功能尤为实用。它不仅能逐页提取文字生成 TXT 文本,更能将原 PDF 转换为双层可搜索 PDF。这意味着识别后的 PDF 既保留了原始图像的外观,又具备了全文检索的能力,极大地方便了资料归档与查阅[citation:3][citation:7]。
为了满足不同硬件配置用户的需求,Umi-OCR 官方提供了两种打包版本。对于配置较高的电脑(特别是拥有 AVX 指令集的 CPU),推荐下载 Paddle 引擎版,该版本识别精度更高,处理复杂文档(如模糊图片、多语言混合)时表现更佳;而对于老旧机型、低配 CPU(如赛扬、奔腾)或希望软件体积更小的用户,Rapid 引擎版 是绝佳选择,虽然模型略小,但识别速度完全能胜任日常办公需求,且兼容性极强,即使在 Windows 7 系统上也能流畅运行[citation:1][citation:5]。
除了核心的文字提取,Umi-OCR 还集成了多项便捷工具。它能够识别图片中的二维码及条形码,支持多达 19 种协议,包括常见的 QRCode、Code128 等。对于理工科学生或研究人员,Umi-OCR 的公式识别插件可以将图片中的数学公式快速转换为 LaTeX 代码,直接复制进论文编辑器即可使用。此外,软件内置了超过 100 种语言的识别库,无论是中文、英文、日文、韩文还是俄文,它都能在离线状态下精准识别[citation:1][citation:7]。
市面上虽然存在众多 OCR 工具,但 Umi-OCR 凭借其纯粹的免费开源精神脱颖而出。其代码托管于 GitHub,完全透明,没有任何后门、广告或捆绑软件。作为一款电脑版软件,它充分利用了本地 CPU 的计算能力,在批量处理时甚至能超越部分在线服务的效率。同时,软件支持命令行调用和 HTTP 接口,开发者可以轻松将其集成到自己的自动化工作流中。其简洁的现代化界面没有冗余的付费引导,打开即是纯粹的识别功能,真正做到了“小而美”[citation:2][citation:4]。