一款完全离线的 OCR 工具,支持截图识别、PDF 双层可搜索、100+ 语言识别。 所有处理均在本地完成,无需上传云端,隐私安全有保障。无论是日常办公中的图片转文字, 还是专业场景下的批量文档数字化,Umi-OCR 都能以极低的资源占用提供稳定可靠的识别服务。
每一项功能都经过精心打磨,满足从日常办公到专业开发的全部需求
无需保存图片,按下快捷键即可框选屏幕任意区域,Umi-OCR 会自动识别并提取文字。 支持连续截图、自动复制到剪贴板,让文字提取像呼吸一样自然。无论是网页资料、 电子书摘录还是视频字幕,都能轻松获取。
将扫描版 PDF 转换为双层可搜索 PDF,在原图之上叠加不可见的文字层, 既保留原始视觉效果,又支持全文搜索和复制。完美适用于文档归档与资料整理。 对于需要长期保存的合同、论文、历史档案等,这一功能可以大幅提升检索效率。
支持中、英、日、韩、法、德等 100 多种语言识别,可同时识别多种语言混排内容。 批量导入图片或 PDF,一键完成全部识别任务,大幅提升工作效率。对于跨国团队 或需要处理多语言资料的用户而言,这一能力尤为关键。
从细节出发,让 OCR 真正融入你的工作流
除图形界面外,Umi-OCR 提供完整的命令行工具和 HTTP API 接口,方便开发者集成到 自动化流程中。你可以通过脚本批量处理图片、定时执行识别任务,或将 OCR 能力嵌入 到自己的应用中。文档齐全,示例丰富,上手门槛极低。
基于 PaddleOCR 与自研优化算法,Umi-OCR 在保证识别精度的同时,大幅降低 CPU 和 内存占用。即使在低配置的办公电脑上,也能流畅运行。识别一张 A4 扫描件平均仅需 0.3 秒,批量处理百张图片也只需数分钟。
Umi-OCR 提供深色与浅色两套主题,并允许用户自定义快捷键、识别语言、输出格式等 参数。界面简洁直观,所有功能一目了然。同时支持便携模式,解压即用,不写注册表, 适合放在 U 盘中随身携带。
完全免费,开源,离线运行。无需注册,下载即用。支持 Windows、Linux 和 macOS。 无论你是普通用户还是开发者,Umi-OCR 都能为你提供高效、安全、稳定的文字识别体验。