完全离线 · 免费开源 · 无需联网

Umi-OCR
离线文字识别
精准高效

一款完全离线的 OCR 工具,支持截图识别、PDF 双层可搜索、100+ 语言识别。 所有处理均在本地完成,无需上传云端,隐私安全有保障。无论是日常办公中的图片转文字, 还是专业场景下的批量文档数字化,Umi-OCR 都能以极低的资源占用提供稳定可靠的识别服务。

100+ 支持语言
0.3s 平均识别速度
100% 本地离线
📸
截图 OCR
一键截取,即时识别
按下快捷键,框选任意屏幕区域,文字瞬间提取。支持连续截图,自动复制到剪贴板。 对于网课字幕、视频台词、游戏对话等无法直接复制的场景尤为实用。
极速识别
📄 PDF 双层可搜索
🌐 100+ 语言
🔒 完全离线
📦 批量处理

为效率而生的 OCR 工具

每一项功能都经过精心打磨,满足从日常办公到专业开发的全部需求

📸 截图识别

截图即识别,一键提取文字

无需保存图片,按下快捷键即可框选屏幕任意区域,Umi-OCR 会自动识别并提取文字。 支持连续截图、自动复制到剪贴板,让文字提取像呼吸一样自然。无论是网页资料、 电子书摘录还是视频字幕,都能轻松获取。

  • ✓ 全局快捷键,随时唤醒
  • ✓ 支持多屏截图与高 DPI 缩放
  • ✓ 识别结果自动复制,无需手动操作
⌨️ 按下快捷键 Ctrl+Alt+O
🖱️ 框选屏幕中的文字区域
📋 文字自动复制到剪贴板
✅ 识别完成,粘贴即可使用
📄 PDF 处理

PDF 双层可搜索,保留原始排版

将扫描版 PDF 转换为双层可搜索 PDF,在原图之上叠加不可见的文字层, 既保留原始视觉效果,又支持全文搜索和复制。完美适用于文档归档与资料整理。 对于需要长期保存的合同、论文、历史档案等,这一功能可以大幅提升检索效率。

  • ✓ 输出双层 PDF,可搜索可复制
  • ✓ 保持原始排版与图像质量
  • ✓ 支持批量 PDF 文件处理
📑 导入扫描版 PDF 文件
🔍 识别文字并生成隐藏层
💾 导出双层可搜索 PDF
🔎 全文搜索,精准定位
🌐 多语言 & 批量

100+ 语言识别,批量处理更高效

支持中、英、日、韩、法、德等 100 多种语言识别,可同时识别多种语言混排内容。 批量导入图片或 PDF,一键完成全部识别任务,大幅提升工作效率。对于跨国团队 或需要处理多语言资料的用户而言,这一能力尤为关键。

  • ✓ 100+ 语言库,覆盖全球主要语种
  • ✓ 智能语言检测,自动切换
  • ✓ 批量导入,队列处理,稳定高效
🇨🇳 中文识别准确率 99.2%
🇺🇸 英文识别准确率 99.5%
🇯🇵 日文识别准确率 98.8%
🇰🇷 韩文识别准确率 98.6%

更多贴心功能,持续进化

从细节出发,让 OCR 真正融入你的工作流

🔧

命令行与 API 调用

除图形界面外,Umi-OCR 提供完整的命令行工具和 HTTP API 接口,方便开发者集成到 自动化流程中。你可以通过脚本批量处理图片、定时执行识别任务,或将 OCR 能力嵌入 到自己的应用中。文档齐全,示例丰富,上手门槛极低。

支持 CLI 批量识别 提供 RESTful API 可嵌入 Python / Node.js
⚡

极速识别引擎,低资源占用

基于 PaddleOCR 与自研优化算法,Umi-OCR 在保证识别精度的同时,大幅降低 CPU 和 内存占用。即使在低配置的办公电脑上,也能流畅运行。识别一张 A4 扫描件平均仅需 0.3 秒,批量处理百张图片也只需数分钟。

单张识别 0.3s 内存占用低于 200MB 支持 CPU / GPU 加速
🎨

可定制界面与主题

Umi-OCR 提供深色与浅色两套主题,并允许用户自定义快捷键、识别语言、输出格式等 参数。界面简洁直观,所有功能一目了然。同时支持便携模式,解压即用,不写注册表, 适合放在 U 盘中随身携带。

深色 / 浅色主题 自定义快捷键 便携模式,解压即用
离线文字识别工具 截图OCR免费版 PDF双层可搜索 开源OCR软件下载 图片转文字批量处理

立即体验 Umi-OCR

完全免费,开源,离线运行。无需注册,下载即用。支持 Windows、Linux 和 macOS。 无论你是普通用户还是开发者,Umi-OCR 都能为你提供高效、安全、稳定的文字识别体验。