Umi-OCR:免费离线OCR工具,3步完成第一次截图识别

📅 发布时间:2026/9/6 21:44:45
Umi-OCR:免费离线OCR工具,3步完成第一次截图识别 Umi-OCR免费离线OCR工具3步完成第一次截图识别【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR经常需要从截图、扫描件里抠出文字却不想把文件上传到在线网站吗Umi-OCR是一款免费、离线的OCR工具把图片识别、PDF文档识别、二维码扫描都整合进一个绿色软件里解压即用无需联网数据不出本机。一、30秒了解Umi-OCR是什么Umi-OCR 是一款开源、免费的离线 OCR 软件支持 Windows 7 x64 与 Linux x64。识别过程完全在本地完成内置多种语言识别库不需要任何联网步骤。需要随时提取屏幕文字的办公、开发人员要批量处理扫描图片、PDF 文档的行政与研究人员注重隐私、不愿把文件上传云端的用户想通过命令行、HTTP 接口调用 OCR 能力的开发者二、从零开始3步完成第一次Umi-OCR操作这一节带你走完获取、启动、第一次识别的全过程熟练后全程不超过5分钟。步骤一获取软件1分钟从发布渠道下载.7z压缩包或.7z.exe自解压包并解压也可以直接克隆仓库git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR步骤二首次启动2分钟无需安装双击Umi-OCR.exe即可运行。软件会根据系统语言自动切换界面想换语言可进「全局设置 → 语言/Language」手动选择。步骤三第一次识别2分钟打开「截图OCR」标签页按下截图快捷键框选屏幕区域识别结果会自动出现在右侧记录栏用鼠标划选即可复制到剪贴板。截图快捷键的默认值可在该页「设置 → 快捷键」里重新录制。三、核心功能速览Umi-OCR 的实用价值集中在三处随手截图识别、批量图片处理、PDF 文档提取。截图OCR代码截图也能保留缩进解决屏幕上的文字只能手敲一遍的问题。框选区域后左侧是图片预览、右侧是识别记录划选文字可直接复制。识别代码截图时把「文本后处理」方案切到单栏-保留缩进行首空格和缩进都会原样保留粘贴进编辑器不用重新整理格式。批量OCR一次识别几百张图片并批量导出解决几十个文件要一张张手动跑的问题。在「批量OCR」页选择文件夹一次导入几百张也没有数量上限支持 jpg、png、webp、bmp、tiff 等常见格式结果可保存为 txt、jsonl、md、csv(Excel)。遇到超大长图无法识别时在页面设置里把「限制图像边长」调高即可。任务跑完还能设置自动关机/待机挂机处理也省心。文档识别从PDF扫描件提取文本「文档识别」页支持 pdf、xps、epub、mobi、fb2、cbz 等格式既有文本就提取扫描件就做 OCR还可以输出双层可搜索 PDF让扫描件变成能全文检索的文档。同样支持忽略区域用来排除页眉页脚。四、实战场景场景一扫描件批量去水印导出干净正文痛点扫描图片每张都带页脚水印直接批量识别会把水印文字混进正文。操作路径打开「批量OCR」页选择存放扫描图片的文件夹进入「忽略区域」编辑器按住右键把水印可能出现的位置全部框住排版方案选单栏-按自然段换行保存格式选 txt点击「开始任务」产出结果每张图对应一个文本文件正文干净无水印可直接归档或导入其他工具继续处理。场景二从技术文档中提取代码痛点文档里的代码示例带缩进手动复制常常错乱。操作路径截图包含代码的区域粘贴回「截图OCR」页「文本后处理」选择单栏-保留缩进划选识别结果复制到编辑器产出结果代码缩进、空行结构基本还原改个参数就能直接运行。五、进阶技巧除了图形界面Umi-OCR 还支持命令行调用与 HTTP 接口适合写脚本或嵌入自己的程序。命令行入口就是主程序本身依赖默认开启的本地 HTTP 服务通信只在系统环回内部进行不经过外网。常用指令例如umi-ocr --screenshot --output result.txt # 截屏识别结果写入文件 umi-ocr --path D:/pics # 识别文件夹内所有图片完整参数见 命令行手册。HTTP 接口支持 Base64 图片识别、文档识别、二维码识别/生成等端点说明在 HTTP接口手册。需要更灵活的流程时命令行还提供高级指令可以调用任意标签页模块的函数。六、避坑指南现象双击启动直接闪退原因系统缺少 Visual C 运行库。 解决安装最新版 VC 运行库后再启动仍失败可到发布渠道下载带运行库的版本。现象识别结果错字多原因图片分辨率低、模糊或识别语言库选错。 解决换清晰原图并在识别设置里选择与文字匹配的语言库。现象特别大的长图识别异常原因默认有「限制图像边长」参数超大图片会被压缩。 解决在批量OCR页的设置里调高该数值。现象HTTP 接口偶发 ECONNREFUSED 报错原因后端并发能力有限长时间大批量连续调用可能出错。 解决不要并发调用报错后重新发起请求即可通常不会持续出现。现象忽略区域没把水印去掉原因忽略区域按整个文本块屏蔽而不是单个字符。 解决把矩形框画大一些确保水印所在的完整文本块完全落在框内。Umi-OCR 是一款免费、离线运行的 OCR 工具覆盖截图识别、批量图片识别、PDF 文档识别与二维码。更多参数看 命令行手册新版本动态见 更新日志——解压即用现在就可以处理手边第一张截图。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考