ARTICLE DETAIL

资讯详情

深耕网站建设、视觉设计与SEO优化的一线实战洞察。

Umi-OCR:免费离线OCR工具,批量识别图片与PDF文档文字

Umi-OCR:免费离线OCR工具,批量识别图片与PDF文档文字 Umi-OCR免费离线OCR工具批量识别图片与PDF文档文字【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费开源的离线 OCR光学字符识别软件完全在本地运行不联网、不上传图片、无次数限制。它支持截图文字识别、批量图片导入、PDF 文档识别和二维码处理适合需要把扫描件、截图、论文里的文字快速转成可复制文本的办公和学习用户。 快速上手解压后3分钟跑通首次识别下载发布包.7z压缩包或免装压缩软件的.7z.exe自解压包解压到任意目录无需安装任何依赖双击Umi-OCR.exe启动界面语言会按系统设置自动匹配打开截图OCR页用快捷键框选屏幕任意区域识别结果直接进剪贴板。从下载到拿到第一段识别文字全程不超过3分钟不需要注册、不需要联网。常用全局参数语言、主题、开机自启、OCR引擎切换都在全局设置页调整设置会保存为 ini 格式配置文件可手动修改后用umi-ocr --reload重新加载。上图是截图OCR页左侧图片上可见文字检测框右侧识别记录支持划选复制和直接编辑适合截一张、改两句、贴出去的即时场景。全局设置页集中了界面外观、语言、启动方式和OCR插件等配置新手只需确认语言与主题即可开始使用。⚙️ 核心功能详解截图OCR快捷键框选文字即复制日常最高频的用法。打开截图页后随时用快捷键可自定义截屏识别也支持把别处复制的图片直接粘贴进来。识别结果保留在右侧记录栏可以划选多条合并复制左侧预览图上可以直接框选某个文本块单独复制——不用为半句话重新截一次图。批量OCR一次识别几百张图多格式导出把图片拖入列表即可排队识别没有数量上限每张图有独立的耗时和状态显示支持任务完成后自动关机/待机。识别结果可按txt、jsonl、md、csv(Excel)等格式导出到原目录或指定目录jpg、png、webp、bmp、tiff 等常见格式都支持。批量页左侧是任务列表文件数、耗时、状态右侧按文件汇总识别文本进度条和百分比让长任务状态一目了然。排版解析与忽略区域整理乱序文字、过滤水印干扰OCR 的原始输出常有两类问题文字顺序混乱多栏、竖排文档以及水印、页眉页脚混入正文。Umi-OCR 的文本后处理提供预设排版方案多栏-按自然段换行、单栏-保留缩进代码截图专用保留行首缩进等自动处理横排与从右到左的竖排。若文档带固定位置的水印可在批量页的忽略区域编辑器里按住右键画矩形框框内整个文本块会在识别时被跳过。 实战场景场景一扫描合同转可编辑文本痛点纸质合同扫描成图片后文字无法搜索、无法引用。解法整本扫描图片丢进批量OCR用多栏-按自然段换行方案识别必要时框选印章区域导出 txt 或 md 后粘贴进 Word 排版。效果几小时的手抄量级工作压缩到一次批量任务文本可直接全文检索。场景二从教程截图提取代码痛点技术教程里的代码截图复制不了手动敲容易丢缩进。解法选择单栏-保留缩进后处理方案逐张截图识别结果保留行首缩进和行内空格。效果代码基本可原样粘进编辑器只需人工核对关键字。场景三多语言混排文档痛点文档里中英日韩混杂在线识别工具经常整段乱码。解法内置多国语言库按文档主体语言选择对应识别库界面本身也支持多语言切换。效果混合文档识别率明显好于单一语言模型输出顺序不乱。软件界面内置简体中文、繁体中文、英文、日文等语言可在全局设置中随时切换。 进阶玩法命令行入口就是主程序本身配合快捷键工具可实现全自动工作流识别文件夹内所有图片umi-ocr --path D:/图片目录快捷键截屏识别umi-ocr --screenshot命令行依赖软件内置的本地 HTTP 接口做进程间通信默认开启、仅本地环回因此也天然支持以 API 方式集成进自己的自动化脚本接口说明见 docs/http/README.md完整参数手册见 docs/README_CLI.md。想换 OCR 引擎Rapid-OCR / Paddle-OCR或参与源码构建可拉取仓库git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR构建环境说明在 README.md 的构建项目一节。⚠️ 边界与注意事项类别说明平台仅支持 Windows 7 x64 与 Linux x64无 macOS 版本识别质量取决于图片清晰度300dpi 以上扫描件效果最佳模糊图、艺术字、复杂手写体会明显降准确率超大长图默认有图像边长限制识别超长图前需在页面设置中调高限制图像边长数值忽略区域排除的是框内整个文本块而非单个字符框画得过小可能漏排建议放大框选显示异常若截图闪烁、UI错位到全局设置把渲染器换成其他方案或关闭硬件加速双引擎Rapid-OCR 兼容性好Paddle-OCR 速度稍快二者通过插件切换无需重装写在最后Umi-OCR 的定位很克制把本地、免费、可批量这三件事做扎实。如果你的文档不需要上云它基本能覆盖截图、批量、PDF 三类最常见需求。建议先从截图OCR页试起顺手后再把批量页和命令行用起来。官方说明文档README.md命令行手册docs/README_CLI.mdHTTP 接口手册docs/http/README.md【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表