
Umi-OCR 快速上手指南免费批量图片文字识别完整教程【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费开源的离线 OCR 软件无需安装、解压即用所有识别都在你自己的电脑上完成图片不会离开本机。它有两个主要入口批量图片 OCR 和截图文字识别内置多国语言识别库。如果你常要整理学习资料、把扫描件转成文字它就是现成的本地方案。上手准备下载与启动Umi-OCR 支持 Windows 7 x64 和 Linux x64发布包为 .7z 压缩包或 .7z.exe 自解压包没有安装环节解压即用。拿到发布包。仓库根目录就附带了 Umi-OCR_Rapid_v2.1.5.7z 发行包解压到任意目录即可路径中尽量避免特殊字符。双击运行 Umi-OCR.exeLinux 下运行 umi-ocr.sh程序即启动。窗口顶部有“截图OCR”“批量OCR”“全局设置”等标签页只保留常用的、其余可以关掉。首次打开时界面语言会按系统设置自动选择想更换的话进入“全局设置”→“语言”手动切换顺便可以把主题、字体大小、桌面快捷方式和开机自启都配好。全局设置标签页语言、主题、开机自启都在这里调整核心场景走一遍批量图片OCR怎么做一个文件夹的图片一次跑完切到“批量OCR”标签页点左上角“选择图片”添加图片支持 jpg、png、webp、bmp、tif 等格式文件会显示在左侧列表里。在右侧“设置”面板选择语言/模型库并挑选排版解析方案普通文档选“单栏-按自然段换行”代码截图选“单栏-保留缩进”可保留行首缩进和行内空格。选定输出格式txt、md、jsonl、csv(Excel) 都可以保存位置可选原图片目录或指定目录。点“开始任务”顶部进度条实时显示进度和耗时列表里每张图片会显示各自耗时与置信度图片数量没有上限一次丢进去几百张也可以。任务结束后切到“记录”标签页每张图片的识别文本按顺序排列方便核对和二次导出。批量OCR标签页左栏是任务列表与进度右栏可查看设置和每张图片的识别记录截图文字识别怎么做随手抓几行字打开“截图OCR”标签页用快捷键唤起截图如果在别处复制了图片也可以直接粘贴进来识别。识别完成后左侧预览栏会在原图上标出文字位置可以直接划选复制右侧记录栏则显示每条识别结果的完整文本。记录栏里可以编辑文字、划选多条记录一起复制也可以右键删除选中记录或清空全部记录。截图OCR标签页识别后可在预览栏直接划选复制文字记录栏右键菜单批量复制、删除选中记录等操作都收在这里场景速查表场景如何准备推荐设置预期效果学习笔记、办公文档图片批量处理jpg/png 图片存进专用文件夹单栏-按自然段换行选简体中文库结果按段落整理输出为 txt/md 文件代码截图提取IDE 代码区直接截图单栏-保留缩进选英文库缩进和空格完整保留可直接粘进编辑器带水印、页码的扫描文档PDF 扫描件转成页面图片多栏-按自然段换行配合“忽略区域”画框水印、页眉页脚的文字不出现在结果里随手抓一段文字不需要存文件直接截图截图OCR标签页默认设置文字秒进剪贴板到处粘贴使用 效率技巧用“忽略区域”屏蔽水印在批量页右栏进入忽略区域编辑器按住右键拖拽画矩形框把水印或页眉页脚排除掉一次画好后续同类型的图再跑就不用手动清理只有整个落在框内的文本块会被忽略。超大图调高“限制图像边长”长图、大图边长过大时识别很慢在页面设置→文字识别里调高这个数值大图就能被完整且更顺畅地处理。用命令行省掉手动步骤重复性任务可以直接跑umi-ocr --path D:/images --output result.txt不用打开窗口也支持传入文件夹和多个路径完整手册见 docs/README_CLI.md。常见问题Q识别时图片会被上传到云端吗 A不会整个过程离线运行图片和结果都不离开电脑断网也能正常用。Q大图批量识别很慢或者结果不完整怎么办 A检查页面设置里的“限制图像边长”是否过小大图会按这个值缩放处理适当调高后大图就能完整识别速度也会改善。Q界面显示成日文或英文看不懂怎么办 A到“全局设置”→“语言”切回简体中文即可首次启动时它按系统语言自动选择随时可以手动覆盖。Umi-OCR 内置多语言界面简体中文、日本語、English 等可自由切换写在最后Umi-OCR 是一个完全本地的 OCR 工具解压、导入图片、拿到文字三步就能跑通日常需求。更深入的用法可以看 HTTP 接口手册 和 命令行手册版本变化则记录在 CHANGE_LOG.md。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考