Umi-OCR 快速上手指南:免费离线识别图片文字,3 步跑通批量 OCR
Umi-OCR 快速上手指南免费离线识别图片文字3 步跑通批量 OCR【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR开会时想复制 PPT 截图里的一段话扫描好的合同 PDF 里一个字都点不中——这种看得见却拿不走的处境Umi-OCR 解决得很直接它是一款免费开源的离线 OCR光学字符识别即从图片中还原出可编辑文字软件支持截图识别、批量图片导入、PDF 文档识别和二维码生成全程不联网图片不出你的电脑。Umi-OCR 截图识别页左侧预览原图右侧编辑识别结果全程离线完成 Umi-OCR 是什么一分钟搞懂它的定位一句话把 OCR 引擎整个装进本地压缩包里解压后双击就能用的文字识别工具。它和在线 OCR 服务最大的区别在于离线二字——识别模型项目默认内置 Rapid-OCR 引擎也可切换 Paddle-OCR 引擎直接运行在你的机器上不依赖网络、不上传图片、没有次数限制。这意味着两件事一是内网办公机、没有网络的电脑上照样能用二是合同、票据这类敏感图片永远不会离开本机。首次打开时软件会根据系统语言自动切换界面支持简中、繁中、英语、日语等语言界面不熟悉的用户也能上手。️ 截图识别如何把图里的文字变成可复制的文本解决临时想抓一段图中文字的问题不需要保存文件也不依赖网络。框选截图直接识别打开截图 OCR 标签页后按下截图快捷键软件内可自定义默认 CtrlAltZ框选区域后文字直接出现在右侧记录栏鼠标划选即可复制。粘贴图片识别在其他软件里复制一张图片切回 Umi-OCR 按 CtrlV 粘贴同样进入识别流程。结果可编辑右侧记录栏支持逐条修改错字、合并多条记录后一起复制。排版解析内置多栏-按自然段换行单栏-保留缩进等后处理方案。比如双栏排版的论文截图选多栏方案后文字会按阅读顺序输出而不是左右两栏交错混排识别代码截图则选单栏-保留缩进行首空格会被保留下来。 批量 OCR一次转换几百张图片的最短路径解决手上有一堆图片要逐张转文字的问题。Umi-OCR 批量识别页左侧添加图片、右侧设置输出格式与识别参数拖拽导入无上限支持 jpg、png、webp、bmp、tif 等 9 种图片格式可以一次拖入几百张软件会显示整体进度和耗时。四种输出格式识别结果可存为 txt直接阅读、md带结构、jsonl给程序处理每行一个 JSON 对象、csv导入 Excel 做表格分析按图片原名逐个保存。忽略区域进入忽略区域编辑器按住鼠标右键在预览图上画矩形框框内的水印、页眉、Logo 文字会在任务中被整体跳过。适合批量处理带公司水印的扫描件。识别超大长图默认会对图像边长做限制以控制耗时遇到超大的长截图时在页面设置里调高限制图像边长的数值即可。同一套后处理方案多栏/单栏、保留缩进等在批量页同样可用截图识别和批量识别的参数是各自独立的可以分别配置。 文档与二维码PDF 识别和扫码生成怎么覆盖解决整份文档要转文字以及需要读码、出码的问题。PDF 等文档识别支持 pdf、xps、epub、mobi、fb2、cbz 六种格式扫描件会被 OCR 成文字已有文本层的文档则直接提取输出可以选择生成双层可搜索 PDF——即在原扫描图像上层叠加一层透明文字得到的文件既能被搜索排版又和原文件一致适合归档合同、论文。二维码识别截图、粘贴或拖入图片均可读取其中的码一张图里多个码也能同时读出支持 QRCode、EAN13、Code128 等 19 种二维码和条形码协议。二维码生成输入一段文本指定纠错等级后生成二维码图片支持自定义尺寸。Umi-OCR 多语言界面OCR 识别结果与软件界面均支持多国语言️ 真实场景走一遍三个典型用法场景一会议里抓一段截图文字。打开截图 OCR 页 → 按 CtrlAltZ 框选屏幕上的文字区域 → 在右侧记录栏划选结果复制。全程 10 秒左右图片不落地、不上网。如果只是想快速试一下也可以直接在命令行执行umi-ocr --screenshot执行后自动截图并识别结果默认进入剪贴板。场景二把 30 页扫描合同转成文本存档。批量 OCR 页添加整个文件夹 → 在忽略区域里框掉每页角落的水印 → 输出选 txt 后点击开始任务。完成后每个 PDF 页面对应一个同名 txt可直接归档或继续导入 Word 排版。场景三生成一批带链接的二维码物料。打开二维码标签页粘贴文本 → 选择协议为 QRCode、设定纠错等级 → 输出图片。批量制作时同样的文本列表可以逐条生成避免再装一个在线生成器。 最小上手路径从下载到第一次识别获取压缩包从发行版渠道下载.7z压缩文件仓库内也附带了Umi-OCR_Rapid_v2.1.5.7z发行包内含 Rapid-OCR 引擎兼容性更好。解压即用解压到任意目录双击Umi-OCR.exe启动无需安装过程。跑第一个任务在截图 OCR 页按快捷键框选一块屏幕文字复制结果——到此已完成识别、查看、复制的完整闭环。系统要求项目要求系统Windows 7 x64 及以上或 Linux x64安装免安装解压即用网络不需要完全离线⚙️ 进阶玩法三条命令行技巧给愿意把 Umi-OCR 接进工作流的用户命令行批量识别文件夹umi-ocr --path D:/图片文件夹会递归扫描文件夹内所有图片配合--output result.txt把结果写入文件。手动改配置免重启界面参数保存在UmiOCR-data/.settingsini 格式中改完后执行umi-ocr --reload即可让软件重新加载配置。HTTP 接口对接软件内置本地 HTTP 服务默认开启、仅监听本机可以通过接口调用图片 OCR、文档识别、二维码功能适合写脚本或与其他程序集成参数细节见 docs/http/ 目录下的接口手册。命令行的完整参数说明范围截图、剪贴板识别、二维码指令等都写在 docs/README_CLI.md。 它适合谁不适合谁离线环境办公人员合同、票据、内部资料的扫描件需要转文字且数据不允许出内网——批量识别 忽略区域 txt/csv 输出基本覆盖日常流程。但如果你要的是带格式的 Word 排版还原它输出的是纯文本仍需自己二次排版。学生和研究者论文 PDF、截图资料需要提取文字或做成可搜索文档双层可搜索 PDF 功能很对口。注意它识别的是文档中的文字不擅长从密集表格图片里还原出结构化表格。开发者和自动化用户命令行 HTTP 接口可以把 Umi-OCR 当成本地 OCR 服务挂进流水线。但 HTTP 后端对并发不友好官方文档也提醒了这一点——如果你的场景是高并发批量请求需要自行做队列排队。写在最后Umi-OCR 提供的核心能力很集中免费的离线 OCR、批量图片转文字、PDF 双层文档和二维码处理免安装解压即用适合把图片里的文字拿不动这一类问题彻底留在本地解决。想深入的话建议先看官方文档 docs/README.md 了解各标签页的完整说明需要程序化调用时再翻 docs/http/README.md 和命令行手册。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考