Umi-OCR免费离线OCR:4个场景,文件不出本机

📅 发布时间:2026/9/17 22:04:11
Umi-OCR免费离线OCR:4个场景,文件不出本机
Umi-OCR免费离线OCR4个场景文件不出本机【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费OCR工具也是少数真正离线的离线OCR识别全程在本机完成文件不出机器断网照常跑。它把屏幕取字、批量图片转文字、扫描PDF加文字层、二维码读写收进同一个窗口里。为什么是它离线安全图片、文档都在本地过一遍内置模型不经过任何服务器。给公司、诊所传文件有顾虑的人用它最稳。免安装下载压缩包解压即用不写注册表、不装运行时。换电脑频繁的人拷一份就能带走全部设置。免费开源不收费、无账号墙、不按字数计次代码公开可查。想自己编译、改流程的开发者可以直接动源码。5分钟跑起来 下载发行包.7z压缩包或.7z.exe自解压包。→ 看到压缩文件在本地落盘自解压包连压缩软件都省了。解压到任意目录。→ 看到Umi-OCR.exe和一堆运行文件。双击Umi-OCR.exe启动Linux 上跑umi-ocr.sh脚本。→ 主界面弹出标签页一目了然。首次打开时界面语言跟随系统。想换简中、繁中、英、日、俄、葡或深浅主题进「全局设置」切一下就好。想自己构建克隆仓库后按 README 说明操作。论文里选不中的死文字 ️PDF 阅读器里有些文字锁得死死的右键选不中。打开「截图OCR」标签页。按页面里的快捷键在屏幕上框住那段话。看右侧识别记录栏选中结果直接复制。结果不理想时调高图片对比度或转灰度中英混排就选混合语言还可以换内置的另一套引擎再跑一遍。一夹发票扫描件进表格 几十张 jpg 发票躺在文件夹里文字要进表格手敲不现实。打开「批量OCR」页把整个文件夹拖进去。jpg、png、webp、bmp、tif 都能进几百张照排。水印 LOGO 固定在同一个位置按住右键在图上画矩形框住它框内文字块整块跳过。勾选保存格式txt、jsonl、md、csv 四选一csv 可直接进 Excel。看左侧列表每张图的耗时和状态都列得清清楚楚。跑得很慢时把「限制图像边长」调高任务拆成几批排队比硬扛一张超长图快。大任务跑完还能勾选自动关机。扫描PDF变可搜索 300 页扫描教材里 CtrlF 一点就扑空——因为它本质是一摞图片。打开「文档识别」标签页把 PDF 拖进去。有固定页眉页脚先框进忽略区域再开跑。任务完成导出结果。拿到的是一份双层可搜索PDF原扫描图完整保留为图像层版式、插图原样不动OCR 把每页文字转成一层透明文本叠在图上。CtrlF 命中的是文字层能定位到第几页整段复制也没问题。PDF 之外XPS、EPUB、MOBI、FB2、CBZ 也支持。文字层由内置的 RapidOCR、PaddleOCR 两套离线模型生成不联网。不想开界面 ⌨️命令行入口就是主程序本身。把整个文件夹识别进一个文件umi-ocr --path D:/images --output D:/result.txt程序化调用走本地 HTTP 接口图片识别、文档识别、二维码读写都有对应端点只监听本机环回不经过物理网卡。参数细节看 命令行手册 和 HTTP接口手册。上手前先知道边界识别率吃输入质量艺术字、潦草手写有上限调参数救不了。大文件、超长图吃内存4GB 以下内存的机器减小单批数量或调低「限制图像边长」。HTTP 接口对并发不友好脚本里串行调用。语言包覆盖中英日韩法德等常用语言小语种内容建议选混合语言包。Umi-OCR 把截图取字、批量转文字、扫描PDF加文字层、二维码读写收进同一个免费离线的本地工具文件从头到尾没离开过你的机器。更多细节看 README有问题去项目社区提 Issue 就行。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考