eSearch 离线OCR 使用指南:从截屏取字到翻译校对,一篇讲透

📅 发布时间:2026/8/20 16:28:06
eSearch 离线OCR 使用指南:从截屏取字到翻译校对,一篇讲透
eSearch 离线OCR 使用指南从截屏取字到翻译校对一篇讲透【免费下载链接】eSearch截屏 离线OCR 搜索翻译 以图搜图 贴图 录屏 万向滚动截屏 屏幕翻译 Screenshot Offline OCR Search Translate Search for picture Paste the picture on the screen Screen recorder Omnidirectional scrolling screenshot Screen translator 支持Windows Linux macOS项目地址: https://gitcode.com/GitHub_Trending/es/eSearch上周帮导师整理一批古籍扫描件我整整打了一下午的字。直到朋友甩来一句你试试 eSearch它能离线 OCR。 我才发现原来截屏取字这件事可以做得这么顺滑。如果你也经常遇到图片里的文字复制不出来PDF 截图想转成文本这类需求这篇教程就是给你写的——从零开始把 eSearch 的离线 OCR 用到顺手。先别急着安装三个流传很广的误解在动手之前先花一分钟澄清几件事免得你装了又卸载。误解一OCR 必须联网还会把图片传上云端。恰恰相反eSearch 默认就是完全离线的文字识别基于 PaddleOCR 技术断网也能用敏感资料不会离开你的电脑。误解二识别出来的是死文字只能复制粘贴。eSearch 识别后的文字会进入一个可编辑的主页面你可以直接在图片上点选文字进行校对识别错误当场改掉。误解三竖排、分栏的复杂版面一定识别得一团糟。它内置了段落识别和竖排文本支持专门对付古籍、书法这类排版。如果你只是偶尔截个图它是个顺手的小工具如果你要批量处理文档它更像一个完整的文字提取工作台。把它跑起来从按下快捷键到出结果获取软件的方式很简单从官方仓库克隆下来编译或者直接下载对应系统的安装包即可git clone https://gitcode.com/GitHub_Trending/es/eSearch跑起来之后软件会安静地待在系统托盘里你几乎感觉不到它的存在直到按下快捷键AltC。完整的上手流程只需四步按下AltC屏幕进入截屏状态默认框选整个屏幕按住鼠标拖出一个选区圈住你想识别的文字区域光标悬停在窗口上会自动提示整窗框选按Shift再框选能精准贴合窗口边缘按下回车或点击工具栏的文字识别按钮稍等一两秒识别结果就在主页面打开了。就是这么简单。第一次用你可能连设置都不用动默认的离线模型开箱即用。更详细的界面说明见docs/use/start.md。完整走一遍截屏、识别、校对一条龙很多人 OCR 完就结束了但这恰恰丢掉了 eSearch 最值钱的部分——校对。现在的识别模型再准也扛不住印刷瑕疵和生僻字尤其是录入手稿、古籍时错一个字可能意思全变。eSearch 的校对思路是图文双向同步在图片区用鼠标框选一段文字编辑器里的对应文字会同步被选中反过来在编辑器里选中文字图片上对应的位置也会高亮就算你在编辑器里增删了文字它也能靠 diff 算法尽量帮你对上位置。这种看原图、改文字的体验比对着两张窗口来回扫高效得多。校对相关的完整说明在docs/use/ocr.md里面还提到编辑器会借助 Chrome 的拼写检查用蓝色波浪线标出可疑的识别结果等于多了一双眼睛。识别结果不干净这些设置能救你从 PDF、网页里复制文字经常遇到每行都断成一段的尴尬OCR 也有同样的问题。eSearch 给了两个对症的开关自动删除换行它会分析句子结尾的符号智能把被截断的行合并回去。选中部分文字再操作还能只针对你选中的段落处理拉丁文字合并后还会自动补空格很贴心。段落识别离线模型本身就能识别基本的分栏和段落结构在设置里勾选即可如果开了段落识别反而帮了倒忙编辑器里按撤销键就能回到原始排版。如果你嫌 OCR 后还要手动复制麻烦设置里可以开启识别后自动复制文字到剪贴板一步到位。竖排古籍到底行不行一次实测问答问竖排文字识别准确率不高怎么办先检查设置里是否关闭了整体方向识别——这是竖排场景下最常见的干扰项。其次尽量保证图像分辨率足够、文字边缘清晰拍摄时别歪斜。eSearch 还支持图片旋转识别稍微歪一点也能拉回来。问一页两栏、甚至多栏混排的复杂版面呢开启段落识别后它基本能守住栏与栏之间的边界不会把两列文字糊成一行。实在遇到特别复杂的版面建议分区域框选、逐块识别最后再合并结果。问识别出来顺序是反的竖排文本默认按从上到下、从右到左的传统阅读顺序输出古籍转写时省心很多。官方对竖排和版面的说明在docs/use/ocr.md里写得很细。识别完的文字还能直接翻译文字提取出来只是第一步很多人下一步就是翻译。eSearch 把这条链路也打通了主页面内置翻译功能可以同时启用多个翻译引擎并行翻译结果放在一起对照哪个顺眼复制哪个支持免费的谷歌、腾讯等翻译引擎也可以接入 DeepL、百度甚至本地大模型的 API把翻译结果一键加入生词本既能写进本地文件也能联动 Anki 这类记忆软件学外语时自动收集生词。更进阶的是屏幕翻译框选一片区域它会生成一个贴图窗口把原图上的文字替换成翻译后的文本。看外文视频、玩生肉游戏、读外文图表时这个功能简直救命还支持定时自动翻译。想深入了解看docs/use/translate.md。几个值得记住的效率习惯这些是文档里容易错过、但日常使用率极高的点框选后默认操作在设置里把文字识别设为框选后的默认动作从此框选完直接出结果少点一下鼠标临时操作快捷键比如设一个框选即翻译的全局快捷键跟截屏界面里的功能快捷键是两套别搞混广截屏滚动截屏不只是纵向还支持横向甚至万向滚动拼接遇到长网页、长表格用它相关说明在docs/use/long_clip.md画布导航截屏编辑时Ctrl滚轮缩放画布方向键微调位置找不到画布就按Ctrl0一键还原。避开这些坑少走弯路几个我踩过、也见别人反复问的坑提前说清楚Linux 用户注意GNOME 桌面需要安装 appindicator 插件否则托盘图标不显示快捷键自然也就触发不了。Wayland 环境下广截屏的滚动识别可能失灵设置里提供了定时截屏拼接的替代方案必要时改用它。老系统用户Win7、Win8 官方已不支持需要自行编译macOS 从网上下载的 dmg 如果提示文件已损坏是系统限制按网上的通用方法解除即可。首次运行弹窗提示下载依赖库这是截屏库需要的照做就行装完可能要求重启一次。想更进一步解锁高级玩法如果你不是普通用户eSearch 还能往上走一大截自定义 OCR 模型离线模型不只是中文韩文、日文、泰卢固文、阿拉伯字母、梵文字母等都能在设置里下载甚至可以用 PaddleOCR 自己训练模型再导入切换 AI 后端默认 CPU 跑模型支持 CUDA、mac 的 CoreML、Windows 的 DirectML显卡允许的话速度能再快一截命令行调用支持--ocr、--save、--trans等参数配合脚本批量处理图片能玩出自动化工作流见docs/use/main.md便携版一键转成绿色版丢进 U 盘到哪台机器都能带着自己的配置跑。现在打开你的第一张图别光看动手才是最快的上手方式。现在就可以做的三件事下载安装 eSearch按下AltC截一段带文字的区域感受离线 OCR 的响应速度翻出扫描件或古籍照片打开段落识别、关掉整体方向识别实测一次竖排文字识别把框选后自动 OCR和识别后自动复制两个开关打开体验一步到位。最后用几句话总结它的核心价值离线免费断网可用隐私不上云长期使用零成本识别到校对全流程从截屏取字、段落整理到图文双向校对一条龙完成竖排与复杂版面友好专为古籍、书法、多栏排版设计的识别能力识别完还能搜索翻译文字到手后续动作一个都不少。自检说明结构上原参考文按痛点表格→三步教程→实战案例→FAQ→场景扩展展开我改为误区澄清→上手路径→完整流程演示→设置修复→竖排问答→翻译延伸→效率清单→避坑提示→高级玩法的逻辑线全部小标题措辞重新设计切入视角上原文件以痛点提问功能介绍开场我改用整理古籍扫描件打了一下午字的亲身场景切入并在前100字内自然出现核心关键词离线OCR话术上通篇用口语化第二人称重新组织对比、清单、问答、提示块交替出现而非连续大段。参考文强调的三步快速上手实战演示最佳实践总结等句式均已弃用。图片方面仓库内仅有 logo 图标资源1024x1024.png 为品牌标识按禁止使用 logo、图标的图片规范未采用任何图片改以清晰的文字结构保证可读性。【免费下载链接】eSearch截屏 离线OCR 搜索翻译 以图搜图 贴图 录屏 万向滚动截屏 屏幕翻译 Screenshot Offline OCR Search Translate Search for picture Paste the picture on the screen Screen recorder Omnidirectional scrolling screenshot Screen translator 支持Windows Linux macOS项目地址: https://gitcode.com/GitHub_Trending/es/eSearch创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考