eSearch 免费离线 OCR 截图工具实战指南:从截屏识别到屏幕翻译的一站式方案
eSearch 是一款免费开源的离线 OCR 截图工具,它把截屏、文字识别、搜索翻译、以图搜图、贴图和录屏全部装进同一个软件里,覆盖 Windows、Linux 和 macOS 三大平台。对普通用户来说,最直观的价值只有一句话:屏幕上任何复制不走的文字,框选一下就能变成可编辑文本,还能顺手完成翻译和搜索。
那些复制不动的文字,正在偷走你的时间
上周我看一门网课回放,老师 PPT 上的关键结论怎么都选不中,只能对着屏幕一个字一个字敲进笔记,半小时过去腰都酸了。类似场景你一定也遇到过:网页图片里的电话号码、外文软件界面的选项、扫描版文档的段落、视频字幕里的台词——它们明明"看得见",却永远"摸不着"。
传统做法是截图、存图、打开 OCR 网站、上传、等结果、再复制出来,一套流程走完少说五分钟。而 eSearch 想做的,是把这条流水线压缩到"框选 + 回车"两个动作。它最初的设计灵感来自手机上的"大爆炸"和"传送门"——屏幕上出现什么字,就立刻能搜索、翻译,只是这次搬到了电脑上,而且完全离线、完全免费。
三十秒速览:eSearch 能帮你做什么
| 功能 | 具体能力 | 适合谁 |
|---|---|---|
| 截屏 + 标注 | 框选、取色器、画笔、几何图形、马赛克、模糊 | 日常截图党、教程作者 |
| 离线 OCR | 不联网识别,支持竖排文本、图片旋转识别 | 学生、文字录入、古籍整理 |
| 搜索 + 翻译 | 识别后直接搜索或翻译,支持多引擎并行 | 阅读外文资料、查单词 |
| 以图搜图 | 对接谷歌、百度、Yandex,可接多模态大模型 | 找图、图片溯源 |
| 屏幕贴图 | 图片钉在屏幕最上层,可缩放、调透明度、鼠标穿透 | 写代码、做设计时的对照参考 |
| 滚动截屏 | 横向、竖向、任意方向拼接长图 | 长网页、聊天记录 |
| 录屏 + 屏幕翻译 | 摄像头、虚拟背景、光标高亮;字幕实时替换翻译 | 课程录制、看生肉视频 |
一句话判断是否值得装:只要你的日常工作离不开屏幕和文字,它就值得放进托盘里。
从按下快捷键到拿到第一份识别结果
安装并启动 eSearch 后,它不会弹出主窗口,而是安静地驻留在系统托盘。按下默认快捷键 Alt+C(macOS 是 ⌥C),屏幕立即进入截屏状态,默认框选全屏。
按住鼠标拖出选区,松开后屏幕下方出现一条工具栏。点下"文字识别"按钮,识别结果随即在主页面展开——整个过程不到十秒,而且第一次使用就能直接用,离线模型内置,不需要申请任何 API、不需要联网。
拿到文字之后有三个常用去向:
- 搜索:识别结果一键交给搜索引擎,查资料不用切换窗口;
- 翻译:内置谷歌等免费翻译引擎,也可以换成 DeepL、百度,甚至接入 ChatGPT 或本地 AI,支持多引擎同时翻译、择优取用;
- 校对:主页面下方是图片区和编辑区,鼠标在图片上划过,对应文字会同步选中到编辑区;反过来在编辑区选中文字,也能自动定位回原图。配合 Chrome 拼写检查的蓝色波浪线,识别错误一眼就能揪出来。
想进一步调优识别体验,打开设置里的"文字识别(OCR)":勾选段落识别保持原文版面结构,开启自动删除换行去掉多余的断行(这一招对复制 PDF 文字同样有效),还能在设置里直接下载日文、韩文、中文繁体等十多种离线模型。
新手最容易踩的五个坑与排查顺序
装好软件不等于万事大吉,这几个坑我替你踩过了:
- Windows 提示下载依赖库 ⚠️ 这是截屏库需要的微软运行库,点击下载并安装,完成后重启即可,属于正常流程。
- Gnome 桌面快捷键无响应、托盘不显示 ⚠️ 需要额外安装 appindicator 扩展来支持托盘图标,装完注销重登即可。
- macOS 提示"文件已损坏" ⚠️ 这是系统对互联网下载的 dmg 的限制,并非文件真的损坏,按你的系统版本搜索对应解除方法就能解决。
- 更新版本后出现新问题 ⚠️ 多为旧配置不兼容,去"设置 - 高级 - 高级设置"里恢复默认配置,多数情况可修复。
- 识别结果断行错乱 ⚠️ 先确认段落识别和自动删除换行是否开启;若识别不准,优先检查图片是否清晰、文字是否过小。
遇到问题别急着重装,按这个顺序自查:图片清不清 → 设置对不对 → 模型全不全 → 配置要不要重置。另外注意,Wayland 环境下无法读取选中的文字,直接用快捷键截屏即可。
让 eSearch 效率翻倍的进阶技巧
- 框选后默认操作:在"设置 - 快捷键"里给 OCR、复制等操作绑定全局快捷键。绑定后按一下快捷键,框选完成即自动识别,一步到位,省掉点按钮的动作。
- OCR 后自动复制:设置里打开"识别后自动复制到剪贴板",识别完直接 Ctrl+V 粘贴到文档。
- 屏幕翻译定时刷新:看视频、打游戏时开启定时翻译,字幕会被替换成译文,且支持多引擎取优。
- 自定义模型与 AI 加速:用 PaddleOCR 训练、Paddle2ONNX 转换后,在"设置 - OCR"里添加 det/rec 模型和字典文件;默认 CPU 推理已够用,支持 CUDA、coreML(mac)、DirectML(Windows)加速。
- 便携版一键转换:设置里可直接把软件转为绿色版,配置随软件目录走,放进 U 盘即插即用。
高频问题速查
Q:离线 OCR 和在线 OCR 怎么选? A:离线完全免费、不联网、隐私安全,默认内置可直接用;在线(百度、有道、大模型)速度更快、精度更高,但需要申请 API Key。
Q:古籍竖排文字能识别吗? A:可以。eSearch 支持竖排文本与图片旋转识别,框选后直接识别即可;配合段落识别保留版面,再用双向同步校对精修。
Q:安装包为什么这么大? A:里面打包了 Electron 运行时、onnx 推理库、离线识别模型、录屏人像模型和物体移除模型,功能全在本地,这是离线能力的代价。
Q:能识别哪些语言? A:中英混合、中文繁体、英文、日文、韩文,以及泰卢固文、卡纳达文、泰米尔文、拉丁文、阿拉伯字母、斯拉夫字母、梵文字母,模型在设置里下载。
现在,你可以把截图变成生产力了
从按下 Alt+C 到拿到可编辑文字,整个过程不到十秒。eSearch 最打动人的地方在于:离线、免费、跨平台,把截屏、OCR、翻译、搜索、贴图、录屏这些高频动作拧成了一条流水线,不再让任何一段"看得见摸不着"的文字卡住你的工作。
想立刻上手,去项目 releases 页面下载对应平台的安装包;想从源码运行或参与贡献,可以克隆仓库:git clone https://gitcode.com/GitHub_Trending/es/eSearch。更详细的说明可以参考项目内的文档:快速开始、OCR 全解、设置说明。装好之后,试着对一段复制的文字按一下 Alt+C——你会发现,处理文字这件事,原来可以这么顺手。
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考



