截屏、离线OCR、屏幕翻译一条龙我使用 eSearch 整理资料的真实体验【免费下载链接】eSearch截屏 离线OCR 搜索翻译 以图搜图 贴图 录屏 万向滚动截屏 屏幕翻译 Screenshot Offline OCR Search Translate Search for picture Paste the picture on the screen Screen recorder Omnidirectional scrolling screenshot Screen translator 支持Windows Linux macOS项目地址: https://gitcode.com/GitHub_Trending/es/eSearch说实话以前我每次遇到屏幕上这段字怎么复制不出来的瞬间都会默默掏出手机重新拍一遍。直到上个月整理一本古籍扫描件想引用其中一句原文手打了十分钟还没打完我才认真去折腾截屏工具的离线OCR 能力然后遇到了 eSearch——一个把截屏、离线OCR、搜索翻译、以图搜图、贴图、录屏全塞进同一个托盘图标里的免费开源软件。这篇文章就是我用了大半个月的真实记录。一页纸看懂 eSearch 能干什么打开软件它不会弹出一个主窗口而是安静地待在系统托盘里等你要用的时候再出现。它最拿手的几件事我列在这里框选截屏 标注矩形、自由画笔、几何图形、马赛克、模糊、取色器一应俱全适合做教程截图、标重点、量颜色。离线OCR 文字识别框选后按一下回车屏幕上的文字直接变成可编辑文本全程不联网适合处理古籍、PDF 扫描页、加密文档截图。搜索 翻译 屏幕翻译识别完顺手就能搜或翻还能把视频、游戏里的外文直接翻译成贴图盖在原位上适合追生肉、读外文论文。以图搜图框选图片区域一键去谷歌、百度、Yandex 搜同款适合找素材出处、查商品。贴图 滚动截屏 录屏把截图钉在屏幕上随时参考还能横向竖向任意方向拼接长图甚至带自动聚焦的超级录屏。从零到一我的第一次完整上手实录下面是我从下载到完成第一个任务的全过程完全是第一人称视角照着做你也能跑通。第一步安装并唤醒它我是在自己的电脑上直接从发布页下载对应系统的安装包Windows 装完如果提示下载截屏依赖库点一下跟随微软官网安装即可Linux 的 Arch 用户也可以在 AUR 里搜e-search。想从源码跑也很简单git clone https://gitcode.com/GitHub_Trending/es/eSearch cd eSearch npm install npm run start装完打开它没有任何主窗口只在托盘里多了个图标同时弹了个已运行的通知。这个没有主窗口的设计一开始让我愣了几秒后来才发现这恰恰是它的优点不占地方随叫随到。第二步按下快捷键框选回车默认快捷键是AltC按下去整个屏幕变暗出现一个十字光标。我拖出一个框选中了古籍扫描页里的一段竖排文字然后直接按下回车——是的离线OCR 是默认开启的不需要任何配置。几秒后弹出主页面左边是原图右边是识别出的文字。竖排文字按从上到下、从右到左的顺序整齐排好了段落也没被拆得七零八落那一刻我确实是有点惊喜的。如果识别有错直接在图片区点选原文编辑区会自动同步选中对应文字改起来非常顺手。第三步识别完顺手翻译和搜索我把框选目标换成一段英文论文摘要识别后点了翻译按钮全文直接翻成了中文。之后我又试了试屏幕翻译截取视频里的一段日语字幕它生成一个贴图窗口盖在原字幕上方把文字替换成中文翻译还能设置定时自动翻译追番的时候真的省心。第四步把结果存下来识别翻译完的文字可以直接复制、保存成 txt / Markdown / HTML还能保存到历史记录方便回头翻。整个流程下来我从对着屏幕手打变成了框选一下、校对两分钟、直接导出效率完全不是一个量级。最容易踩的 3 个坑我替你踩过了下面这几个问题我都在使用中真实遇到过直接给对比Gnome 桌面托盘图标不见了✘ 以为软件没启动反复重开 ✔ 安装 appindicator 扩展插件后托盘正常显示软件其实一直在后台跑。OCR 结果换行乱七八糟✘ 直接复制识别结果发现每行都是独立的 ✔ 在主页面打开自动删除换行它会分析结尾符号智能合并再开启段落识别竖排、分栏的版式也能保持原貌。复制 PDF 里的文字遇到多余换行时这招同样有效。装了新版后出现以前没有的报错✘ 到处搜教程、重装软件 ✔ 先试试设置 → 高级 → 高级设置 → 恢复默认设置多半是旧版本配置不兼容导致问题立刻消失。用之前 vs 用之后一张表看明白我把整理一篇外文资料的实际差别列在下面直观感受一下环节没用 eSearch 之前用了 eSearch 之后获取屏幕文字手动照着屏幕打字一篇论文约 30 分钟框选 回车几秒出全文校对约 5 分钟翻译复制到网页翻译来回切换窗口识别后一键翻译还能多个引擎同时对照截屏标注截图后另开画图软件编辑框选界面里直接画框、打码、取色一步到位竖排/古籍文本几乎无解只能手工录入离线OCR 自动按传统顺序输出段落不乱长截图/录屏需要多张拼接或用专用软件滚动截屏任意方向拼接录屏自带焦点跟随3 个官方没重点宣传、但真的好用的小技巧把框选后默认操作设成 OCR一步到位在截屏界面右键 OCR 按钮或小圆点可以把它设为默认操作以后框选完松手就自动识别连回车都省了。为什么有效因为它砍掉了框选 → 找按钮 → 点击中间的每一步适合高频使用。大小栏可以直接输入算式框选时顶部会显示坐标和尺寸的数字这些数字是可以直接点击编辑的。我偶尔需要截一个精确尺寸的区域直接输入800*500或坐标的四则运算按下回车选区就精准调整比鼠标拖半天准得多。给 OCR 下载更多语言模型在设置里可以下载日文、韩文、繁体、拉丁字母等模型下载完自动加入列表框选 OCR 时点按钮右上角的小圆点就能切换引擎。处理非中文内容时识别率提升非常明显而且依然是纯离线的。现在就可以开始做的 3 件事下载安装 eSearch按下AltC框选一段屏幕文字体验一次默认开启的离线OCR在设置里把框选后默认操作设为文字识别再配一个自己顺手的全局快捷键打开设置-OCR下载一个你常用语言的模型顺便开启自动删除换行eSearch 是开源的代码、文档都在项目仓库里遇到问题或有好点子也欢迎提 issue 或参与贡献。别的不说光是框选一下屏幕上的字就是你的了这一点就值得你今晚花五分钟试试。【免费下载链接】eSearch截屏 离线OCR 搜索翻译 以图搜图 贴图 录屏 万向滚动截屏 屏幕翻译 Screenshot Offline OCR Search Translate Search for picture Paste the picture on the screen Screen recorder Omnidirectional scrolling screenshot Screen translator 支持Windows Linux macOS项目地址: https://gitcode.com/GitHub_Trending/es/eSearch创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考