ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

eSearch离线OCR识别竖排文字实操:两个开关一次框选,古籍照片也能转成通顺文本

eSearch离线OCR识别竖排文字实操:两个开关一次框选,古籍照片也能转成通顺文本 eSearch离线OCR识别竖排文字实操两个开关一次框选古籍照片也能转成通顺文本【免费下载链接】eSearch截屏 离线OCR 搜索翻译 以图搜图 贴图 录屏 万向滚动截屏 屏幕翻译 Screenshot Offline OCR Search Translate Search for picture Paste the picture on the screen Screen recorder Omnidirectional scrolling screenshot Screen translator 支持Windows Linux macOS项目地址: https://gitcode.com/GitHub_Trending/es/eSearch前阵子帮长辈整理家里的一页清代家谱照片竖排繁体密密麻麻。把它拖进常用的识别工具出来的文字虽然能读顺序却全乱了——本该从右往左、从上到下读的一列列字被硬生生拼成了横排。后来换成 eSearch 离线OCR 重新识别几分钟就拿到了通顺文本。这篇文章把整个过程完整记录下来怎么安装、哪两个开关最关键、如何框选识别以及识别之后怎么校对。照着一遍走下来你就能独立完成一次竖排文字识别遇到问题也知道去哪个设置里排查。动手之前把 eSearch 装进电脑先简单认识一下它。eSearch 是一款免费开源软件把截屏、离线OCR、搜索翻译、贴图、录屏都放在了同一个界面里。平时你大概只用得上其中一两样但遇到竖排文字这种偏门需求它内置的那套离线 OCR 引擎刚好能顶上。这套引擎基于 PaddleOCR模型直接装在本地开箱即用。不联网、不注册、不收费扫描件里的隐私内容也不会传到任何服务器。安装方式按系统选一种即可Windows 用户打开命令行输入winget install esearchArch 系 Linux 用户在 AUR 里搜索e-search即可安装。macOS 和其他发行版去项目的发布页下载对应系统的安装包。想从源码自己构建依次执行git clone https://gitcode.com/GitHub_Trending/es/eSearch cd eSearch npm install装好后直接运行。此时 OCR 已经可用不需要任何联网配置。离线OCR设置的关键两个开关决定竖排成败我第一次用默认设置去识别那页家谱结果很打击人字都认出来了但列和列的顺序是乱的句子断得七零八落。问题不在软件不够聪明而在两个默认开关上。打开设置找到文字识别OCR一栏留意下面两个开关。第一个是整体方向识别把它关掉。这个开关的描述原话是识别整体方向并纠正不适合竖排文字。它的作用是检测整张图的文字方向并强行纠正对横排是好事遇到竖排反而会把阅读顺序搅乱。可以把它理解成一副固定度数的眼镜——度数配给了横排文字戴到竖排上只会更晕。第二个是识别段落保持开启。它在 OCR 段落识别里负责分析分栏与阅读顺序让输出符合从上到下、从右到左的原版阅读习惯。家谱、古籍里常见的分栏和双行小注靠的就是它。顺带提一句如果某些特殊版面在开启后段落顺序反而出错可以试着关掉它做对比效果以实际版面为准。一次框选就出结果AltC 的完整操作路径设置调好之后识别本身非常快按AltCmacOS 上是⌥C进入框选模式。鼠标拖出一个选区把要识别的古籍区域圈起来。工具按钮会跟随选区自动移动点击文字识别按钮即可也可以在设置里把文字识别设为框选后默认操作这样框选完自动开始识别。识别完成后结果会和原图一起出现在编辑页左侧是图片右侧是文字。再读那页家谱顺序就对了——从右往左一列一列段落结构也保留着。第一次完整的竖排识别到这里就成功了整个过程用不了一分钟。自动删除换行把断行拼回通顺的句子识别出来的文字有时还带着换行古籍版面的每列字会被拆成一个个短行直接复制出去并不好读。这时用自动删除换行。它会分析行尾标点把多余的换行去掉遇到拉丁文还会在单词之间自动补空格。你可以对整个文本执行也可以选中部分文字单独处理。那页家谱处理完换行之后一整页内容就变成了一段段通顺的正文可以直接存档。图上选字、右侧同步古籍文字识别后的校对OCR 再准也难免看走眼尤其是繁体字字形相近很容易认错。eSearch 在编辑页提供了一套双向校对方式。在左侧图片上点选文字右侧编辑器会同步选中对应的内容反过来在编辑器里选中文字左侧图片区也会自动定位到原文位置。相当于图上指哪编辑器就选哪逐句核对非常直观。编辑器自带拼写检查疑似错误的地方会出现蓝色波浪线一眼就能发现。比如風和鳳这类容易混的繁体字哪里标了线就回去核对哪里。如果觉得某一段被段落识别处理得不满意按撤回快捷键可以恢复到未识别段落前的原始排版重新整理。让重复劳动更省事三个小开关和模型下载入口识别竖排古籍常常是批量活一次处理十几页甚至几十页值得把几个省事选项打开框选后默认操作设为文字识别框完即识少按一次回车。开启OCR后自动复制到剪贴板识别完直接去文档里粘贴。需要识别中文繁体、日文、韩文、拉丁文等语种时到设置-OCR 页面下载对应离线模型。下载完自动加入模型列表随时切换。德语这类欧洲语言对应拉丁文模型页面上都有文字说明。这几个开关都在设置里打开一次之后每一页都能省几秒几十页下来就是好几分钟。识别结果不对按这张排查表逐步检查实际操作中遇到问题先别急着重装按下面这张表从前往后查大部分情况都是设置问题现象检查项解决办法竖排被读成横排、顺序全乱整体方向识别是否开着在 OCR 设置里关闭它段落、列序混乱识别段落是否开启确认已开启仍乱则撤回恢复原始排版再试繁体、日文识别结果差当前用的是哪个模型到设置里下载对应语言模型并切换框选后找不到识别按钮工具栏位置、默认操作工具栏跟随选区移动或将默认操作设为文字识别识别准确率普遍偏低图片质量保证文字清晰、对比度足够必要时旋转图片对齐方向 竖排识别不理想时第一个要看的就是整体方向识别这是最常见的原因。竖排文字识别还能用在哪些地方家谱只是其中一个例子这套流程换个场景同样成立书法作品转录把照片拍正、框选竖排的行草内容也能转成文字存档。竖排繁体 PDF 摘录截图识别后经过双向校对摘录质量往往比直接复制 PDF 原文还高。日文、韩文竖排资料切换对应语言模型即可。民国报纸、老式招贴分栏版面交给段落识别处理。横排 PDF 的多余换行同样可以用自动删除换行一键整理。结尾一张设置速查卡把这一路用到的关键点收成一张卡方便下次照着做快捷键AltC进入框选。设置 → 文字识别OCR→ 关闭整体方向识别。确保识别段落开启。可选开启自动删除换行、框选后自动OCR、OCR后自动复制。其他语言设置 → OCR → 下载对应离线模型后切换。校对左侧图上选字右侧编辑器同步定位。✅ 更详细的设置说明在项目源码自带的docs/use/ocr.md和docs/use/start.md里遇到文档没覆盖的情况也可以去项目仓库反馈一起把这款工具打磨得更好用。【免费下载链接】eSearch截屏 离线OCR 搜索翻译 以图搜图 贴图 录屏 万向滚动截屏 屏幕翻译 Screenshot Offline OCR Search Translate Search for picture Paste the picture on the screen Screen recorder Omnidirectional scrolling screenshot Screen translator 支持Windows Linux macOS项目地址: https://gitcode.com/GitHub_Trending/es/eSearch创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表