ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Umi-OCR:免费离线 OCR 软件,截图取字与批量图片转文字一键完成

Umi-OCR:免费离线 OCR 软件,截图取字与批量图片转文字一键完成 Umi-OCR免费离线 OCR 软件截图取字与批量图片转文字一键完成【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费、开源、离线运行的 OCR 文字识别工具识别全程在本地完成文件不经过任何服务器。它把截图取字、图片文件夹批量转文字、扫描件转双层可搜索 PDF、二维码读写这四件事收进了一个解压即用的程序里。手写稿和艺术字不在它的擅长范围输入质量再差也救不回来。3 步跑起来 下载发行包.7z压缩包或.7z.exe自解压包没装压缩软件也能直接解压。解压到任意目录无需安装。双击Umi-OCR.exe启动Linux 用户运行umi-ocr.sh启动脚本。首次打开时界面语言会跟随系统自动切换。想换语言或深浅色主题进「全局设置」→「语言 / 主题」即可简中、繁中、英、日、俄、葡等语言都在列表里。核心场景实操 屏幕上的文字选不中框选一下就能拿走目标把屏幕上任意区域的文字提取出来复制走。打开「截图OCR」标签页。按页面上标注的快捷键唤起截图框选那段文字。识别结果出现在右侧记录栏直接复制。技巧结果不是图片而是文本每条记录都能改字选中多条还能一次性复制。图片来源不限于截屏在别处复制一张图粘贴进来同样能识别。代码截图建议把排版方案切到「单栏-保留缩进」行首空格原样保留。图片文件夹批量转文字目标把一堆 jpg、png 图片一次出文字省去逐张复制。打开「批量OCR」页把整个文件夹直接拖进去。等任务跑完左侧列表能看到每张图的耗时和状态。勾选想要的保存格式txt、jsonl、md、csv 四种csv 可直接进 Excel。jpg、jpe、jpeg、jfif、png、webp、bmp、tif、tiff 都能进数量没有硬性上限几百张照排子文件夹也会被一并扫描。跑大任务前可以先勾选「完成后自动关机」。扫描件变成可搜索 PDF目标让扫描版文档支持 CtrlF 定位文字能整段复制。打开「文档识别」标签页把文件拖入。页眉页脚固定的话用忽略区域把那个位置框掉。任务完成后导出得到双层可搜索 PDF。PDF 之外XPS、EPUB、MOBI、FB2、CBZ 也支持任务完成后可选自动关机或休眠。如果某个 PDF 报无法处理把它逐页转成图片再走批量识别通常能绕过去。二维码批量读码与生成目标一次读出多张截图里的码或反手生成一张码图。打开「二维码」标签页把图片拖入。批量读出全部内容一张图贴好几个码也没问题。反过来在「生成码」里粘贴一段文本立刻得到图片。二维码、一维条码、PDF417 等 19 种协议都能读生成时宽高和纠错等级都可以指定。任务入口关键点提取屏幕文字截图OCR 页快捷键框选结果栏可编辑图片批量转文字批量OCR 页输出 txt / jsonl / md / csv扫描件转可搜索 PDF文档识别 页输出双层 PDF支持忽略区域二维码读码 / 生成二维码 页19 种协议一图多码脚本里跑识别umi-ocr命令行可指定路径与输出文件程序内调用本地 HTTP 接口仅环回访问串行调用剔除水印页脚右栏忽略区域右键画框整块跳过整理输出排版各页设置切换排版解析方案让结果更准的技巧 输出总差几个字时先把图片对比度调高或转成灰度图再识别。核对识别语言是否匹配内容中英混排选混合语言包。内置 RapidOCR 与 PaddleOCR 两套离线引擎一套效果不好就换另一套再跑一遍。固定位置的水印或页脚进右栏「忽略区域」按住右键画矩形框框内的整个文字块会被直接跳过框尽量画大一点。多栏排版、代码截图在设置里切换「排版解析方案」「多栏-按自然段换行」适合大部分场景「单栏-保留缩进」给代码用。超大长图把「限制图像边长」的数值调高再把任务拆成几批排队比硬扛一张超长图快得多。不开界面的用法 ⚙️不想开窗口时命令行入口就是主程序本身。把整个文件夹识别到一个文件里umi-ocr --path D:/images --output D:/result.txt这条命令适合写进批处理脚本、配合快捷键做定时任务参数细节见 命令行手册。需要程序化调用时软件自带本地 HTTP 接口图片和文档识别都能走接口。它默认只监听本机环回不经过物理网卡可以放心在本地程序里使用。注意它对并发不友好脚本里请串行调用用法见 HTTP 接口手册。它是怎么工作的 生成双层 PDF 时你的原始扫描图作为图像层完整保留版式、插图、字体原样不动OCR 只在图上叠了一层透明文字搜索和复制指向的就是这层文字。所以你看到的仍是扫描件本身CtrlF 却能命中内容。整个识别过程由内置的离线模型在本地跑完不需要联网。这些情况别用 ⚠️艺术字、潦草手写识别率本身就低调参数也救不了。大文件和超长图吃内存4GB 以下内存的机器建议减少单批数量或调低「限制图像边长」。HTTP 接口并发能力有限连续大批量调用偶尔会报错重试即可脚本务必串行。识别语言包覆盖中、英、日、韩、法、德等常用语言小语种内容建议选混合语言包再识别。Umi-OCR 把截图取字、批量转文字、扫描件变可搜索 PDF、二维码读写这四件事装进了一个免费离线的小工具里。更多细节看 README遇到问题到项目社区提 Issue 即可。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表