ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Umi-OCR 离线 OCR 完整指南:截图、图片堆、扫描 PDF 的 4 种取字方式

Umi-OCR 离线 OCR 完整指南:截图、图片堆、扫描 PDF 的 4 种取字方式 Umi-OCR 离线 OCR 完整指南截图、图片堆、扫描 PDF 的 4 种取字方式【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR图片里的文字没法复制。把图拷进在线识别工具再上传、再等待——这套流程对涉密文档和断网环境行不通。Umi-OCR 是一款免费、开源的离线 OCR 软件识别全程在本地完成文件不出机器Windows 和 Linux 都能跑解压即用。下面按四个高频场景——截图取字、批量图片识别、扫描 PDF 转可搜索文档、二维码读写——把用法过一遍最后附上常见问题的排坑经验。Umi-OCR 核心能力速览本地识别、免安装、四个标签页上手前先弄清它管什么本地识别OCR 引擎内置在发行包里不经过网络适合敏感文档与断网环境免安装.7z压缩包或.7z.exe自解压包Windows 解压后直接运行Linux 用启动脚本umi-ocr.sh四个标签页截图 OCR、批量 OCR、文档识别、二维码按需打开各页设置互不干扰两种自动化入口命令行与 HTTP 接口可被脚本直接调用多语言界面简中、繁中、英语、日语、俄语、葡萄牙语等首次启动跟随系统识别语言库内置中文、英文、日文、韩文、法文、德文等常用语言中英混排内容选混合语言包即可。五分钟跑起来下载、启动、识别第一张图下载发行包解压即用获取方式二选一下载发行包解压.7z或.7z.exe任选。自解压包适合没装压缩软件的机器解压后双击Umi-OCR.exe即可。克隆源码自行构建构建步骤见项目说明文档。git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR启动后进入标签页界面截图 OCR 页默认打开界面语言会跟随系统自动切换想手动换语言或切深色主题进「全局设置」标签页首次截图30 秒把文字收进记录栏停留在「截图 OCR」标签页按下默认截图快捷键在屏幕上框选区域识别结果随即出现在右侧记录栏可直接复制、编辑。快捷键不顺手的话在这一页的设置里改成自己习惯的组合。截图与批量两个最高频的场景 截图 OCR框选屏幕任意区域取字最典型的需求教程里一段代码块是图片、图表坐标轴读起来费劲、外文资料的某条条目想存档。左侧图片预览可直接用鼠标划选划中文字后右键复制右侧识别记录支持编辑文字允许多条记录一起划选复制在别的软件里复制的图片可直接粘贴到这一页识别设置里的「排版解析方案」处理多栏布局与阅读顺序代码截图选「单栏-保留缩进」行首缩进得以保留 批量 OCR一次导入一整堆图片一摞票据扫描件、一批教材页图、一个装满带文字照片的文件夹——整个文件夹拖进「批量 OCR」标签页即可排队识别。输入格式jpg, jpe, jpeg, jfif, png, webp, bmp, tif, tiff数量无上限几百张可一次排队左侧列表逐张显示耗时与置信度顶部进度条反映整体进度输出可选四种格式输出格式适用情况txt最通用直接打开就能看csv进 Excel 直接建档适合表格化归档jsonl一行一条 JSON方便程序后续处理md整理成 Markdown 文档发布大任务可以勾选完成后自动关机或待机空闲时段慢慢跑图片水印、LOGO 位置固定时用右栏设置里的「忽略区域」编辑器按住右键画矩形把水印可能出现的位置框住框内整块文字会在识别时被跳过文档识别与二维码 扫描 PDF 转成可搜索的双层 PDF场景一份老规范文档只有扫描件想快速定位某条条款。打开「文档识别」标签页把文件拖入即可。产出是一份双层可搜索 PDF底层是原样的扫描图像版式、插图不动OCR 识别出的文字作为透明文本层叠在图像之上。外观看不出差别但从此支持搜索、复制、提取文字。支持格式pdf, xps, epub, mobi, fb2, cbz电子书文件同样适用该页也能设「忽略区域」适合排除页眉页脚带来的干扰任务完成后可选自动关机或休眠 二维码批量读码一段文本生成码读码截图、粘贴或拖入图片批量读出内容一张图上贴多个码也能识别。覆盖 EAN13、Code128 等一维条码与 PDF417 在内共 19 种协议拍下来的一箱商品条码可以一次读完。生成码输入一段文本立即得到码图片宽高与纠错等级等参数可设适合需要打印的使用场景。常见问题排坑清单准确率与速度结果差几个字先提高输入对比度或转灰度图再识别确认识别语言与内容匹配质量仍差时适当调低置信度阈值提高召回率再人工筛一遍特殊艺术字体、潦草手写识别率有限可在软件支持的 PaddleOCR 与 RapidOCR 之间换引擎再试一次批量慢速度主要取决于图片数量与尺寸。识别超大长图时先在页面设置里调高「限制图像边长」的数值也可以把任务拆成几批HTTP 接口并发能力有限脚本里串行调用即可内存与兼容性大文件占用内存偏高基本正常调低图像边长上限、减少单批数量都能缓解机器内存低于 4GB 时减少同时处理文件数某个 PDF 提示无法处理先把它转成图片走批量 OCR文件本身损坏的用 PDF 工具修复后再来或升级到软件最新版本重试窗口闪烁、界面错位到「全局设置」的「界面和外观」里换渲染方案或关闭硬件加速自动化调用命令行与 HTTP 接口不想开图形界面时终端里直接调主程序umi-ocr --path D:/images --output D:/result.txt--path传单张图片或文件夹会搜索嵌套子文件夹--output把结果写入文件加--clip则复制进剪贴板。指令支持前几个字母简写umi-ocr --help可查全部参数。完整参数说明命令行手册网络调用HTTP 接口手册含图片识别接口与文档识别接口说明一句命令行与接口的通信只走本地环回不经过物理网卡文件同样不出机器。参与贡献翻译、Issue 与延伸资料界面翻译在 Weblate 平台协作维护已有简中、繁中、英语、日语、俄语、葡萄牙语等。可从翻译步骤简易入手完整流程见翻译步骤完整翻译文件位于 dev-tools/i18n/ 目录遇到问题直接开 Issue附上版本号与复现步骤版本动态看 CHANGE_LOG.md功能清单与工程结构完整说明在根目录 README.md【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表