
Umi-OCR 完整指南免费离线 OCR 文字识别5 分钟安装上手【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费、开源、完全离线的 OCR 软件能把截图、批量图片、扫描版 PDF 里的文字提取成可复制的文本还能识别和生成二维码。它不依赖网络不收集数据适合办公、学习和开发场景 全部代码开源完全免费 离线运行解压即用无需联网 提供命令行与 HTTP 接口方便接入自动化流程快速上手Umi-OCR 三种安装方式方式一下载发行版推荐最省事下载 v2.1.5 发布包.7z压缩包或.7z.exe自解压包解压到任意目录双击Umi-OCR.exe即可启动无需安装Linux 用户下载 Linux 运行库版本解压后运行umi-ocr.sh启动v2.1.3 起兼容 Linux x64。方式二Scoop 一行命令安装Windows 用户如果装了 Scoop 包管理器两条命令搞定scoop bucket add extras scoop install extras/umi-ocr加paddle后缀可换装 PaddleOCR 引擎版extras/umi-ocr-paddle。两个引擎版不要同时安装快捷方式会互相覆盖但可以事后通过导入插件切换引擎。方式三源码构建最彻底git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR克隆后按仓库内构建说明部署对应平台的运行环境再运行主入口UmiOCR-data/main.py。适合想改代码、二次开发的开发者。首次体验5 分钟跑通第一次识别启动软件后界面会自动跟随系统语言打开截图OCR标签页按页面上标注的快捷键屏幕进入截图模式按住鼠标拖拽框选一段屏幕文字松开稍等片刻右侧记录栏出现识别出的文字在文字上划选、右键复制粘贴到任何地方到这里你已经完成了从安装到出结果的全流程。左侧预览栏可以直接鼠标划选文字右侧记录栏支持编辑多个记录可以划选合并复制——复制网页、PDF 里的文字再也不用逐个手动敲。按场景走你想干什么就用哪个标签页场景一截一张图提取文字什么时候用网页、PPT、软件界面里有需要摘抄的文字比截图工具多走一步到剪贴板。操作打开截图OCR标签页按快捷键唤起截图框选目标区域识别结果自动进入右侧记录栏每段标注置信度和耗时划选需要的段落右键复制或按CtrlC输出与微调右侧顶部有文本后处理选项默认多栏-按自然段换行适合绝大多数文档截图识别代码截图时改成单栏-保留缩进缩进和空格都会保住。也支持在别处复制图片后直接粘贴进来识别免去先存文件的麻烦。场景二一次处理整个文件夹什么时候用手里有几十、几百张截图或照片要统一转成文字归档。操作打开批量OCR标签页点击选择图片或直接把文件夹拖进来支持jpg / png / webp / bmp / tiff等格式没有数量上限点击开始任务列表里逐张显示耗时与置信度任务完成后选择保存格式一键导出输出与微调结果可存为txt、jsonl、Markdown、csvExcel 可打开保存到原目录或指定目录。两张实用设置忽略区域图片角落有固定水印时进入忽略区域编辑器按住右键画矩形框住水印框内的文字块会被整块丢弃结果立刻干净。注意框要画得足够大且只丢弃整块落在框内的文字。任务完成后自动关机/待机勾选后可下班前丢几百张图第二天直接取结果。场景三识别扫描版 PDF 与电子书什么时候用手头是扫描件、旧文档的 PDF或 epub/mobi 电子书需要可搜索、可复制的文本。操作打开文档识别标签页拖入文件支持pdf、xps、epub、mobi、fb2、cbz六种格式选择处理方式扫描页走 OCR电子文档直接提取原有文本点击开始导出双层可搜索 PDF 或纯文本输出与微调双层 PDF 是这里的亮点——页面上能看到原文同时文字可选中可搜索发给同事也能直接复制。带固定页眉页脚的文档同样可设忽略区域把页眉页脚整块排除只留正文。场景四读码与生成码什么时候用图里有二维码、条形码需要读取或要把一段文字变成二维码图片。操作打开二维码标签页截图、粘贴或拖入本地图片支持一图多码自动读出内容切到生成模式输入文本选择协议与纠错等级调整尺寸后保存图片输出与微调共支持 19 种协议涵盖QRCode、Code128、Code39、EAN13、PDF417、Aztec、DataMatrix等常见一维码和矩阵码日常扫码与生成基本够用。参数怎么选场景速查表设置项很多但你只需要记住这张表场景推荐选项选择理由普通文档、网页截图排版解析多栏-按自然段换行自动合并断行结果可直接阅读代码截图排版解析单栏-保留缩进保留缩进与行内空格整句都要独立一行排版解析多栏-总是换行每段语句强制换行便于逐条处理大图、长图识别慢或丢字页面设置 → 文字识别 → 限制图像边长调高默认 960 会压缩大图调高可保精度批量识别导出txt 单独文件 / csvtxt 便于归档csv 可直接进 Excel扫描件 PDF双层可搜索 PDF原文可见且文字可检索界面语言不对全局设置 → 语言支持简中、繁中、英语、日语、俄语等十余种截图时屏幕闪烁、UI 错位全局设置 → 界面和外观 → 渲染器切换渲染方案或关闭硬件加速即可修复顺手的几个全局设置一键添加桌面快捷方式、开机自启切换亮色/暗色主题调整界面字体和大小比例。配置修改都会存到UmiOCR-data/.settings想批量改配置可以直接编辑这个 ini 文件。自动化与集成命令行与 HTTP 接口普通用户可跳过本节。两种调用方式都走本地回环通信不经过物理网卡可放心在脚本中使用。命令行手册见 docs/README_CLI.md入口就是Umi-OCR.exe全局设置里的 HTTP 服务保持开启即可。最常用五条umi-ocr --screenshot # 鼠标截屏识别 umi-ocr --clipboard # 识别剪贴板里的图片 umi-ocr --path D:/images # 批量识别文件夹内所有图片 umi-ocr --qrcode_read D:/code.png # 识别二维码 umi-ocr --qrcode_create 文本 out.png 128结果输出去向用附加参数控制--clip复制进剪贴板--output file.txt写入文件--output_append追加。指令还支持字母前缀简写如--sc等价--screenshot。--path可一次传多个文件或文件夹多路径用空格分隔。HTTP 接口手册见 docs/http/README.md服务默认监听127.0.0.1:1224。图片识别只需一个 POST 请求把图片转成 Base64 传进去POST http://127.0.0.1:1224/api/ocr { base64: iVBORw0KGgo..., options: { tbpu.parser: multi_para, data.format: text } }返回 JSON 里code为 100 表示成功data即识别文本data.format设为text时。其余能力/api/ocr/get_options查询当前引擎支持的全部参数二维码走/api/qrcode识别、/api/qrcode/text生成文档识别是上传 → 轮询状态 → 获取下载链接 → 下载 → 清理五步流程仓库里附了完整的 Python 示例脚本 可直接参考。两点注意后端并发能力弱尽量串行调用长时间连续调用偶发ECONNREFUSED重试即可。排错速查高频问题的三段式解法症状截图时屏幕闪烁、界面错位。原因显卡加速渲染与当前显卡驱动不兼容。解决全局设置 → 界面和外观 → 渲染器切换到其他渲染方案或关闭硬件加速。症状启动时提示缺少 DLL 文件。原因系统缺少 Microsoft Visual C 运行库。解决安装 Visual C Redistributable 后重新启动。症状命令行或 HTTP 请求没有响应。原因Umi-OCR 依赖本地 HTTP 服务接收外部指令服务未开启。解决打开全局设置确认允许 HTTP 服务已勾选默认开启主机保持仅本地即可。症状大图、长图识别很慢或大面积丢字。原因默认限制图像边长 960会先压缩大图片。解决在页面设置 → 文字识别中调高限制图像边长数值。症状批量结果里总混着水印文字忽略区域似乎没生效。原因忽略区域只丢弃整块落在框内的文本框没包全就不生效。解决进忽略区域编辑器重画矩形把框画得比水印实际位置更大一圈。症状程序调用命令行收不到返回内容。原因Umi-OCR 暂不支持 stdout 重定向和管道|会失效。解决改用 HTTP 命令行转发接口通过 HTTP 调指令并取回结果。生态与参与插件机制与路线图Umi-OCR 是模块化设计UmiOCR-data/plugins目录存放各类插件OCR 引擎本身就是插件——PaddleOCR 与 RapidOCR 两套引擎可随时导入、切换不改一行主程序。插件库独立维护想加新引擎或新输出格式按插件规范开发即可挂载。参与方式有三条遇到 Bug 或想提功能到仓库 Issue 反馈界面语言想改进通过 Weblate 平台在线提交翻译现有多语言文件 和翻译工具脚本都可以参考关注 CHANGE_LOG.md 了解每个版本的改动。官方远期计划包括 GPU 加速的离线 OCR、独立数学公式识别、表格识别输出 Excel、图片翻译以及 macOS 等更多平台的兼容——这些接口在早期就已预留后续版本会逐步落地。从截图识字到批量归档再到脚本集成Umi-OCR 把整套流程都放在了本地。现在就解压一份 v2.1.5按快捷键截下第一张图感受离线 OCR 的速度。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考