
解压即用免费离线OCR工具把扫描件变成可编辑文本只要两分钟【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR周五下午五点你收到一份37页的扫描合同客户要求明早回签。你需要把这些图片变成可编辑文本但不想把文件传上任何在线站点。Umi-OCR是一款免费开源的离线OCR工具把截图或批量图片文件交给它就能拿到排好顺序的文字全程在本地运行。下载发行版解压双击Umi-OCR.exe就能用。不需要安装不需要注册也不需要联网。下面是几个常见用法的完整流程。 解压完直接双击运行发行包是 7z 格式解压到机器上任意目录即可。双击目录里的Umi-OCR.exe软件就启动了模型和资源文件都放在同一目录不需要再装别的。代码全部开源使用不收费也没有次数限制。首次启动时界面语言会跟随系统设置自动选择想换主题、改快捷键都在全局设置里完成。界面上改过的参数会写进配置文件手动修改文件后软件也能重新加载生效。 把整文件夹拖进去批量识别扫描件打开批量OCR标签页把装扫描件的文件夹直接拖进界面。jpg、png、bmp、tiff 都能读子文件夹里嵌套的图片也会一起找出来数量不限一次丢进去几百张也没问题。内置识别库覆盖中文、英文等常用语言图里中英混排也能处理。点开始任务后界面实时显示进度和耗时。完成后识别结果按图片一一对应保存成你选定的格式txt、md、csvExcel、jsonl。想直接阅读就存 txt想丢给脚本处理就存 jsonl。还可以设任务完成后自动关机或休眠晚上跑完第二天收结果。如果文档里有固定位置的水印、页眉或页码多一步在右栏设置里进入忽略区域按住右键画矩形把干扰区框住任务里这些区域的文字会被跳过。矩形要完整包住整个文本块它才会被整体忽略。️ 框住屏幕上的那段字截图提取文字打开截图OCR标签页按快捷键默认 CtrlAltZ屏幕变暗后拖框选住要认的区域识别结果就出现在右侧记录栏。别处复制的图片也可以直接粘贴到这一页识别不用重新截图。记录栏是可编辑的改个别错字没问题也可以划选多条记录一次复制进剪贴板。左侧的图片预览支持直接用鼠标划选框到哪文字就复制到哪。文本后处理下面是排版解析方案。双栏论文选多栏-按自然段换行文字按阅读顺序输出代码截图选单栏-保留缩进行首缩进原样保留。横排和竖排两种排版都能处理识别出来的文本顺序是对的复制出去基本不用返工。⌨️ 用命令行把OCR任务接进脚本如果你还想做得更细一点主程序也能当命令行入口用。在终端里执行umi-ocr --path D:/scan --clip umi-ocr --screenshot umi-ocr --qrcode_read D:/qr.png第一条把文件夹里所有图片识别完结果进剪贴板第二条截屏识别第三条读图片里的二维码。所有参数都支持简写多路径、输出到文件等组合在手册里有完整说明。想在自己的程序里调用还有一份 HTTP接口手册 可以参考。下载发行版解压双击就能跑起来更多参数见 命令行手册。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考