
Umi-OCR解压即用的离线文字识别工具批量处理数百张图片【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款面向普通用户和小团队的免费离线 OCR 软件所有识别过程都在本机完成支持批量图片识别、截图 OCR、多语言识别和二维码读取。它在 Windows7 x64 及以上与 Linuxx64上解压即用无需安装也无需联网。工具概览项目说明性质开源、免费代码公开费用无收费项无次数限制支持系统Windows 7 x64 及以上、Linux x64核心能力批量图片识别、截图 OCR、PDF 文档识别、二维码/条形码识别与生成输出格式TXT、MD、JSONL、CSV 等可配置网络依赖无完全离线运行功能亮点离线本地识别敏感文档不上传服务器识别在本地完成图片不会经过任何第三方服务。这对处理合同、票据、内部文档等不宜外发的材料很实用不用担心传输链路和数据留存问题在没有网络的环境会议室、内网机器里也能照常工作。批量图片识别一次导入整个文件夹批量 OCR 页面支持一次性选入几十甚至上百张图片逐张显示耗时与识别状态右侧同步滚动输出结果。它解决的是「逐张打开在线工具、逐张复制结果」的重复劳动整本扫描册、一整批截图丢进去跑完直接得到全部文本文件。智能排版解析还原多栏与竖排的阅读顺序OCR 输出的是按位置切出的文字块顺序常是乱的。Umi-OCR 的文本后处理提供多栏按自然段换行、竖排文字处理、代码缩进保留等预设方案。它解决的是「识别出来了但不能直接用」的问题双栏论文、竖排书影、代码截图按方案处理后得到的文本可以直接阅读和编辑。动手环节批量数字化一本扫描文档以「把 20 页扫描合同转为文本文件」为例完整流程如下解压并启动将发行版压缩包解压到任意目录双击运行Umi-OCR.exe软件会自动检测并加载 OCR 引擎。选图打开「批量 OCR」标签页点「选择图片」选中扫描文档所在文件夹里的全部图片支持一次选择多张或按文件夹导入。设置在右侧设置区选择输出格式TXT/MD/JSONL/CSV文本后处理方案按文档排版选择——普通文档选「单栏-保留缩进」或默认方案双栏论文选「多栏-按自然段换行」若每页有固定页眉页脚可在此进入忽略区域编辑器用右键在图上框出要排除的区域。运行并核对点「开始任务」列表会显示每张图的处理耗时和状态右侧「记录」区逐条输出识别文本全部完成后可按原文件名得到对应的文本文件。习惯命令行操作的用户也可以不经过界面直接对文件夹执行umi-ocr --path 扫描文档文件夹路径实用技巧扫描件尽量达到 300 dpi 以上模糊图片的识别率下降明显TXT、MD 适合人工阅读编辑JSONL 适合后续程序化处理Paddle-OCR 引擎速度稍快Rapid-OCR 兼容性更好按环境二选一结语更多界面功能说明见官方文档docs/README.md命令行与 HTTP 接口用法见命令行手册docs/README_CLI.md。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考