ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

本地图片文字提取:开源OCR工具Umi-OCR三步上手

本地图片文字提取:开源OCR工具Umi-OCR三步上手 本地图片文字提取开源OCR工具Umi-OCR三步上手【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费开源的离线 OCR 软件截图或导入图片后在本地完成文字提取结果可直接复制或导出为文件。所有识别都在你自己的电脑上执行文档不经过任何网络。项目定位Umi-OCR 是一个带图形界面的文字识别工具以标签页组织功能截图识别、批量识别、PDF 文档识别、二维码外加命令行和 HTTP 接口两种外部调用方式。项目说明运行方式解压即用无需安装官方包支持 Windows 7 x64 与 Linux x64识别语言内置多国语言识别库中、英、日等均可输入格式jpg / png / bmp / webp / tiff 等图片以及 pdf、epub 等文档输出格式txt、jsonl、md、csv或直接复制到剪贴板它适合两类人一是经常需要从截图、扫描件里抠文字的日常用户二是不希望把文档上传到第三方在线识别服务的人。核心功能实测截图OCR框选即得文字进入「截图OCR」标签页这是使用频率最高的场景点击截图按钮或在「全局设置」中配置的快捷键屏幕进入截取状态Esc可随时取消。用鼠标框选要识别的区域识别结果出现在右侧「识别记录」栏左侧是图片预览。记录栏里的文字可以直接划选复制也可以编辑后再复制支持一次划选多条记录。除了框选还支持把别处复制的图片直接粘贴进来识别。识别前可以在页面设置里选「文本后处理」方案处理双栏论文选「多栏-按自然段换行」处理代码截图选「单栏-保留缩进」能保留行首缩进和行中空格。批量识别几百张图一次跑完进入「批量OCR」标签页把图片拖进列表即可没有数量上限几百张可以一次性提交添加文件或整文件夹拖入右侧设置输出格式和保存路径。点击「开始任务」界面实时显示进度完成后按所选格式导出 txt / jsonl / md / csv。若图片带有水印或页眉页脚可进入「忽略区域」编辑器按住鼠标右键画矩形框框内整块文字会在识别时被跳过尽量把框画大一点以完全包住水印。注意忽略区域按「整块文本」生效落在框内的文本块才会被排除不是按单个字符。安装与首次配置从项目仓库的发行版页面下载最新版压缩包.7z或自解压.7z.exe解压到任意目录双击Umi-OCR.exe即可运行Linux 用户运行umi-ocr.sh。全程不需要联网。如果嫌下载麻烦且使用 Windows也可以走 Scoopscoop bucket add extras scoop install extras/umi-ocr该包自带 Rapid-OCR 引擎另有 Paddle-OCR 版本可选。首次配置建议做三件事在「全局设置」中确认界面语言默认跟随系统和主题在「截图OCR」页设置截图快捷键方便日常调用在 OCR 插件选项中确认引擎默认 Rapid-OCR 兼容性最好。配置文件保存在UmiOCR-data/.settings是 ini 格式允许手动修改后用--reload命令重载。其他值得知道的能力以下功能按需了解即可每个都能在对应标签页直接上手文档识别导入 PDF、epub、mobi 等文件对扫描件做 OCR 或直接提取原有文本可以输出双层可搜索 PDF同样支持忽略区域方便排除页眉页脚。二维码支持扫码截图、粘贴或拖入图片一图多码和文本生成二维码共 19 种协议含 QRCode、EAN13、PDF417 等。公式识别截图页附带数学公式识别能力适合截图里出现公式的场景。接口调用主程序本身可以当命令行入口也可以用 HTTP 接口被其他程序调用详见 命令行手册 与 HTTP接口手册。常见问题与小贴士对电脑配置有要求吗官方发布包支持 Windows 7 x64 和 Linux x64。识别在 CPU 上运行内存建议 4GB 以上没有 GPU 加速电脑越新速度越快。图片质量影响大吗越大越清晰通常越好扫描文档建议 300dpi。如果遇到超长的图识别不到文字进入页面设置把「文字识别 → 限制图像边长」调高该参数会把超边长的图压缩后再识别。输出格式怎么选给人看选 txt 或 md要进 Excel 选 csv要做程序化处理选 jsonl每行一个 JSON 结果。隐私如何识别全程离线图片不出本机命令行/HTTP 接口与后台进程之间的通信也只走本地环回不经过网卡。识别错了怎么办截图OCR 的记录栏支持编辑后再复制批量结果可先导出一份 txt 抽查再决定是否重跑并调整「文本后处理」方案。写在最后Umi-OCR 适合三类场景文档需要保密不能上传云端、截图抠文字的高频操作、以及几百张图片的批量归档。如果你的需求是超复杂版式的版面还原或者需要 macOS / iOS 上的支持它目前覆盖不到可以再看看其他方案。遇到问题可以先查 命令行手册 和 HTTP接口手册仍有疑问到项目的 Issue / 讨论区提问即可。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表