ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Umi-OCR离线OCR使用指南:从截图到批量文字识别

Umi-OCR离线OCR使用指南:从截图到批量文字识别 Umi-OCR离线OCR使用指南从截图到批量文字识别【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR是一款开源免费的离线文字识别软件用于提取图片、截屏和扫描件中的文字。与在线OCR服务不同它的识别过程全部在本地电脑完成图片不经过网络上传文档隐私更有保障。软件内置中、英、日等多国语言库覆盖日常办公中的Umi-OCR 离线OCR常见场景。功能一览Umi-OCR 离线OCR支持哪些识别任务功能说明适用场景截图OCR框选屏幕区域识别并复制其中文字会议纪要、代码、网页文字批量OCR一次导入多张图片顺序识别历史图片批量归档PDF文档识别从扫描件提取可编辑文本PDF扫描件转可编辑文本忽略区域框选矩形排除水印、页眉页脚带干扰内容的文档二维码识别与生成读取图中二维码或由文本生成二维码图片资产标签、扫码录入命令行与HTTP接口通过命令或本地网络请求调用识别自动化流程、程序集成左图展示了主界面的截图OCR页左侧为截取的代码图片右侧为识别出的文本可直接复制。场景实操从截图提取文字与批量图片文字识别以下两个场景覆盖了最高频的使用方式无需任何前置配置启动软件即可操作。从截图提取文字打开截图OCR标签页框选屏幕上要识别的区域在右侧记录面板查看识别结果右键复制或保存为文本文件如果一次要处理几十张图片手动截图效率偏低改用批量页更合适。批量识别目录中的图片打开批量OCR标签页点击选择图片添加图片或文件夹点击开始任务开始识别在记录面板查看各图片结果与耗时列表中的耗时和状态列可以帮你快速定位识别质量异常的个别图片。进阶集成用命令行与HTTP接口调用识别两种方式都依赖本地HTTP服务默认端口1224默认开启仅在本机回环通信不会外发。用命令行调用识别最简命令umi-ocr --path D:/img1.png --clip其中--path指定图片或文件夹路径文件夹会递归识别所有图片--clip将结果复制到剪贴板。完整命令行参数说明见 docs/README_CLI.md。用HTTP接口调用识别curl -X POST http://127.0.0.1:1224/api/ocr \ -H Content-Type: application/json \ -d {base64: BASE64编码的图片数据}接口返回JSON格式的识别结果字段说明见 图片OCR接口文档全部接口汇总见 HTTP接口手册。识别效果调优修复断行、水印与混排问题调优入口集中在截图OCR页右侧的设置面板逐项对照现象处理即可。断行错乱原因是排版解析方案与文档版式不匹配。操作在排版解析方案中多栏文档选多栏-按自然段换行代码截图选单栏-保留缩进。水印、页眉页脚混入结果原因是OCR识别了全图文字。操作在忽略区域中绘制矩形框框内的文字块将被舍弃。中英混排或日文识别不准原因是语言模型与内容不符。操作在语言/模型库中改为对应语言如简体中文、English、日本語。识别速度偏慢原因是原图尺寸过大。操作在图片长边限制默认960中调低数值超限图片会被压缩后再识别速度更快、精度略有损失。全局设置页还提供语言、主题、开机自启等选项可按团队习惯统一配置。克隆仓库git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR下载发行包Umi-OCR_Rapid_v2.1.5.7z更新日志CHANGE_LOG.md解压压缩包后运行主程序即可开始使用。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表