ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Umi-OCR:免费离线 OCR 一次搞定截图、批量图片与扫描 PDF

Umi-OCR:免费离线 OCR 一次搞定截图、批量图片与扫描 PDF Umi-OCR免费离线 OCR 一次搞定截图、批量图片与扫描 PDF【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费、开源、完全离线的 OCR 工具OCR 即光学字符识别把图片里的文字变成可编辑文本支持 Windows 7 x64 与 Linux x64。截图、批量图片、扫描版 PDF 的取字全在本机完成不联网、不上传解压即用。3 步出第一次识别结果下载发布包取仓库根目录的 Umi-OCR_Rapid_v2.1.5.7z没有压缩软件的电脑可下.7z.exe自解压包开发者也可直接git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR。下载完成你手里会有一个安装包文件。解压到任意目录软件是绿色免安装版没有安装程序也不挑路径解压完即可看到Umi-OCR.exe。双击Umi-OCR.exe启动主窗口打开顶部有「截图OCR」「批量OCR」「全局设置」等标签页。点左侧工具栏截屏图标在屏幕上拖出矩形框松开鼠标后自动开始识别。看右侧「记录」区识别出的文字出现在这里右键就能复制走。图中左侧是截取的代码图片下方有「隐藏文本」开关与缩放比例右侧「记录」区已列出识别出的文字右上角是「滚动」开关与「清空」按钮。文字从哪儿来按场景走把网页、聊天和代码截图里的文字抠下来屏幕上的正文不用手敲框一下就能带走。打开「截图OCR」标签页点左侧截屏图标拖出矩形框选区域松开即识别如果图片已在别处复制也可以直接粘贴进窗口识别。取走结果时在右侧记录里右键选「复制CtrlC」或「全选CtrlA」后一次复制整段。图中左侧是一张文档截图并选中了一块文字右键菜单提供「复制、全选、复制图片、显示/隐藏文字」右侧「记录」页签按时间顺序列出历次识别结果。整个文件夹的图片一次转文字几十张图片不用逐张打开。打开「批量OCR」标签页点「选择图片」把文件或整个文件夹加入列表支持 jpg、png、webp、tiff 等格式无数量上限在右侧「设置」里确认识别语言与排版参数点「开始任务」。顶部进度条实时显示已耗时、完成数量与百分比右侧「记录」逐张列出每份文件的识别文本并标注各自的置信度。图中左侧列表已排队 13 张图片顶部进度条显示「1.4s 3/13 23%」「开始任务」按钮在其右侧右栏「记录」按文件名分组显示文字每条附时间与置信度如 0.92。从扫描版 PDF 提取文字还能生成可搜索的双层 PDF扫描件以后可以直接搜索、复制版式观感不变。打开「文档识别」标签页加入 PDF也支持 xps、epub、mobi 等格式选择输出为纯文本或「双层可搜索 PDF」——后者保留原始扫描画面在上面叠加一层文字之后在 PDF 里直接搜索复制即可。引擎与参数设置和批量页共用一套不用重复配置同样支持画「忽略区域」排除页眉页脚。切换识别语言中英日繁都能读混合语言文档按文字主体选语言即可。在「截图OCR」或「批量OCR」页的右侧「设置」里切换「语言/模型库」简体中文、English、日本語、繁體中文等界面上的显示语言则在「全局设置」→「语言/Language」修改同一页还能调主题与字体。图中「全局设置」页上方是「快捷方式」区可添加桌面、开始菜单快捷方式并设置开机自启下方「界面和外观」列出语言、主题、字体、界面大小比例等选项。提高识别准确率先调这几个参数选项适用情况说明多栏-按自然段换行报纸、网页等多栏排版自动分栏切段最通用单栏-保留缩进代码截图、缩进文本保留行首缩进与行中空格多栏-无换行表格、密集文本输出连续文本不额外换行单栏-总是换行每行独立短句每行文字后强制换行忽略区域水印、页眉页脚干扰按住右键画矩形框框内整块文字被舍弃纠正文本方向文字倾斜或倒置先判方向再识别速度略降限制图像边长高清大图、长图默认 960调大数值可提升大图精度图中「记录」面板每条识别块上方标注「耗时 0.38s置信 0.92」及识别时间右键菜单可对记录执行「删除选中记录」「清空全部记录」等维护操作。进阶调用命令行与 HTTP 接口前提是「全局设置」页允许 HTTP 服务默认开启仅本地访问。命令行入口就是主程序本身umi-ocr --screenshot # 发起鼠标截屏识别 umi-ocr --path D:/xxx.png # 识别指定图片也接受文件夹路径 umi-ocr --help # 查看全部参数让其他程序接入时HTTP 服务默认监听 1224 端口图片识别调用 POST/api/ocr请求体传 Base64 图片data.format设为text即只取文本curl -X POST http://127.0.0.1:1224/api/ocr -H Content-Type: application/json \ -d {image:Base64图片字符串,data.format:text}更多参数见 命令行手册 与 HTTP 接口手册。出问题时对照这张表排查现象原因处理高清大图识别不清边长超限制值被压缩页面「设置」→「文字识别」→「限制图像边长」调大数值结果混入水印、页眉文字干扰区未排除在「忽略区域」里画多个矩形完全包裹水印可能出现的位置倾斜或倒置文字识别不准方向纠偏未开启勾选「纠正文本方向」接受速度略降命令行没有响应HTTP 服务被关掉「全局设置」中确认允许 HTTP 服务默认开启混合语言文档错字多语言模型与文字主体不符按文字主体切换「语言/模型库」只要你的需求是「从本机的图片和 PDF 里取文字、全程不上传」Umi-OCR 解压后就能直接干 相关资源命令行手册 · HTTP 接口手册 · 接口参数详解 · 更新日志 · 最新发布包 Umi-OCR_Rapid_v2.1.5.7z【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表