ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Umi-OCR:免费离线OCR,3步让扫描PDF变成可搜索

Umi-OCR:免费离线OCR,3步让扫描PDF变成可搜索 Umi-OCR免费离线OCR3步让扫描PDF变成可搜索【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR看到却选不中的扫描版PDF、要一张张手动敲图的图片大概是日常办公里最磨人的事。Umi-OCR 是一款免费开源的离线OCR工具不联网、不注册屏幕、图片、PDF里的文字都能直接提取出来。它到底是什么Umi-OCR是一个解压即用、完全离线的OCR程序。不用安装、不用注册、不依赖网络。它内置离线识别引擎和多国语言模型库文字处理全部在你的电脑上完成文件不出本机。支持 Windows 和 Linux绿色免安装拷到U盘里就能带走。所有功能免费开放没有隐藏收费。对比项传统在线OCR本工具网络要联网文件上传云端完全离线文件不出电脑费用订阅或按量计费有月度额度完全免费不限数量批量一次处理一两张几百张图片、整本PDF一次跑它能帮我做什么截图识别屏幕上的字直接复制定位按快捷键截屏识别结果立刻出现在右侧。适用网页、代码截图、其他软件界面里的文字提取在别处复制的图片也能直接粘贴进窗口识别。结果文字按阅读顺序输出可直接复制多栏排版也能自动排好顺序。批量识别几百张图片一次跑完定位拖入整个文件夹逐张识别进度条和耗时实时显示。适用几十张到几百张扫描件、票据、书本照片的文字提取。结果每张图对应生成 txt、md、csv(Excel) 等格式文件列表里还能看到每张的置信度和耗时方便挑出问题图。文档识别扫描版PDF可以搜索了定位丢进一个PDF扫描件输出“双层可搜索PDF”。适用老扫描文件、纸质合同扫描件想按关键词查找内容“忽略区域”还能排掉页眉页脚。结果生成的PDF外观和原件一样但能直接搜关键词、选中文字复制也支持 epub、mobi、cbz 等格式。二维码扫码和生成一次搞定定位从图片里读二维码、条形码也能用文字生成码图。适用读商品条码、验证码或办公时生成支付二维码。结果一张图里的多个码一次读出生成的码可设置纠错等级。最快怎么上手下载发布包.7z 或自解压包解压后双击Umi-OCR.exe启动不用安装。在顶部标签页选“截图OCR”或“批量OCR”拖入截图或图片就能开始。首次使用可以到“全局设置”里确认语言、主题和截图快捷键。开发者也可以从源码构建运行git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR想在脚本或其他程序里调用识别能力可以看 命令行手册 和 HTTP接口手册。用得更顺手的技巧选对“排版解析方案”代码截图用“单栏-保留缩进”行首缩进和空格都能留住。图里有水印或页眉页脚时在“忽略区域”画几个矩形把干扰文字包起来它们就不会进入识别结果。界面语言不对到“全局设置”→“语言”里切换繁中、英语、日语等都可用。截图页支持“重复上一次截图”不用每次重新框区域。大任务勾上“任务完成后自动关机/待机”让它整夜处理睡一觉起来收结果。谁用得上学生和研究者扫描版论文、古籍文献提取参考文献和图表说明外语资料直接可搜索。办公和档案人员合同、票据等扫描件批量转文字存成 Excel 归档备查。开发者截图里的代码保持缩进复制走或用命令行、HTTP接口把识别能力接进自己的工作流。会不会卡住问模糊的扫描件识别不准怎么办答准确率主要受图片质量限制。可以先提高对比度和清晰度同一张图也可以换不同的OCR引擎试试。超大长图要在页面设置里调高“限制图像边长”。问完全断网能用吗答可以。识别模型、语言库都在本地内置的HTTP接口也只在系统内部环回通信不经过外网。问一次能处理多少答批量识别没有数量上限几百张图可以一次导入PDF按页识别大一点的书只是时间等比变长。Umi-OCR 把整个识别过程放在你自己电脑上免费、可离线、不限次。欢迎下载解压试用有问题或有想法也欢迎到社区提出来一起完善。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表