尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Umi-OCR:免费离线OCR文字识别工具,截图、批量、PDF 5分钟上手

Umi-OCR:免费离线OCR文字识别工具,截图、批量、PDF 5分钟上手 Umi-OCR免费离线OCR文字识别工具截图、批量、PDF 5分钟上手【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费、开源、完全离线的 OCR 软件。它解压即用不需要联网所有图片文字识别都在本机完成。它支持截图识别、批量图片识别和 PDF 文档识别适用于 Windows 7 x64 和 Linux x64 系统。三步跑起来 先拿到效果再回头看它有什么。第1步获取程序。两种方式任选git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR或从发布渠道下载.7z发行包。发行包解压后得到Umi-OCR.exe无需安装任何依赖也无需配置 Python 环境。第2步启动。双击Umi-OCR.exe。软件会按系统语言自动切换界面支持简体中文、繁体中文、英语、日语等。第3步截图识别。打开截图OCR标签页按截图快捷键框选屏幕区域右侧记录栏立刻出现识别出的文字可直接划选复制。能力地图按任务找功能识别质量排版解析方案决定输出顺序识别准不准是一回事文字顺序对不对是另一回事。Umi-OCR 内置文本后处理识别完成后自动整理段落顺序预设方案包括多栏-按自然段换行自动识别多栏布局适合大部分文档单栏-保留缩进保留行首缩进和行内空格专门用于代码截图多栏-无换行把所有语句合并成一行适合表格、票据类内容。这些方案同时兼容横排和竖排从右到左文字。批量处理一次几百张四种输出格式批量OCR标签页用于导入本地图片无数量上限一次可处理几百张。支持输入jpg, jpe, jpeg, jfif, png, webp, bmp, tif, tiff支持输出txt, jsonl, md, csv(Excel)任务完成后可设置自动关机/待机适合睡前挂一批扫描件文档处理PDF 扫描件变可搜索文档识别支持pdf, xps, epub, mobi, fb2, cbz。对扫描件执行 OCR也可以直接提取 PDF 里已有的文本层。核心能力是输出双层可搜索 PDF底层是原图上层是透明文字既能搜索又能复制版式不变。二维码19 种协议能扫也能造二维码标签页支持截图、粘贴或拖入图片来扫码支持一图多码覆盖 19 种协议包括 QRCode、DataMatrix、PDF417、EAN13、Code128 等。反向也支持输入一段文本生成二维码图片可选纠错等级。集成方式命令行 HTTP 接口Umi-OCR 可以脱离界面工作umi-ocr --path D:/img1.png D:/img2.png --output result.txt命令行通过本地回环的 HTTP 接口与主进程通信不经过物理网卡。全局设置里的服务区域必须保持 HTTP 服务开启默认开启。完整的命令参数见 命令行手册REST 接口的完整说明见 HTTP接口手册。选型决策RapidOCR 还是 PaddleOCRUmi-OCR 内置两种离线 OCR 引擎以插件形式提供可在全局设置里随时切换对比项RapidOCR-jsonPaddleOCR-json定位默认引擎兼容性好可选引擎速度稍快适合任务日常截图、常规批量识别大批量处理、对耗时敏感的任务结论拿不准就选它开箱即用批量任务明显变快时切换它两种引擎都支持多语言识别库切换引擎不影响排版解析等后处理设置。场景实战任务一从代码截图提取代码并保留缩进配置截图OCR 页 → 设置 → 文本后处理选单栏-保留缩进。操作框选代码区域右侧记录栏输出的代码保留原有缩进和空格直接粘进编辑器即可编译。验证对比原图检查for循环体、return语句的缩进层级是否原样保留。任务二批量识别带水印的图片配置批量OCR 页 → 右栏设置 → 进入忽略区域编辑器按住右键拖出矩形框框住水印可能出现的全部位置。操作框内的文字块会被整个跳过。注意规则是整块忽略——只有完全落在框内的文本块才会被去掉框边擦到的块仍会输出所以矩形宁大勿小。验证先拿一张样图试跑检查记录栏里水印文字是否已消失。任务三把扫描版 PDF 变成可搜索 PDF配置文档识别页选择 PDF 文件输出类型勾选双层可搜索 PDF页眉页脚干扰大时同样用忽略区域框掉。操作启动任务完成后在输出目录打开生成的 PDF用 CtrlF 搜索一个词。验证搜索能命中、文字可选中即说明上层文字层写入成功。避坑手册症状超大长图识别不全或被压缩原因默认限制了图像边长解法批量OCR 页 → 页面设置 → 文字识别 → 限制图像边长调高数值。症状界面截屏闪烁、UI 错位原因显卡加速渲染与部分驱动不兼容解法全局设置 → 界面和外观 → 渲染器切换渲染方案或关闭硬件加速。症状脚本调用命令行时收不到回传、管道|失效原因运行环境限制暂不支持输出流重定向解法改用 HTTP 接口转发命令行或让结果写入--output指定的文件。症状HTTP 大批量连续调用偶发ECONNREFUSED原因后端组件对并发和长时间连续调用支持有限解法不要并发调用报错后直接重发请求即可。开始动手解压后运行Umi-OCR.exe打开截图OCR页按一次截图快捷键你就能拿到第一段识别结果。接下来按 命令行手册 和 HTTP接口手册 把截图OCR接进你的自动化流程。软件更新记录见 CHANGE_LOG.md。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表