尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Umi-OCR 免费离线OCR软件实战:从一摞纸质资料到可编辑文字,我只用了三分钟

Umi-OCR 免费离线OCR软件实战:从一摞纸质资料到可编辑文字,我只用了三分钟 Umi-OCR 免费离线OCR软件实战从一摞纸质资料到可编辑文字我只用了三分钟【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR深夜十一点你盯着办公桌上那二十页刚打印出来的技术文档——不是电子版是纸质的。要么一个字一个字敲进电脑要么掏出手机拍照再手动整理。两年前的我选了后者结果那晚我花了四个小时。直到我遇到Umi-OCR一款完全免费、开源、离线运行的 OCR 软件。从那以后图片里的文字复制不出来这件事从我的人生里消失了。今天这篇文章就把我从安装到玩透它的完整路径走给你看。一句话看懂Umi-OCR 到底解决什么问题如果你在办公、学习或写代码时经常遇到下面任一场景它就是为你准备的网页、软件界面、PDF 里的文字无法复制只能截图一堆扫描件、照片里的文字需要变成可编辑文档想识别图片里的二维码或者批量生成二维码手上有几百张图片要转文字不想一张张手动处理Umi-OCR 是一款免费、开源的离线 OCR 软件自带离线识别引擎和多种语言库解压即用、无需联网、不传任何数据到云端。截图识别、批量识别、PDF 文档识别、二维码扫码与生成全都能干。和多数需要联网的在线 OCR 工具相比它最大的不同是数据不出本机速度还不输在线服务。首战速通3 步完成第一次文字识别先别急着研究所有功能我们把最短路径走通让你三分钟内获得第一次正反馈。第一步下载并解压从项目仓库获取压缩包Windows 版为.7z格式解压到纯英文路径例如D:\Umi-OCR。注意不要放在带中文或空格过长的目录里避免潜在的兼容性问题。第二步启动软件无需安装。解压后直接双击Umi-OCR.exe即可运行第一次启动会自动按你系统的语言设置切换界面语言。想手动切换的话到全局设置→语言/Language里选即可。第三步截图识别打开「截图OCR」标签页按下默认快捷键CtrlShiftS用鼠标框选屏幕上任意想识别的区域松开后文字自动提取并显示在右侧记录栏复制即可使用。截图识别是日常最高频的功能框选、识别、复制三步一气呵成看到识别结果出来的那一刻恭喜你已经正式上手了。进阶玩法4 个多数人不知道的高效技巧基础功能会用之后下面这几个能力才是 Umi-OCR 真正拉开差距的地方。技巧一用排版解析方案解决多栏和代码截图同样是识别为什么有人复制出来是乱序的有人复制出来直接能粘贴进文档关键在于「截图OCR」设置里的文本后处理 - 排版解析方案。它决定识别出的文字块按什么顺序、什么方式拼接多栏-按自然段换行适合大部分网页、论文等双栏或多栏排版单栏-保留缩进专门用于解析代码截图保留行首缩进和行中空格不做处理OCR 引擎的原始输出如果你经常把代码截图转成文本选单栏-保留缩进缩进和空格会原样保留粘贴进编辑器里直接能用。代码截图识别配合保留缩进方案还原度接近原生代码技巧二用忽略区域排掉水印和页眉页脚批量识别扫描件时最烦人的不是文字本身而是图片角落的水印、LOGO、页眉页脚。它们会混进识别结果里还得手工清理。「批量OCR」标签页右侧设置里可以进入忽略区域编辑器按住右键在图片上画出矩形框把这些区域圈起来。任务执行时完全落在框内的文本块会被直接丢弃水印识别问题从此一劳永逸。技巧三二维码不仅能扫还能批量生成「二维码」标签页支持截图、粘贴、拖入图片识别其中的二维码和条形码一张图多个码也能一次读出支持 Aztec、QRCode、PDF417 等 19 种协议。反过来输入任意文本就能生成二维码图片还能自定义宽高和纠错等级。生成 Wi-Fi 分享码、名片信息都不用再求助于在线网站了。技巧四扫描版 PDF 一键变成可搜索文档这是被很多人忽略的重头戏。在「文档识别」标签页拖入 PDF 扫描件选择输出为双层可搜索 PDF——识别出的文字会被写入 PDF 底层上层保留原图。结果就是原本只能肉眼阅读的扫描件现在可以全文搜索、复制、选中高亮。支持pdf, xps, epub, mobi, fb2, cbz格式同样可以设置忽略区域排除页眉页脚还可以在任务完成后自动关机或休眠。实战演练把一整本纸质笔记搬进电脑理论讲完了走一遍完整的真实流程。假设你要把一本 30 页的纸质笔记变成电子版拍照用手机把每一页拍下来导入电脑放进一个文件夹批量导入打开「批量OCR」标签页点「选择图片」或直接把整个文件夹拖进去支持jpg, png, webp, bmp, tif等常见格式忽略水印如果照片角落有手指、阴影或水印先进入忽略区域编辑器框选掉设置输出在右侧设置里选择输出格式——需要整理成文章选md需要统计分析选csv最通用的是txt开始任务点击「开始任务」进度条实时显示处理状态几百张图片没有数量上限全部跑完还能自动待机批量识别支持一次导入数百张图片逐个显示识别结果与置信度任务跑完后识别记录可以直接复制也可以按设定格式保存到指定目录。纸质笔记变成可搜索的电子文本整个过程不用联网隐私完全在自己手里。避坑指南新手最容易踩的 5 个坑常见错误正确做法❌ 解压到含中文的路径如C:\用户\下载✅ 解压到纯英文路径如D:\Umi-OCR❌ 识别大图时发现文字丢失✅ 在批量页「设置→文字识别→限制图像边长」中调高数值❌ 截图时界面闪烁、错位✅ 全局设置→界面和外观→渲染器切换渲染方案或关闭硬件加速❌ 识别结果顺序混乱✅ 根据内容形态切换排版解析方案多栏/单栏/保留缩进❌ 批量识别水印干扰严重✅ 先用忽略区域把水印和页眉页脚框选掉另外一个小提醒软件窗口右上角可以锁定标签页防止日常使用中误触关闭标签栏左上角可以切换窗口置顶边看资料边识别时非常顺手。生态延伸命令行和 HTTP 接口能做什么Umi-OCR 远不止一个图形界面。它内置了完整的命令行和 HTTP 接口让你可以把文字识别能力嵌进自己的工作流。命令行调用主程序Umi-OCR.exe本身就是命令行入口需保证 HTTP 服务开启默认开启。# 鼠标截屏并直接复制结果到剪贴板 umi-ocr --screenshot --clip # 指定截取范围并输出到文件 umi-ocr --screenshot screen0 rect50,100,300,200 --output test.txt # 识别指定图片或整个文件夹 umi-ocr --path D:/img1.png D:/image/test # 从文本生成二维码图片 umi-ocr --qrcode_create https://example.com D:/输出图片.jpeg 256 256所有指令都支持简写比如--screenshot可以简写为--scLinux 用户也可以用umi-ocr.sh脚本。HTTP 接口软件默认在http://127.0.0.1:1224提供本地接口。发一个 POST 请求带上 base64 图片就能拿到 JSON 格式的识别结果import json, requests url http://127.0.0.1:1224/api/ocr data { base64: 图片的base64编码字符串, options: {data.format: text} } response requests.post(url, datajson.dumps(data), headers{Content-Type: application/json}) print(json.loads(response.text))接口还支持 PDF 文档识别、二维码识别/生成、参数动态查询。想深入了解可以翻阅项目的命令行手册与 HTTP 接口文档命令行手册位于docs/README_CLI.mdHTTP 接口手册位于docs/http/README.md。对开发者来说这些接口意味着你可以用 Python、JavaScript 甚至任意语言把 Umi-OCR 变成项目里的文字识别引擎。想从源码开始研究或二次开发也可以用git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR拉取整个项目。从现在开始让图片里的文字随取随用回头看这篇文章我们其实只做了一件事把一个截图后手动抄写的麻烦替换成一个三秒出结果的快捷键。截图识别CtrlShiftS框选即识别日常查资料最快批量处理几百张图片或一整本扫描版 PDF挂机跑完即可排版与忽略区域让结果符合阅读习惯水印干扰归零命令行与接口把识别能力接入自己的脚本和工作流这款免费离线 OCR 软件不需要注册、不需要联网、不需要付费现在就可以下载来试试。建议你今天就做一件事随手截一张经常要抄写的网页截图按下CtrlShiftS你会立刻明白什么叫再也回不去手动抄写了。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表