尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Umi-OCR 免费本地OCR:扫描件变可搜索,三分钟从解压到第一次识别

Umi-OCR 免费本地OCR:扫描件变可搜索,三分钟从解压到第一次识别 Umi-OCR 免费本地OCR扫描件变可搜索三分钟从解压到第一次识别【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR扫描的论文复制不出文字屏幕上的英文段落鼠标拖不动想把它变成能编辑的文本。Umi-OCR 是一款免费开源的离线文字识别工具识别全部在你的电脑本地运行不需要联网也不会上传任何图片。截图本地OCR、批量转文本、PDF 文档识别都支持从解压到看到第一个识别结果只需要三分钟。 快速上手从解压到第一次识别下载发布包。支持 Windows 7 x64 及以上、Linux x64包是.7z压缩格式或.7z.exe自解压格式后者在没有压缩软件的电脑上也能直接用。解压到任意目录双击Umi-OCR.exe。没有安装向导不需要注册解压即用。等模型加载。第一次启动要加载 OCR 模型会明显偏慢之后每次启动就快了。按默认键位CtrlAltZ框选屏幕上的文字区域Esc取消。把结果从剪贴板粘出来用右侧记录栏里还能再编辑、划选复制。除了解压安装Windows 用户也可以用 Scoop 命令行工具一键安装开发者则可以从源码构建运行。首次运行会按系统语言自动匹配界面想换繁体中文、英语、日语等进全局设置→语言/Language随时改。引擎选择现在不用纠结Rapid-OCR 兼容性更好Paddle-OCR 速度稍快全局设置里随时能切。装好之后先抓一段屏幕上的文字试试。 按任务实战四个常用场景随时框选屏幕上的文字会议字幕、教程截图、终端输出屏幕上复制不到的文字都用截图页处理。打开截图 OCR标签页。按CtrlAltZ框选区域Esc取消。查看右侧记录栏的结果错了直接改也可以跨多条记录划选复制。粘贴别处复制来的图片进软件识别或重复上一次截图的位置连续处理相邻内容。快捷键换成自己顺手的组合就行改完立即生效。几百张图片一次转成文本文件一文件夹的票据照片、扫描的档案页、批量截的小说图都丢给批量页。打开批量 OCR标签页拖入文件夹或多张图片jpg、png、webp、bmp、tiff 等格式都能识别。选择输出格式txt、jsonl、md、csv最后一种用 Excel 就能直接打开。点击开始任务没有数量上限几百张一次跑完。勾选完成后自动关机夜里挂机跑早上起来收结果。图上带着水印、页码时打开右栏的忽略区域编辑器按住右键把水印可能出现的位置框住可以画多个矩形。框内完整的文本块会被跳过框外内容照常保留框画得稍大一点更稳。扫描版 PDF 转成可搜索的电子文档拿到扫描的论文、合同最想要的就是在 PDF 里直接搜字、选字。打开文档识别标签页拖入文件。支持 pdf、xps、epub、mobi、fb2、cbz 六类格式。扫描页走 OCR电子 PDF 直接提取原有文本不用额外处理。输出选双层可搜索 PDF版式保留关键词搜索可用。页眉页脚碍眼就同样设置忽略区域把上下边距框掉。文档多就排队批量处理完成后也能自动关机。从图片里读出条形码和二维码二维码标签页同时管扫码和生成码。截图、粘贴或拖入本地图片读出图中的码一张图里多个码全部识别。协议覆盖 19 种QRCode、DataMatrix、EAN13、Code128、PDF417、Aztec 等常用码都在里面。生成码时输入文本调整纠错等级等参数输出一张码图片。⚙️ 调优与自动化让结果更好用上面四个任务覆盖了最常用的场景。想让结果更准有地方可调想接进自动化有命令行入口。先调识别语言文档里中英混杂时选包含中英文的组合模型识别率比只选单语明显好。再调排版解析引擎输出的文本块顺序不一定顺多栏-按自然段换行预设自动处理双栏版式论文、报告选它就够识别代码截图时选单栏-保留缩进行首缩进和行内空格都保留结果能直接粘进 IDE。还有忽略区域前面去水印、页眉提过思路一样。这些预设都能处理从右到左的竖排文字前提是引擎本身支持竖排。界面语言本身也不受限内置多国语言库繁中、英语、日语等都能用。命令行与脚本调用入口就是Umi-OCR.exe多数情况可直接写umi-ocr前提是全局设置里的本地 HTTP 服务开着默认就是开的主机保持仅本地即可。识别文件夹内所有图片结果写入文本文件umi-ocr --path D:/images --output result.txt框选屏幕识别结果复制到剪贴板umi-ocr --screenshot --clip其余参数按需组合--clipboard读剪贴板里的图片--output_append追加写入已有文件--qrcode_read扫图片里的码--qrcode_create由文本生成二维码--help查看完整说明。写脚本时可以走 HTTP 接口文档 里的/argv接口效果等价于拼一条命令行。 经验与常见问题硬件要求多高4GB 内存起步CPU 越强识别越快。内存紧张时别一次塞太多任务。模糊的图怎么调都不准图片质量优先扫描文档建议 300dpi 以上。超长图识别不全时进页面设置 → 文字识别调高限制图像边长的数值。输出格式怎么挑TXT 方便人工阅读编辑JSONL 方便程序处理CSV 方便导入 Excel 统计MD 适合写进笔记。几百张图一次跑行不行行但量大时按每批 50100 张分次跑更稳。遇到单张超大图卡住先切图再识别。截图时闪屏、界面错位去全局设置 → 界面和外观换一个渲染器或关掉硬件加速。离线 OCR 的意义就是数据始终留在你自己的电脑上文档不离开手断网照常跑没有次数额度。把压缩包解压到任意目录运行Umi-OCR.exe第一个识别任务三分钟之内跑完。常用资源命令行手册 · HTTP 接口文档 · 更新日志【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表