Umi-OCR离线 OCR 实操指南截图、批量图片与 PDF 识别【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR周五 18:40你手头有 200 张手机拍的讲义照片和一摞扫描 PDF下班前想把它们整理成能复制、能搜索的文本。Umi-OCR 是一个免费开源的离线 OCR 软件截图 OCR、批量图片识别、PDF 文档识别、二维码扫描与生成全部在本地完成文件不传服务器不注册不按字数计费断网也能跑完。解压安装包拿到第一个识别结果最短路径一共四步把发行版.7z压缩包解压到固定目录无需安装双击Umi-OCR.exe首次打开会按系统语言自动切换界面在「截图OCR」标签页按页面上的快捷键唤起截图框选屏幕上的文字右侧识别记录面板立刻出结果划选复制或改几个字再复制。第一次用把标签栏左上角的窗口置顶和右上角的锁定标签页两个开关摸熟就够。你喂给它什么它还你什么你喂给它它还你屏幕截图、剪贴板图片可选中、可编辑的文字排版可自动整理一整个图片文件夹jpg、png、webp、bmp、tif 等每张图一个txt、md、csv(Excel)或jsonl文件扫描 PDF、epub、mobi 等文档双层可搜索 PDF版式不变文字能 CtrlF带二维码、条形码的图片支持一图多码码内文字覆盖 QRCode、EAN13、PDF417 等 19 种协议一段普通文本生成好的二维码图片可指定尺寸和纠错等级三条能直接照抄的工作流工作流一扫描 PDF 文件夹 → 可搜索 PDF目标几百份扫描文档归档后能全文检索。入口「文档识别」标签页把整个文件夹拖进去。关键设置输出勾选双层可搜索PDF固定出现在页眉页脚的文字用忽略区域右键画框排除打开任务完成后自动关机。产出同目录下一份版式不变、但能复制搜索的 PDF。工作流二手机讲义照片 → Markdown 笔记目标一学期拍的照片讲义变成可编辑笔记。入口「批量OCR」标签页拖入照片文件夹。关键设置输出勾选md排版解析方案选「多栏-按自然段换行」双栏讲义能按段落断开。产出每张照片一个 .md 文件用 Typora 或 VS Code 打开就是分好段的讲义。工作流三脚本静默调用 OCR目标自动化脚本里取识别结果不弹界面。入口主程序Umi-OCR.exe本身就是命令行入口。关键设置先在「截图OCR」标签页关掉任务完成弹出主窗口。产出结果直接写进脚本指定的文件后续流程接着处理。结果不对时按这个顺序排查你看到长图识别结果不完整、像被裁掉一角大概率是「限制图像边长」默认值偏低先确认图片尺寸再去批量页「设置 → 文字识别」把数值调高或设为无限制。你看到水印词、页眉页脚总混在结果里大概率是忽略区域没画好。在忽略区域编辑器里按住右键画矩形注意机制是框内整个文本块被忽略所以框要完全包住水印可能出现的位置画大一点更稳妥。你看到老显卡机器上截图闪烁、界面错位大概率是显卡加速渲染不兼容。去「全局设置 → 界面和外观 → 渲染器」切换到其他渲染方案或关闭硬件加速。你看到脚本调用命令行却收不到回传大概率是重定向失效系统的和|对 Umi-OCR 可能不起作用。改用--output file.txt写文件或走 HTTP 接口的HTTP转发命令行说明在 docs/http/argv.md。你看到 Linux 或老系统启动直接报错先确认拿的是release/开头的稳定分支Linux 侧 glibc 2.31 以上Debian 11、Ubuntu 20 及更新系统可用Docker 部署方式见官方运行库仓库说明。想再深一层命令行入口主程序即入口一条命令截图识别并写入剪贴板umi-ocr --screenshot --clip参数全表见 docs/README_CLI.md。HTTP 接口可传 Base64 图片做识别也能走文档识别流程拿双层可搜索 PDF参数定义见 docs/http/api_doc.md附 api_doc_demo.py 示例。当前稳定版本 v2.1.5新增日志机制与--reload配置重载沿革见 CHANGE_LOG.md功能说明以 README.md 为准。想读源码或参与开发main/dev分支可能含不稳定的新功能研究学习可用日常使用请拿 release 版本git clone --single-branch --branch main https://gitcode.com/GitHub_Trending/um/Umi-OCR遇到 Bug 或有功能建议直接在项目的 Issue 页面提交界面翻译由 Weblate 平台协作维护覆盖英、繁中、日、俄等十余种语言也欢迎译者参与。下载一个发行版解压出来先框一次屏幕试试识别面板里出现的几行字就是它能做到的起点。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
阅读完成 · 觉得有帮助?