
Umi-OCR 离线 OCR 教程3 个高频场景与排障速查【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR把一批图片交给在线 OCR 网站要受上传限速和每日额度约束文件在别人服务器上存多久也说不准。Umi-OCR 是免费离线 OCR 工具图片全程不离开你的硬盘不注册、不上传。本文覆盖安装首跑、3 个高频场景、参数调优、排障和无界面用法读完即可上手。免安装部署下载与首次启动这一节把软件在你的电脑上跑起来。从发布页下载.7z包没装压缩软件就选.7z.exe自解压包解压到不带中文和空格的路径例如D:\Tools\Umi-OCR。Windows 双击Umi-OCR.exe启动Linux 运行umi-ocr.sh。主窗口由标签页组成截图 OCR、批量 OCR、文档识别、二维码、全局设置右上角可锁定常用标签防误关。提前说软件自带本地识别引擎和运行库部分杀毒软件会误报拦截进程这是闪退最常见的原因——首次启动前把软件目录加入白名单。截图识别把屏幕上的字一键抓走适合随手摘抄消息、界面里的零散文字。入口是截图 OCR标签页快捷键唤起截图框框住目标文字识别结果立刻出现在右侧记录栏。关键操作复制图片直接粘贴在别处如聊天窗口复制一张图回到 Umi-OCR 粘贴即可识别不用先存盘。记录栏直接改错右侧文字可手动修正还能划选多条记录一起复制顺手整理成想要的格式。竖排从右到左的栏由排版解析自动整理前提是引擎支持该语言。产出文字直接落在右侧记录栏改完划选复制即可不用再跳去别的编辑器。批量识别几百张图怎么拖、怎么导出适合一次性归档成批图片如旧照片、票据扫描件。入口是批量 OCR标签页把图片直接拖进窗口jpg、png、webp、bmp、tif 等格式都收数量没有上限几百张一次导入。关键操作点开始任务右侧逐张显示文件耗时、置信度和识别结果。v2.1.2起支持暂停任务软件不退出待机、休眠后接着跑。可设任务完成后自动关机或待机过夜挂机早上起来结果已跑完。产出与导出txt、jsonl、md、csv 四种格式其中 csv 用 Excel 直接打开。文档识别把扫描版 PDF 转成可搜索文本适合把扫描版 PDF、电子书数字化变成能搜索的存档。入口是文档识别标签页支持 pdf、xps、epub、mobi、fb2、cbz 六种格式典型场景就是扫描版 PDF。关键操作默认优先提取 PDF 自带文本层速度快、零识别误差纯扫描页才交给本地引擎逐页识别。也可强制整页 OCR或反过来只提取原文本。支持按页码范围设置忽略区域剔除页眉、页脚、页码。v2.1.2 起可导出单层纯文本 PDF体积小、好编辑。产出核心是双层可搜索 PDF——底层原图、上层透明文字外观和扫描件一致文字却能搜索、复制、划线公司合同归档、论文数字化直接顶用。调优 4 个旋钮常见问题都能修 识别之后的常见问题靠下面 4 个旋钮解决。排版解析方案怎么选文字顺序乱、段落粘连、代码缩进丢了别动引擎去文字识别设置里换排版解析方案输出就会按阅读顺序重新组织方案适合什么多栏-按自然段换行两栏/三栏论文书籍覆盖面最广最常用多栏-总是换行每行独立适合按行后续处理多栏-无换行整段强制合并成一行单栏-按自然段换行单栏文档段落自然断行单栏-保留缩进代码截图保住行首缩进和行中空格不做处理引擎原始输出不整理拿不准就选多栏-按自然段换行各方案都能同时处理横排和竖排从右到左的栏。忽略区域框怎么画才生效图片角落的水印、LOGO、页眉页脚总混进结果从批量页右侧设置进入忽略区域编辑器按住右键画多个矩形框框内文字在识别时自动排除。注意只有整个文本块完全落在框内才会被忽略不是按单个字符判断。画框宁可大一点把水印可能出现的位置全部包住画完记得保存漏框一次结果里就多一行杂音。引擎与识别语言库怎么切换某类文字识别不准或报错先去全局设置换引擎默认Rapid-OCR兼容性好PaddleOCR速度更快一些换引擎往往比调别的参数见效快。两种语言别混界面语言全局设置 → 语言中文、繁体、英文、日文、俄语、葡萄牙语等社区翻译维护管按钮菜单长什么样识别语言库各标签页文字识别设置里单独选或下载管引擎认哪种文字。界面用中文、日常识别日文书籍完全可以搭配。长图识别不全调哪个数特别高的截图、长图底部漏识别去文字识别设置里调高限制图像边长默认值为了平衡速度和内存适当调高即可覆盖长图。别放大原图——过度放大只会增加噪声反而降准确率。排障速查3 组常见现象 先对现象再找原因按顺序处理。识别结果现象最可能原因处理动作画了忽略区域水印还是混进来框没包住整个文本块或没保存配置重画更大的框确认配置已保存代码截图缩进、空格全丢排版方案不保留缩进方案切单栏-保留缩进长图识别缺胳膊少腿图像超过限制图像边长阈值调高该数值别放大原图显示与加载现象最可能原因处理动作截图时闪烁、界面错位显卡渲染不兼容全局设置 → 界面和外观 → 渲染器换方案或关硬件加速几万个文件的文件夹加载很卡超大文件夹同步加载v2.1.5 起为异步加载等预览进度走完再操作内存占用偏高PaddleOCR 线程与内存默认值v2.1.4 起默认限制在系统内存一半以内插件配置里再调低线程数任务与命令行现象最可能原因处理动作批量任务想中途休息旧版本不支持暂停升级到 v2.1.2 以上用暂停任务休眠后可继续命令行没反应HTTP 服务关闭或用了备用启动器确认 HTTP 服务开启默认开启仅监听本地环回用主程序Umi-OCR.exe仍解决不了查更新日志的版本说明确认该问题是否已在更新版本修复。无界面用法命令行与本地 HTTP 服务两条程序化入口把 Umi-OCR 接进脚本和快捷键工具。命令行入口就是主程序Umi-OCR.exe指令支持简写--screenshot可写--scumi-ocr --screenshot --clip umi-ocr --path D:/扫描件.png --output result.txt umi-ocr --qrcode_create 你好 D:/qrcode.png 256第一条截屏识别结果直接进剪贴板第三条生成 256 像素的二维码图。完整参数见命令行手册。本地 HTTP 服务在软件启动后就提供 OCR、文档识别、二维码三类接口几十行代码就能封装成局域网小工具实现上传图片 → 返回 JSON 结果。默认只监听本地环回图片与结果都留在自己电脑里需要局域网共享时把主机切换为任何可用地址。细节见HTTP 接口手册。免费、开源、完全离线识别引擎整套装在你自己的硬盘上。从一张随手截图到一整本扫描书归档文字的产出始终在你手里。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考