OvisOCR2图片PDF识别精准识别成文字工具 功能介绍把成堆的扫描件、PDF、截图一键变成可编辑的 Markdown 或 txt 文档注意项解压路径不要包含中文电脑要求· Windows 系统· NVIDIA 显卡显卡需要 12G, 显卡驱动更新到最新版本· 显存偏小的显卡可在「参数设置」中下调并发页数、上下文长度、它替你解决什么你手上有 200 页的 PDF 论文、几百张合同扫描件、一沓财报截图需要把里面的文字、表格、公式全部提取出来整理成能编辑的文档。手动敲字 —— 一整天没了还容易出错找在线 OCR —— 要上传文件涉密资料不敢传还按页收费用传统 OCR —— 表格散架、公式变乱码、多栏排版读串行识别效果有多好底层是开源的 OvisOCR2 模型仅 0.8B 参数却相当能打在权威文档解析榜单 OmniDocBench v1.6 上综合得分 96.58是首个登顶该榜单的端到端模型 —— 此前榜首长期被结构复杂的多模块流水线方案占据。· 正 文 按人类阅读顺序还原多栏排版不会读串行· 表 格 输出标准 HTML 表格合并单元格也能正确还原· 公 式 输出 LaTeX可直接粘进 Word / Typora / Obsidian· 插 图 自动定位图表区域可裁剪成图片单独导出为什么值得装◆ 完 全 离 线模型跑在你自己的显卡上文件一个字节都不会离开这台电脑。合同、病历、财报、内部资料放心处理。不联网不上传不计费。◆ 真 · 批 量支持整个文件夹递归扫描几百个文件排队自动跑完。多个文件的页面会自动攒成一批送进显卡吞吐远高于一个一个处理。◆ 断 点 续 跑跑到一半断电了勾上「跳过已存在的结果文件」再点开始只补做没完成的部分已经跑好的不会白费。◆ 进 度 看 得 见左边队列实时显示每个文件的状态、页数、耗时右边同步预览识别结果 —— Markdown 渲染效果、原始源码、原图三个视图随时切换对照识别得对不对一眼就知道。◆ 输 出 即 用结果与源文件同名可选保持原有目录层级PDF 可整本合并成一个 .md也可以每页单独成文件。◆ 界 面 顺 手拖拽添加、深色 / 浅色主题一键切换、参数改完自动记住。所有识别参数都在「参数设置」页里带说明不用查文档。适合谁用· 需要把纸质 / 扫描资料数字化归档的人· 整理论文、教材、技术手册的研究者与学生· 处理合同、发票、报表的财务与法务· 给知识库 / RAG 准备高质量 Markdown 语料的开发者· 任何受够了「复制 PDF 结果全是乱码」的人OvisOCR2批量PDF、图片文档识别工具下载链接:下载链接https://pan.quark.cn/s/80cbf7006e9f解压密码: aibbs.fun