ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

MinerU Gradio WebUI:快速把 PDF 变成 Markdown 的可视化方案

2026/8/29 9:40:53 拓冰建站 浏览量
MinerU Gradio WebUI:快速把 PDF 变成 Markdown 的可视化方案 MinerU Gradio WebUI快速把 PDF 变成 Markdown 的可视化方案【免费下载链接】MinerUTransforms complex documents like PDFs and Office docs into LLM-ready markdown/JSON for your Agentic workflows.项目地址: https://gitcode.com/GitHub_Trending/mi/MinerUMinerU 把 PDF、Office 文档解析成 LLM 能直接用的 Markdown/JSONGradio WebUI 则让你不用碰命令行在浏览器里拖个文件就能看到结果。适合第一次上手、想直观看到解析效果的人。一图看懂 MinerU 在做什么上传文档后MinerU 会先做文档分类和版面检测再把正文、公式、表格分别识别、排序、合并最后统一输出 Markdown、content list 和可视化结果整条链路你都能在 WebUI 里看到状态。3 步跑起来环境要求Python 3.10–3.13建议 16GB 内存、NVIDIA GPU 8GB纯 CPU 也能跑只是慢。1. 装核心包用 pip 装一次即可国内网络加个镜像源更稳pip install -U mineru[all] -i https://mirrors.aliyun.com/pypi/simple2. 启动 WebUI默认端口 7860第一次启动会自动下载模型耐心等它跑完mineru-gradio --server-name 0.0.0.0 --server-port 78603. 浏览器传文件打开http://127.0.0.1:7860拖入 PDF也支持图片、DOCX/PPTX/XLSX点转换右侧会出 Markdown 渲染、原始文本和 content_list 三种结果可直接下载。按场景挑配置后端是 WebUI 里最重要的选择pipeline通用省显存hybrid-engine默认精度更高vlm-engine适合大文档高质量解析*-http-client则连远程服务、本地几乎不吃资源。处理一篇带公式的论文选hybrid-engine公式、表格保持默认开启强度选 high出来的 Markdown 公式用$包裹渲染效果最贴近原稿。批量转几十份报告用pipeline后端更省资源页面范围设个上限顶部最大页数滑条扫出来的扫描件勾选强制 OCR并选对语言识别准确率会明显提升。显存只有 6G 怎么调两条路要么--max-convert-pages限制单次处理页数要么换vlm-http-client/hybrid-http-client把重活甩给远程mineru-openai-server本地只出前端。踩坑速查现象大概率原因一条命令解决启动报端口占用7860 已被占mineru-gradio --server-port 7861模型下载很慢/失败访问不了 HuggingFaceexport MINERU_MODEL_SOURCEmodelscope中文识别错字语言没设对界面选 OCR 语言为ch并勾选强制 OCR显存不够 OOM文档太长mineru-gradio --max-convert-pages 50公式不渲染LaTeX 分隔符不匹配mineru-gradio --latex-delimiters-type all查日志的通用命令export MINERU_LOG_LEVELDEBUG怎么选日常用pipeline省心省显存要精度选hybrid-engine默认多数场景够用纯本地资源紧张就上*-http-client连远程服务。后端精度显存/资源适合pipeline中低普通文档、批量hybrid-engine高中论文、默认选择vlm-engine高高大文档、追求质量后端选项和参数可能随版本更新以mineru-gradio --help实际输出为准。【免费下载链接】MinerUTransforms complex documents like PDFs and Office docs into LLM-ready markdown/JSON for your Agentic workflows.项目地址: https://gitcode.com/GitHub_Trending/mi/MinerU创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考