ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

MinerU 文档解析完整指南:从安装到 GPU 加速只需三步

2026/8/29 10:19:03 拓冰建站 浏览量
MinerU 文档解析完整指南:从安装到 GPU 加速只需三步 MinerU 文档解析完整指南从安装到 GPU 加速只需三步【免费下载链接】MinerUTransforms complex documents like PDFs and Office docs into LLM-ready markdown/JSON for your Agentic workflows.项目地址: https://gitcode.com/GitHub_Trending/mi/MinerUMinerU 是一个开源文档解析工具能把 PDF、图片和 Office 文档转成 LLM 可直接读取的 Markdown 与 JSON。本文只讲三件事怎么最快跑起来、按你的硬件挑哪个安装包、哪些变量必须设置。不展开原理看完就能用。第一条转换命令两行跑通有 GPU 的 Linux 或 macOS 机器装 core 核心包含 pipeline、vlm 解析后端与 Gradio 界面不含 vllmuv pip install mineru[core] mineru -p demo/pdfs/demo1.pdf -o output第一行安装第二行转换。-p接文件或目录-o接输出目录不传--api-url时命令会自动拉起本地临时 mineru-api 服务你不需要自己管服务进程。仓库里demo/pdfs/目录自带示例 PDF可以直接拿来试。按硬件挑安装包判断规则很简单条件 → 选择只有 CPU、想连远程推理服务 → 装基础包uv pip install mineru体积最小、不需要 torch运行时加-b vlm-http-client -u 服务端地址指向一个 OpenAI 兼容接口即可。有 Volta 及以上架构的显卡、显存 8G 起步想加速 VLM 推理 → 追加 vllm 扩展uv pip install mineru[core,vllm]。vllm 用 PagedAttention 管理 KV 缓存模型推理时的键值缓存批量解析时速度明显更快。Windows 用户 GPU → 选 lmdeploy 扩展替代 vllm用法几乎一致。一条红线vllm 和 lmdeploy 二选一不建议同时装避免依赖冲突。另外hybrid-http-client 模式比 vlm-http-client 重一点本地还需要mineru[pipeline]依赖。四个常用环境变量环境变量优先级高于命令行参数对所有命令都生效名称作用示例值MINERU_MODEL_SOURCE模型下载源huggingface 不通时切换modelscopeMINERU_FORMULA_ENABLE公式解析开关默认开启falseMINERU_TABLE_ENABLE表格解析开关默认开启trueMINERU_PDF_RENDER_TIMEOUTPDF 转图超时秒防异常文件卡住600MINERU_HYBRID_BATCH_RATIOhybrid-http-client 小模型批倍率按显存调节4高频踩坑现象 → 解法装 vllm 后报驱动错误→ 默认安装会拉到 vllm 0.21 系列需要 CUDA 13.0 兼容驱动环境是 CUDA 12.9 时按 vllm 官方说明选择对应 CUDA 的安装方式或直接使用 Docker 里的 vllm/vllm-openai:v0.21.0-cu129 基础镜像。中文识别效果差→ 命令里加-l ch指定文档语言可提升 pipeline 后端的中文准确率。低显存客户端吃紧→ 把 MINERU_HYBRID_BATCH_RATIO 按显存调小6G 以内设 8、4G 以内设 4、3G 以内设 2、2G 以内设 1。无论你是本地解析论文的研究者还是要在服务器上搭文档流水线的工程师MinerU 都有对应的安装路径。更多参数细节都在仓库 docs/zh/ 目录的文档里边用边查即可。【免费下载链接】MinerUTransforms complex documents like PDFs and Office docs into LLM-ready markdown/JSON for your Agentic workflows.项目地址: https://gitcode.com/GitHub_Trending/mi/MinerU创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考