MinerU官方正版

MinerU官方正版

软件下载 安全检测通过

介绍

MinerU官方正版是一款十分优秀的智能数据提取软件,软件功能强大,操作简单易用,提供70多种语言,专注于PDF文档的高效解析,能够快速处理复杂的多模态 PDF 文档,如图片、表格、公式和脚注等,支持Markdown、content.json 和 listlayout.json等多种输出格式,满足用户的使用需求,感兴趣的小伙伴赶快下载使用吧!

MinerU官方正版软件功能

1、删除页眉、页脚、脚注、页码等元素,保证语义连贯。

2、按照人类阅读顺序输出文本,适用于单栏、多栏和复杂排版。

3、保留原始文档的结构,包括标题、段落、列表等。

4、提取图像、图片说明、表格、表格标题和脚注。

MinerU官方正版

5、自动识别文档中的公式并将其转换为LaTeX格式。

6、自动识别文档中的表格并将其转换为HTML格式。

7、自动检测扫描的PDF和失真的PDF,并启用OCR功能。

8、OCR支持109种语言的检测和识别。

MinerU官方正版

9、支持多种输出格式,如多模态和NLP的Markdown、按阅读顺序排序的JSON、信息丰富的中间格式等。

10、支持多种可视化结果,包括布局可视化、跨度可视化等,便于高效确认输出效果和质量检查。

11、支持纯CPU环境,支持GPU(CUDA)/NPU(CANN)/MPS加速。

12、兼容Windows、Linux和Mac平台。

MinerU官方正版软件安装步骤

1、在本站下载软件安装包,点击我同意继续安装;

MinerU官方正版

2、选择安装选项,点击下一步;

MinerU官方正版

3、自定义选择安装位置,点击安装。

MinerU官方正版

MinerU官方正版软件更新日志

2.7.6 (2026/02/06)

新增国产算力平台昆仑芯、太初元碁的适配支持。

目前已由官方和厂商适配并支持的国产算力平台包括:昇腾、平头哥、沐曦、海光、燧原、摩尔线程、天数智芯、寒武纪、昆仑芯、太初元碁、壁仞。

MinerU 持续兼容国产硬件平台,支持主流芯片架构,助力科研、政企用户迈向文档数字化新高度。

2.7.4 (2026/01/30)

新增国产算力平台天数智芯、寒武纪的适配支持。

2.7.2 (2026/01/23)

新增国产算力平台海光、燧原、摩尔线程的适配支持。

跨页表合并优化,提升合并成功率与合并效果。

2.7.1 (2026/01/06)

bug 修复:#4300

更新 pdfminer.six 依赖版本以解决 CVE-2025-64512

支持输入图像的 EXIF 方向自动校正,提升 OCR 识别效果。#4283

2.7.0 (2025/12/30)

简化安装流程,使用 uv pip install mineru[all] 即可安装所有可选后端依赖。

增加全新后端 hybrid,结合 pipeline 与 vlm 的优势:

从文本 PDF 中直接抽取文本,在文本 PDF 场景原生支持多语言识别,并大幅减少解析幻觉;

通过指定 OCR 语言,在扫描 PDF 场景支持 109 种语言的文本识别;

支持独立的行内公式识别开关,在不需要时可单独关闭以改善结果视觉效果。

简化 vlm/hybrid 后端的引擎选择逻辑,用户只需指定 *-auto-engine 即可自动选择合适的推理引擎。

默认解析后端从 pipeline 切换至 hybrid-auto-engine,提升新用户开箱即用时的结果一致性。

Gradio 应用增加 i18n 适配,支持中英文切换。

2.6.7 (2025/12/12)

bug修复: #4168

2.6.6 (2025/12/02)

Ascend适配优化

优化命令行工具初始化流程,使Ascend适配方案中vlm-vllm-engine后端在命令行工具中可用。

为Atlas 300I Duo(310p)设备更新适配文档。

mineru-api工具优化

为mineru-api接口参数增加描述性文本,优化接口文档可读性。

可通过环境变量MINERU_API_ENABLE_FASTAPI_DOCS控制是否启用自动生成的接口文档页面,默认为启用。

为vlm-vllm-async-engine、vlm-lmdeploy-engine、vlm-http-client后端增加并发数配置选项,用户可通过环境变量MINERU_API_MAX_CONCURRENT_REQUESTS控制api接口的最大并发请求数,默认为不限制数量。

2.6.5 (2025/11/26)

增加新后端vlm-lmdeploy-engine支持,使用方式与vlm-vllm-(async)engine类似,但使用lmdeploy作为推理引擎,与vllm相比额外支持Windows平台原生推理加速。

新增国产算力平台昇腾/npu、平头哥/ppu、沐曦/maca的适配支持,用户可在对应平台上使用pipeline与vlm模型,并使用vllm/lmdeploy引擎加速vlm模型推理,具体使用方式请参考其他加速卡适配。

国产平台适配不易,我们已尽量确保适配的完整性和稳定性,但仍可能存在一些稳定性/兼容问题与精度对齐问题,请大家根据适配文档页面内红绿灯情况自行选择合适的环境与场景进行使用。

如在使用国产化平台适配方案的过程中遇到任何文档未提及的问题,为便于其他用户查找解决方案,请在discussions的指定帖子中进行反馈。

2.6.4 (2025/11/04)

为pdf渲染图片增加超时配置,默认为300秒,可通过环境变量MINERU_PDF_RENDER_TIMEOUT进行配置,防止部分异常pdf文件导致渲染过程长时间阻塞。

为onnx模型增加cpu线程数配置选项,默认为系统cpu核心数,可通过环境变量MINERU_INTRA_OP_NUM_THREADS和MINERU_INTER_OP_NUM_THREADS进行配置,以减少高并发场景下的对cpu资源的抢占冲突。

2.6.3 (2025/10/31)

增加新后端vlm-mlx-engine支持,在Apple Silicon设备上支持使用MLX加速MinerU2.5模型推理,相比vlm-transformers后端,vlm-mlx-engine后端速度提升100%~200%。

bug修复: #3849 #3859

2.6.2 (2025/10/24)

pipline后端优化

增加对中文公式的实验性支持,可通过配置环境变量export MINERU_FORMULA_CH_SUPPORT=1开启。该功能可能会导致MFR速率略微下降、部分长公式识别失败等问题,建议仅在需要解析中文公式的场景下开启。如需关闭该功能,可将环境变量设置为0。

OCR速度大幅提升200%~300%,感谢 @cjsdurj 提供的优化方案

OCR模型优化拉丁文识别的准度和广度,并更新西里尔文(cyrillic)、阿拉伯文(arabic)、天城文(devanagari)、泰卢固语(te)、泰米尔语(ta)语系至ppocr-v5版本,精度相比上代模型提升40%以上

vlm后端优化

table_caption、table_footnote匹配逻辑优化,提升页内多张连续表场景下的表格标题和脚注的匹配准确率和阅读顺序合理性

优化使用vllm后端时高并发时的cpu资源占用,降低服务端压力

适配vllm0.11.0版本

通用优化

跨页表格合并效果优化,新增跨页续表合并支持,提升在多列合并场景下的表格合并效果

为表格合并功能增加环境变量配置选项MINERU_TABLE_MERGE_ENABLE,表格合并功能默认开启,可通过设置该变量为0来关闭表格合并功能