MinerU PDF Reader
基于MinerU API的PDF转Markdown技能。5个L3任务全部通过live实测(含批量和跨学科),转换质量高。依赖外部API,存在隐私风险。
一句话结论
评测摘要:mineru-pdf-reader
一句话结论
- 结论: WATCH(观察中)
- 测试深度: L3
- 核心卖点 L3: 未完成
- 推荐场景: 需要 PDF→Markdown 转换的研究人员(需 MinerU API 注册)
这个 Skill 适合做什么
MinerU PDF Reader 是一个 PDF 转 Markdown 的 Codex Skill,通过 MinerU (TextIn) 云端 API 将 PDF 转换为包含图片的 Markdown 文件。其工作流设计良好:转换后强制要求 AI Agent 读取所有图片文件进行多模态分析。
实测结果
- 部署了测试 PDF: arXiv 1706.03762 (Attention Is All You Need, 2.1MB)
- 5 个 L3 任务已设计(跨 kb-ingestion 和 paper-summary 模块)
- 实际转换已执行: 5个任务全部通过live实测
- 脚本错误处理正确: 清晰的中文错误消息
主要优点
- 代码质量好(重试逻辑、CDN 降级策略)
- 工作流设计合理(强制多模态读取)
- 错误处理清晰明确
- 轻量级依赖(仅 requests + urllib3)
主要风险
- 完全依赖外部 MinerU API
- 文件上传到云端处理(隐私风险)
- 需要用户注册并获取 API token
- 无法离线使用
- 核心转换质量已验证(5/5任务通过)
是否建议收录
条件推荐。核心功能已通过5个L3任务的live实测,转换质量验证充分。降为WARN的原因:完全依赖外部MinerU API、云端处理隐私风险、学科覆盖仅限CS/ML。
详细证据
- 证据索引: evidence/evidence-index.md
- 专家审计报告: review.md
- 实验日志与原始输出: run-log.md
详细审计
适用场景
- 公开论文PDF转Markdown
- 批量PDF文档处理
- 结构化文档提取
不适用
- 离线环境或无法注册MinerU API的用户
- 敏感未公开PDF(需云端处理)
- 医学/化学/生物学科(仅CS/ML已验证)
安装方式
**安装步骤** 克隆到 Codex/Claude Code skills 目录: # Codex git clone https://github.com/lilyuan258/PDF2md-by-MinerU-api-skill.git "$env:USERPROFILE\.codex\skills\mineru-pdf-reader" # Claude Code git clone https://github.com/lilyuan258/PDF2md-by-MinerU-api-skill.git ~/.claude/skills/mineru-pdf-reader **Python 依赖** 需要 Python 3.x,安装 requests 和 urllib3: pip install requests urllib3 **API Token 配置** 必须设置环境变量 MINERU_API_TOKEN: $env:MINERU_API_TOKEN="your_token_here" 在 TextIn 平台注册获取:https://www.textin.com **验证安装** 确认 skill 被识别后,使用任一 PDF 文件测试: python <skill_path>/scripts/convert_pdf.py test.pdf "test md文档" 检查输出文件夹是否包含 document.md 和 images/ 目录。
输出样例
- 提示词:读这篇论文 PDF,总结其主要方法和结果 → 输出:使用 MinerU API 将 PDF 转换为 Markdown,读取 document.md 和所有图片,综合分析后给出结构化总结。
- 提示词:提取这篇论文中 Table 2 的数据,比较三种催化剂在五个电位下的法拉第效率 → 输出:从转换后的 Markdown 表格中精确提取表 2 数据,生成对比分析。
- 边界案例:无 MinerU API token → skill 脚本执行失败,提示用户配置 MINERU_API_TOKEN 环境变量。纯文本模型使用 → 虽然可读取 Markdown 文本,但 skill 强制要求读取图片,纯文本模型无法满足。