read-paperlisted
Install: claude install-skill LuoHaomin/read-paper
# read-paper — 论文精读拆解
把一篇(或多篇)学术论文整理成一套**详细、可教学的分析条目 + 一份导航总览**。本 skill **自动识别论文类型**(理论证明 / 实验方法 / 综述 / 系统),按类型选用对应的拆解模板——不再把所有论文都套进"定理+证明"的模子。
每个条目要做到:定位清晰、有大白话直觉、推导/实验可被逐步追问、点出非平凡之处、并焊进全局。**结构标准全部写死在本文件和 [`reference/`](reference/) 下的模板里——照着做即可。** 每个模板里都内嵌了自包含的范例条目当质量锚点。
> 本 skill 是**文档分析** skill(无 app、无截图)。"验证"标准 = 你真的拿一篇 PDF 跑通全流程,产出符合下文质量基线的条目。
>
> **两条铁律,贯穿全程:**
> 1. **脚本自定位**:驱动脚本 `extract.sh` 就在本 `SKILL.md` 的**同一目录**下——不要假设它装在 `.claude/skills/read-paper/`,先算出本 skill 目录再用。
> 2. **防幻觉优先**:每个公式 / 数字 / 结论都要能挂回原文出处;挂不上就标 `⚠️ 待核`,**绝不编造**。详见 §3。
---
## 0. 前置条件
- **首选:MinerU MCP(`mcp__mineru__parse_documents`)。** 若已配置(见 `~/.claude.json` 的 `mineru` 项),它**云端**解析、公式直出 LaTeX,是本 skill 的首选抽取器——不占本地资源、不挑机器。带 `MINERU_API_TOKEN` = precision 模式(长论文、`vlm` 高精度、批量);无 token = flash 模式(≤20 页免费)。
- **回退:`pdftotext`(poppler)** —— MinerU MCP 不可用或失败时用。唯一本地硬依赖:
```bash
command -v pdftotext || brew install poppler # macOS
# sudo apt-get install poppler-utils # Debian/Ubuntu
```
---
## 1. 抽取文本
**首选 MinerU MCP(公式直出 LaTeX,强烈推荐)。** 若 `mcp__mineru__parse_documents` 可用,直接调它——云端 precision/vlm,输出**干净的 LaTeX Markdown**(公式、表格、阅读顺序、双栏都处理好),从根上消除 pdftotext 的 Unicode 残缺体问题。
- `file_sources` 每项是路径/URL,或 `{"source":"...","pages":"2-3"}`;语言未知省略 `language`(默认 `ch`);一般别设 `enable_ocr`(服务器自动判)。
- 整篇:`parse_documents(file_sources=["paper.pdf"])`。
- 只要若干页:`parse_documents(file_sources=[{"source":"paper.pdf","pages":"2-3"}])`。
- 要拿图片/大结果落盘:加 `output_dir`,结果(含 `images/`)写到该目录,笔记可