doc-atlaslisted
Install: claude install-skill lemomo-ai/doc-atlas
# 多格式文档 → 可视化信息面板(doc-atlas)
把一份或多份文档(PDF / Word / PPT / Excel / HTML / EPUB / Markdown…)**归一化为 Markdown 中间层 → 跨文件梳理合并成一个统一知识结构(model.json)→ 渲染成一个离线可开的单文件 `dashboard.html`**:左侧固定目录树,右侧按需出现的模块化内容(关键指标卡、核心要点、逻辑/关系图、数据图表、冲突对照、章节详情)。
**三条核心价值(一切取舍围绕它们)**:
1. **高度炼化**——读者看面板就够了,不必再翻原文;若做得杂乱无章,那还不如直接看 PDF。
2. **准确可溯**——零幻觉、每个数字/结论都能指回「哪个文件第几页」,不确定就诚实标注。
3. **逻辑图是主角**——把文档的核心逻辑/因果/关系做成醒目的大图,这是本工具最大的卖点。
**路径模型(重要)**:命令在**用户的文档文件夹里**运行(即当前工作目录 `cwd`,里面放着用户的 PDF/文档),**不要 `cd` 进 skill 目录**。脚本一律用绝对路径 `"$SKILL_DIR/scripts/..."` 调用;所有产物写到用户文件夹下的 `./doc-atlas-out/`。`SKILL_DIR` = 本 skill 的安装目录(即本 `SKILL.md` 所在目录),开工前设一次:
```bash
SKILL_DIR="$HOME/.claude/skills/doc-atlas" # 本 skill 安装目录(按实际位置改)
OUT="./doc-atlas-out" # 产物目录,落在用户当前文件夹下
```
---
## 何时用本 skill
- 用户给了文档文件,并希望「梳理内容 / 生成面板 / 可视化总结 / 理清逻辑 / 多文件合并梳理」。
- 单文件也可用(跳过跨文件去重部分);多文件时跨文件合并是核心价值。
**输出放哪**:默认建在用户当前文件夹下的 `./doc-atlas-out/`(里面含 `workspace/`、`model.json`、`dashboard.html`);若用户指定了目录就沿用。
---
## 工作流总览(六步)
0. **扫描 + 一次性确认**:先扫描当前文件夹(只读无害),再**用一次 AskUserQuestion 同屏问两件事**——输出语言 + 纳入哪些文件。
1. **归一化**:每个被确认的文件 → `workspace/<name>/{content.md, assets/, meta.json}`(PDF 逐页文本带**页锚**、表格走结构化抽取保数值列;源未变自动跳过)。
2. **梳理合并(核心)**:通读、去重 / 识冲突 / 互补 / 判关系,重组成 `model.json`;写完做**完整性批判第二遍**并填 `distillation_report`(含数值字段)自检。
3. **事实核查(对抗式)**:对**对外/高风险**文档,派 subagent **回原件证伪**,修正 `❌/➖` 后再渲染(低风险单文件可内联自查)。
4. **渲染**:`model.json (+workspace) → dashboard.html`(单文件、零外链、断网可开;渲染前自动跑 `validate_model.py` 机器校验)。
5. **自检交付**:无头校验无报错、抽查溯