tashanzhishilisted
Install: claude install-skill anneheartrecord/charles-skill
# 剪藏他人观点到「他山之石」(tashanzhishi)
## Overview
把一个视频、播客或文章的内容,整理成一篇**可以直接阅读的文章**,存进 `20-knowledge/他山之石/`。
核心原则:产出的是给读者看的**文章**,不是观点汇总,也不是逐条「作者认为……」的清单。忠实于来源、把事实和推测分清、标注作者立场,但用流畅的文章呈现。这不是写用户自己署名的内容,所以**不套用户文风、也不跑 de-ai-flavor**。输出永远中文。
## 何时用 / 不用
用:用户给链接或粘贴文字稿,说要「剪藏到他山之石」「整理成他山之石文档」「归档这个观点」。
不用:用户要写自己署名的推文/文章(那是写作任务,走文风流程)。
## 输入两种来源
1. **链接**(YouTube/B站/播客等)→ 用 yt-dlp 抓元数据 + 字幕。
2. **粘贴的文字/字幕/文章** → 直接用,跳过抓取。
## 流程
### 1. 拿到原文
链接来源,运行本目录的脚本:
```bash
bash ~/.claude/skills/tashanzhishi/fetch-transcript.sh "<链接>" # 默认读 Chrome 登录态
bash ~/.claude/skills/tashanzhishi/fetch-transcript.sh "<链接>" safari # 换浏览器:safari/brave/edge/firefox
```
它会打印一个临时目录路径,里面有 `meta.txt`(标题 ||| 作者 ||| 上传日期 ||| 链接 ||| 时长)和一个 `.vtt` 字幕文件。YouTube 现在要求登录态才能下字幕,脚本默认读 Chrome 的 cookies,所以需要在 Chrome 里登录过 YouTube。
把字幕清洗成纯文本再读:
```bash
python3 ~/.claude/skills/tashanzhishi/vtt2text.py "<那个目录>"/sub.*.vtt > /tmp/transcript.txt
```
`vtt2text.py` 会去掉时间轴、内联标签、HTML 实体,并合并自动字幕的滚动重复。然后用 Read 读 `meta.txt` 和 `/tmp/transcript.txt`。注意:视频结尾常有重复的「精彩片段」集锦,蒸馏时忽略那段。
### 2. 写成一篇可读文章
- 清洗自动字幕的识别错误、逐字空格、错的专有名词(公司名、人名、术语、英文缩写),但不改作者语气和立场。
- 用流畅的中文写成一篇文章,**把读者当杂志读者**:正常标点(用冒号、写完整句子),不要「短语。完整句。」这种断裂节奏,也不要「1. 作者认为 X」的清单堆叠。
- 按内容自然分几个 `##` 小标题导航;attribution 自然融进句子(他算了笔账、她的观察是、他给了个尺子)。
- 事实与推测分清:可核实的当事实写,推测和判断点明是作者观点。结尾用一段「可信与存疑」的编辑提醒收尾。
- 可以摘 1 到 5 句原话金句融进正文,但别让全文变成摘抄。
### 3. 写文件
写到 `20-knowledge/他山之石/<简洁中文标题>.md`,文件名不含斜杠。`captured` 用 `date +%F` 的当天日期。结构见下。
## 文档结构(可读文章,不是观点汇总)
```markdown
---
tags: [他山之石, <领域标签