pipeline-patternlisted
Install: claude install-skill shaokeyibb/anti-asu-skills
# /pipeline-pattern:批量简历生产线识别
单份简历核验是"证伪一条条主张",成本高、结论弱。而当 HR 手上有一批简历时,存在一个**杠杆更高的信号**:**结构性雷同**。
如果二十份简历里有六份使用了同一套版式、同一种句式节奏、同一组项目、同一类开源贡献模式,那么这六份简历大概率出自同一条生产线——某个简历包装工具、某个培训机构、某个求职社群的模板。
这个发现的价值**不是判定这六个人在造假**(他们很可能都是真实做过这些项目的),而是:
> **对这批简历中来自模板的共性表述,降低其信息权重;把面试的注意力转向能区分个体的部分。**
换句话说:当六份简历都写着"主导设计高并发架构,QPS 提升 300%"���,这句话就不再是区分度信号,面试官需要问别的。
## 边界
- **本 skill 的产出绝不能用于淘汰任何候选人**。出自同一培训班、用了同一个简历工具、做了同一个热门项目——都**不是**任何形式的负面事实。培训班是正当的学习途径,简历工具是正当的效率工具。
- **绝不能形成对特定群体的歧视**。不得基于识别结果推断候选人的院校层次、经济状况、家庭背景或任何受保护特征,也不得建议对某个来源的候选人整体降级。
- 结论的唯一合法用途是**调整面试提问策略**:既然模板部分无区分度,就多问模板之外的部分。
- 只比对简历文本本身与候选人主动提供的公开材料。不比对候选人之间的私人关系,不推断谁认识谁。
## 核验流程
### 第一步:建立指纹
对每份简历提取以下特征,读 [references/template-fingerprints.md](references/template-fingerprints.md) 了解各维度的具体提取方法:
| 维度 | 提取内容 |
| --- | --- |
| **版式指纹** | 分栏结构、字体、配色、图标使用、分区标题样式、页数、信息区排列顺序 |
| **句式指纹** | 要点条目的句式结构、平均长度、动词选择、是否每条都挂数字 |
| **词汇指纹** | 高频专有措辞("链路""闭环""赋能""治理""0→1""体感"等) |
| **项目组合指纹** | 项目类型的组合方式(如"一个 RAG + 一个秒杀 + 一个手写框架"这种覆盖多方向的经典组合) |
| **开源指纹** | 贡献的仓库集合、PR 类型、时间窗口 |
| **凭证指纹** | 同一竞赛的同一届次、同一批证书 |
| **叙事指纹** | 自我定位的措辞方式、技能栏的组织逻辑 |
### 第二步:聚类比对
两两比对指纹,按相似度分层:
- **强雷同**:版式几乎一致(同一模板)+ 句式节奏一致 + 项目组合高度重合。
- **中度雷同**:句式与措辞明显同源,但版式不同(可能同一培训内容、不同模板)。
- **弱雷同**:只有项目类型重合。
**极重要**:**弱雷同不构成任何信号**。热门项目类型本来就集中——大量候选人做 RAG 项目,只是因为这是当前最热的学习方向。这属于时代共性,不是生产线特征。
只有**版式 + 句式 + 项目组合**三者同时高度雷同,才值得记录。
### 第三步:区分"共同来源"与"共同经历"
发现雷同后,必须先排除完全正当的解释:
| 观察 | 正当解释 |
| --- | --- |
| 多人项目相同 | 他们是**同一个团队的成员**——这非常常见,也完全诚实 |
| 多人经历相同 | 同一实习项目组、同一课程、同一竞赛