← ClaudeAtlas

pipeline-patternlisted

批量简历生产线识别:在一批简历中检测版式、句式、项目组合、开源模式的结构性雷同,识别可能出自同一简历工具或培训模板的群体,产出的是"这些共性表述不具备区分度"的提问策略建议,绝不用于淘汰任何候选人。凡是同时面对多份简历要做批量判断就使用本技能——包括用户说"这批简历怎么都长一个样""这几个人是不是一个班出来的""帮我筛一下这十份简历"时。
shaokeyibb/anti-asu-skills · ★ 26 · Data & Documents · score 80
Install: claude install-skill shaokeyibb/anti-asu-skills
# /pipeline-pattern:批量简历生产线识别 单份简历核验是"证伪一条条主张",成本高、结论弱。而当 HR 手上有一批简历时,存在一个**杠杆更高的信号**:**结构性雷同**。 如果二十份简历里有六份使用了同一套版式、同一种句式节奏、同一组项目、同一类开源贡献模式,那么这六份简历大概率出自同一条生产线——某个简历包装工具、某个培训机构、某个求职社群的模板。 这个发现的价值**不是判定这六个人在造假**(他们很可能都是真实做过这些项目的),而是: > **对这批简历中来自模板的共性表述,降低其信息权重;把面试的注意力转向能区分个体的部分。** 换句话说:当六份简历都写着"主导设计高并发架构,QPS 提升 300%"���,这句话就不再是区分度信号,面试官需要问别的。 ## 边界 - **本 skill 的产出绝不能用于淘汰任何候选人**。出自同一培训班、用了同一个简历工具、做了同一个热门项目——都**不是**任何形式的负面事实。培训班是正当的学习途径,简历工具是正当的效率工具。 - **绝不能形成对特定群体的歧视**。不得基于识别结果推断候选人的院校层次、经济状况、家庭背景或任何受保护特征,也不得建议对某个来源的候选人整体降级。 - 结论的唯一合法用途是**调整面试提问策略**:既然模板部分无区分度,就多问模板之外的部分。 - 只比对简历文本本身与候选人主动提供的公开材料。不比对候选人之间的私人关系,不推断谁认识谁。 ## 核验流程 ### 第一步:建立指纹 对每份简历提取以下特征,读 [references/template-fingerprints.md](references/template-fingerprints.md) 了解各维度的具体提取方法: | 维度 | 提取内容 | | --- | --- | | **版式指纹** | 分栏结构、字体、配色、图标使用、分区标题样式、页数、信息区排列顺序 | | **句式指纹** | 要点条目的句式结构、平均长度、动词选择、是否每条都挂数字 | | **词汇指纹** | 高频专有措辞("链路""闭环""赋能""治理""0→1""体感"等) | | **项目组合指纹** | 项目类型的组合方式(如"一个 RAG + 一个秒杀 + 一个手写框架"这种覆盖多方向的经典组合) | | **开源指纹** | 贡献的仓库集合、PR 类型、时间窗口 | | **凭证指纹** | 同一竞赛的同一届次、同一批证书 | | **叙事指纹** | 自我定位的措辞方式、技能栏的组织逻辑 | ### 第二步:聚类比对 两两比对指纹,按相似度分层: - **强雷同**:版式几乎一致(同一模板)+ 句式节奏一致 + 项目组合高度重合。 - **中度雷同**:句式与措辞明显同源,但版式不同(可能同一培训内容、不同模板)。 - **弱雷同**:只有项目类型重合。 **极重要**:**弱雷同不构成任何信号**。热门项目类型本来就集中——大量候选人做 RAG 项目,只是因为这是当前最热的学习方向。这属于时代共性,不是生产线特征。 只有**版式 + 句式 + 项目组合**三者同时高度雷同,才值得记录。 ### 第三步:区分"共同来源"与"共同经历" 发现雷同后,必须先排除完全正当的解释: | 观察 | 正当解释 | | --- | --- | | 多人项目相同 | 他们是**同一个团队的成员**——这非常常见,也完全诚实 | | 多人经历相同 | 同一实习项目组、同一课程、同一竞赛