← ClaudeAtlas

oracle-bumplisted

提议并执行 rubric 或 bucket 升级,按轨道独立执行。两种模式:**完整 rubric bump**(最高风险动作,5 步强制 + 跨模型审核)和 **--bucket-only 轻量重校**(只换 bucket 边界,不动公式)。触发词:"升级 rubric"/"bump rubric"/"更新公式"/"我想加一个维度"/"调整权重"/"重校桶"/"recalibrate bucket"。
Huanyu-Hibiki/Huanyu-Skills · ★ 1 · AI & Automation · score 67
Install: claude install-skill Huanyu-Hibiki/Huanyu-Skills
# /oracle-bump — Rubric / Bucket 升级(按轨道) 两种模式: | 模式 | 触发 | 做什么 | 验证强度 | |---|---|---|---| | **完整 rubric bump** | `--propose "<新公式>"` | 改公式/维度/权重 | 5 步 + 跨模型审核(强制) | | **bucket-only 重校** | `--bucket-only` | 只重新派生 bucket 边界 | 数据自动派生,无审核 | 完整 bump 严格遵守 [bump-validation-protocol.md](../../shared-references/bump-validation-protocol.md)。**按轨道独立**:一次操作只 bump 一个轨道。 ## Overview ``` 入口:/oracle-bump ↓ [Phase A0: 模式分流] ├─ --bucket-only → [Phase B: 轻量重校] └─ --propose → [Phase 0~8: 完整 bump] ``` ## Constants - **READINESS_HEURISTIC** — 默认:该轨校准池 ≥5 样本 + ≥1 个跨样本观察有 ≥3 样本支持;Claude 可基于强信号(≥3x 偏差反例 / 单点极强模因)提前,可因证据弱推迟。**提议必标注 default-aligned / judgment-driven** - **THRESHOLD = 0.8** — 排序一致性阈值(4/5)。**写死**,统计刚性 - **CROSS_MODEL_AUDIT = true** — 跨模型独立审核默认开 - **REQUIRE_CONFIRM = true** — 落地前用户明确 "yes, bump" ## 完整 rubric bump 流程 ### Phase 0: 前置门槛检查(按轨道) | 检查 | 失败处理 | |---|---| | `in_progress_session == null` | 拒绝:"有 in-progress 预测未完成,先走完或清掉" | | `--track <id>` 指定(必填) | 漏了 → 询问"升级哪轨?"(列出 content-plan 轨道) | | 该轨校准池 ≥5(默认)+ 上次 bump 后 ≥1 新样本 | 硬约束:无新样本拒绝;样本少软约束:显式标注后仍走全流程 | | **诊断前置**:「本公式能否解决 retro 暴露的偏差?」 | 答案 no 或混合且核心偏差在 no 侧(如平台分发问题 rubric 修不了)→ **在 Phase 0 直接拒绝进 Phase 1**,省掉后面工作量 | 诊断证据先跑收敛工具(确定性重算,不靠记忆):`python tools/score-curve.py <项目根> --track <id> --json` → 该轨偏差方向序列(连续高估/低估?)+ 平均绝对偏差 + bucket 命中率。「retro 暴露的偏差」以此数据交叉核对 state 的 consecutive_directional_errors——**公式修不了方向性系统偏差以外的命中问题**(bucket 命中低但方向随机 → 该跑 --bucket-only 而不是 rubric bump)。 校准池 = `state.calibration_samples_by_track