experimentlisted
Install: claude install-skill DaeSeokSong/oh-my-ouroboros
# Experiment Setup
새 실험을 설계하고 실행 준비를 자동화. 재현성 기준, 실험 워크플로우, 결과 분석 절차 내장.
## 실행 흐름
$ARGUMENTS 파싱 후 순서대로:
1. 실험 유형 확인: `ablation` / `new-feature` / `baseline` / `sweep` / `results`
2. 현재 config (train.yaml, task/*.yaml) 읽기
3. 재현성 체크리스트 적용 (§ 재현성 참조)
4. Hydra config 생성/수정 (config/task/ 하위)
5. wandb run name 규칙 적용: `{단계}-{모델}-{변수}-{MMDD}`
6. dry-run: `wandb=disabled trainer.fast_dev_run=true`
7. 성공 시 실제 실행 명령 제안, 실패 시 에러 분석
## 실험 유형별 동작
| 유형 | 동작 |
|------|------|
| `ablation` | 변경 변수 1개씩 격리, 동일 seed로 fair comparison config 생성 |
| `new-feature` | 새 모듈 추가, `torchinfo.summary()` / `thop`으로 파라미터 수 확인 |
| `baseline` | best config 기준 재현성 체크 |
| `sweep` | Hydra multirun 설정 생성, 탐색 범위 명시 |
| `results` | wandb URL 기반 결과 분석 스크립트 생성 |
**재현성 자동 삽입**: `seed_everything` 호출 확인 / config `seed` 키 확인 / CUDA·패키지 버전 wandb 기록 확인
**GPU 메모리 예측** (new-feature / sweep 시): `torchinfo.summary()` 또는 `thop`으로 파라미터·FLOPs 확인. DeepSpeed/LoRA 변경 시 예상 메모리 vs 실제 GPU 용량 비교.
---
## § 자가진화 동결 마커 (Stage A 진입 시 MANDATORY)
자가진화 동결 마커 생성: `mkdir -p ~/.claude/_bench && touch ~/.claude/_bench/.experiment_active`
(실험 중 preference-gated 자가진화 Tier-2/slow update 차단 — CLAUDE.md 규칙8 준수)
> **가드 컨벤션**: 자가진화 트리거(regression-blind/slow update)는 서두에서 `[ -f ~/.claude/_bench/.experiment_active ] && { echo '실험 활성 — 진화 보류'; exit 0; }` 로 체크한다.
## § Mem0 Prior 검색 (Stage A 시작 시 MANDATORY)
→ mem0-auto.md T11 참조 (4채널 순차 검색)
prior 결과 있으면: "이전 실험에서 {config}로 {metric}={값} 달성" 표시 → Go/NoGo 판단 반영.
### § Tavily SOTA 검색 + citation-ver