하네스 건강도 진단
Claude Code 하네스 설정의 전체 건강도를 8개 차원으로 진단합니다.
8개 진단 차원
1. CLAUDE.md 품질 (0-3)
- 0: 없음
- 1: 존재하지만 기본만
- 2: 프로젝트 컨텍스트 + 규칙 포함
- 3: 상세한 아키텍처 + 패턴 + 안티패턴
2. Skills 커버리지 (0-3)
- 0: 스킬 없음
- 1: 1-5개
- 2: 6-15개 + 트리거/안티트리거 정의
- 3: 16개+ + 도메인별 분류 + eval 스킬 포함
검사 대상은 고정 스킬 목록이 아니라 skills/ 디렉토리 실물 목록 기준 전수 스캔.
3. Agents 아키텍처 (0-3)
- 0: 에이전트 없음
- 1: 1-3개 (기본)
- 2: 4-8개 + 역할 분리 명확
- 3: 9개+ + evaluator 분리 + 역할 경계 매트릭스
4. Hooks 자동화 (0-3)
- 0: 훅 없음
- 1: 기본 (prettier, lint)
- 2: 품질 게이트 + 보안 스캔
- 3: 전체 파이프라인 (coverage + security + e2e + eval)
5. Rules 구조화 (0-3)
- 0: 규칙 없음
- 1: 1-2개 일반 규칙
- 2: 파일 패턴별 규칙 (*.ts, *.py 등)
- 3: 도메인별 + 보안 + 성능 + 테스트 규칙
6. MCP 서버 (0-3)
- 0: MCP 없음
- 1: 1-2개 기본
- 2: 검색 + 문서 + UI 도구
- 3: 검색 + 문서 + 코드 분석(code-review-graph 등)
7. Eval 파이프라인 (0-3)
- 0: eval 없음
- 1: 수동 verify만
- 2: 자동 품질 게이트 + 스코어링
- 3: 독립 evaluator + pass@k + AI 슬롭 감지
8. 팀/멀티에이전트 (0-3)
- 0: 단독 사용
- 1: 기본 서브에이전트
- 2: 역할 기반 팀 + 커뮤니케이션 프로토콜
- 3: TTH급 사일로 + Ralph Loop + backpressure
실행 프로세스
~/.claude/디렉토리 전체 스캔- 각 차원별 점수 산출 (0-3)
- 총점 (0-24) + 등급 산출
등급
| 총점 | 등급 | 설명 |
|---|---|---|
| 21-24 | S | 프로덕션 레벨 하네스 |
| 16-20 | A | 고급 설정. 소수 항목 개선 필요 |
| 11-15 | B | 중급. 핵심 갭 존재 |
| 6-10 | C | 기초. 대부분 수동 |
| 0-5 | D | 미설정. 바닐라 상태 |
출력 형식
📊 하네스 건강도: [등급] ([N]/24)
| 차원 | 점수 | 상태 |
|------|------|------|
| CLAUDE.md | [N]/3 | [🟢/🟡/🔴] |
| Skills | [N]/3 | ... |
| Agents | [N]/3 | ... |
| Hooks | [N]/3 | ... |
| Rules | [N]/3 | ... |
| MCP | [N]/3 | ... |
| Eval | [N]/3 | ... |
| Team | [N]/3 | ... |
🔧 개선 제안:
1. [가장 낮은 점수 차원 개선 방안]
2. ...
컨텍스트 파일 프루닝 (분기 루틴)
CLAUDE.md는 지식 저장소가 아니라 편향 교정 프롬프트다 — 밀도가 품질이다. 분기마다 각 줄을 세 가지로 분류한다:
| 분류 | 기준 | 처분 |
|---|---|---|
| A | 에이전트가 파일 탐색으로 스스로 알아낼 수 있는 정보 (구조·패키지·스타일) | 삭제 후보 — 근거를 한 줄씩 제시 |
| B | 지시가 없으면 기본 동작이 반대로 가는 항목 (삭제·조사·단순화·의존성 확인) | 유지 |
| C | 팀마다 답이 갈리는 선택 (하위 호환·테스트 강도·로깅 수준) | 유지하되 최신인지 사용자에게 질문 |
추가 점검:
tasks/lessons.md에서 같은 유형의 수정이 3회 이상 반복된 패턴 → CLAUDE.md 한 줄 승격 후보로 보고- 모델 세대가 바뀌어 더 이상 발동하지 않는 줄(교정 대상 성향이 사라진 것) → 삭제 후보
- 분류 결과를 표로 출력하고, 삭제는 사용자 승인 후 실행