- workflow/: Schnellreferenz, Modell-Strategie, Story-Lifecycle-Doku - skills/: /go, /plan-review, /story als globale Skills - hooks/: auto-format.sh (PostToolUse), verify-on-stop.sh (Stop) - agents/: plan-reviewer (Opus 4.7) für unabhängigen Plan-Review - Symlinks in ~/.claude/skills/ und ~/.claude/agents/ - settings.json um Hooks-Sektion erweitert Co-Authored-By: Claude Sonnet 4.6 (1M context) <noreply@anthropic.com>
82 lines
2.2 KiB
Markdown
82 lines
2.2 KiB
Markdown
# Modell-Strategie
|
||
|
||
## Grundprinzip
|
||
|
||
Teures Modell nur dort, wo Qualität den Unterschied macht.
|
||
Günstiges Modell für mechanische, wiederholbare Aufgaben.
|
||
|
||
## Modell-Übersicht (Stand April 2026)
|
||
|
||
| Modell | ID | Stärke | Relative Kosten |
|
||
|---|---|---|---|
|
||
| Opus 4.7 | `claude-opus-4-7` | Höchste Reasoning-Qualität, adaptives Thinking | ●●●●● |
|
||
| Sonnet 4.6 | `claude-sonnet-4-6` | Ausgewogen, sehr gute Codequalität | ●●●○○ |
|
||
| Haiku 4.5 | `claude-haiku-4-5-20251001` | Schnell, kostengünstig | ●○○○○ |
|
||
|
||
## Zuordnung nach Phase
|
||
|
||
### Planung & Review → Opus 4.7
|
||
Warum: Ein schlechter Plan kostet mehr Zeit als das teurere Modell.
|
||
```
|
||
/model opus
|
||
```
|
||
Einsatz:
|
||
- `EnterPlanMode`
|
||
- `/plan-review`
|
||
- Architektur-Entscheidungen
|
||
- Risiko-Analysen
|
||
|
||
### Implementierung → Sonnet 4.6
|
||
Warum: Ausreichende Qualität bei deutlich niedrigeren Kosten als Opus.
|
||
```
|
||
/model sonnet (Standard / Default)
|
||
```
|
||
Einsatz:
|
||
- Feature-Implementierung
|
||
- Refactoring
|
||
- Bug-Fixes
|
||
- Frontend-Entwicklung
|
||
|
||
### Tests / Lint / Format → Haiku 4.5
|
||
Warum: Mechanische Aufgaben brauchen kein Reasoning.
|
||
```
|
||
/model haiku
|
||
```
|
||
Einsatz:
|
||
- `test-runner`-Agent
|
||
- Auto-Format-Hook
|
||
- PR-Beschreibung generieren
|
||
- Einfache Datei-Operationen
|
||
|
||
### Security-Audit → Opus 4.7
|
||
Warum: Sicherheitslücken zu übersehen kostet mehr als das Modell.
|
||
```
|
||
/model opus
|
||
```
|
||
Einsatz:
|
||
- `security-audit`-Agent
|
||
- Permission-Scan im PreToolUse-Hook
|
||
|
||
## Kontext-Degradation
|
||
|
||
Bei langen Sessions sinkt die Qualität aller Modelle:
|
||
- **Sonnet**: Degradation ab ~300k Tokens
|
||
- **Opus**: Robuster, aber ab ~400k Tokens trotzdem besser compacten
|
||
|
||
Strategie:
|
||
1. `/compact "aktueller Stand: [Zusammenfassung]"` bei 200–350k
|
||
2. Neue Session + Subagenten bei > 350k
|
||
3. Subagenten schützen Haupt-Kontext generell (immer bevorzugen für isolierte Aufgaben)
|
||
|
||
## Fast Mode
|
||
|
||
`/fast` aktiviert Opus 4.7 mit schnellerer Ausgabe (kein Downgrade).
|
||
Sinnvoll bei: Langen Implementierungen mit Opus, wo Wartezeit stört.
|
||
|
||
## Kosten-Faustregeln
|
||
|
||
- 10 Story-Punkte Implementierung: ~80% Sonnet, ~20% Opus
|
||
- Security-Audit pro Story: immer Opus (< 5% der Gesamtkosten, schützt vor Regressionen)
|
||
- Test-Runner: immer Haiku (< 2% der Gesamtkosten)
|
||
- Faustregel: Opus nur für Entscheidungen, Sonnet für Umsetzung, Haiku für Verifikation
|