# Modell-Strategie ## Grundprinzip Teures Modell nur dort, wo Qualität den Unterschied macht. Günstiges Modell für mechanische, wiederholbare Aufgaben. ## Modell-Übersicht (Stand April 2026) | Modell | ID | Stärke | Relative Kosten | |---|---|---|---| | Opus 4.7 | `claude-opus-4-7` | Höchste Reasoning-Qualität, adaptives Thinking | ●●●●● | | Sonnet 4.6 | `claude-sonnet-4-6` | Ausgewogen, sehr gute Codequalität | ●●●○○ | | Haiku 4.5 | `claude-haiku-4-5-20251001` | Schnell, kostengünstig | ●○○○○ | ## Zuordnung nach Phase ### Planung & Review → Opus 4.7 Warum: Ein schlechter Plan kostet mehr Zeit als das teurere Modell. ``` /model opus ``` Einsatz: - `EnterPlanMode` - `/plan-review` - Architektur-Entscheidungen - Risiko-Analysen ### Implementierung → Sonnet 4.6 Warum: Ausreichende Qualität bei deutlich niedrigeren Kosten als Opus. ``` /model sonnet (Standard / Default) ``` Einsatz: - Feature-Implementierung - Refactoring - Bug-Fixes - Frontend-Entwicklung ### Tests / Lint / Format → Haiku 4.5 Warum: Mechanische Aufgaben brauchen kein Reasoning. ``` /model haiku ``` Einsatz: - `test-runner`-Agent - Auto-Format-Hook - PR-Beschreibung generieren - Einfache Datei-Operationen ### Security-Audit → Opus 4.7 Warum: Sicherheitslücken zu übersehen kostet mehr als das Modell. ``` /model opus ``` Einsatz: - `security-audit`-Agent - Permission-Scan im PreToolUse-Hook ## Kontext-Degradation Bei langen Sessions sinkt die Qualität aller Modelle: - **Sonnet**: Degradation ab ~300k Tokens - **Opus**: Robuster, aber ab ~400k Tokens trotzdem besser compacten Strategie: 1. `/compact "aktueller Stand: [Zusammenfassung]"` bei 200–350k 2. Neue Session + Subagenten bei > 350k 3. Subagenten schützen Haupt-Kontext generell (immer bevorzugen für isolierte Aufgaben) ## Fast Mode `/fast` aktiviert Opus 4.7 mit schnellerer Ausgabe (kein Downgrade). Sinnvoll bei: Langen Implementierungen mit Opus, wo Wartezeit stört. ## Kosten-Faustregeln - 10 Story-Punkte Implementierung: ~80% Sonnet, ~20% Opus - Security-Audit pro Story: immer Opus (< 5% der Gesamtkosten, schützt vor Regressionen) - Test-Runner: immer Haiku (< 2% der Gesamtkosten) - Faustregel: Opus nur für Entscheidungen, Sonnet für Umsetzung, Haiku für Verifikation