Files
claude-workflow/workflow/models.md
T
martinandClaude Sonnet 4.6 a07c436a7d Optimaler Entwicklungs-Workflow eingerichtet
- workflow/: Schnellreferenz, Modell-Strategie, Story-Lifecycle-Doku
- skills/: /go, /plan-review, /story als globale Skills
- hooks/: auto-format.sh (PostToolUse), verify-on-stop.sh (Stop)
- agents/: plan-reviewer (Opus 4.7) für unabhängigen Plan-Review
- Symlinks in ~/.claude/skills/ und ~/.claude/agents/
- settings.json um Hooks-Sektion erweitert

Co-Authored-By: Claude Sonnet 4.6 (1M context) <noreply@anthropic.com>
2026-04-19 10:38:30 +02:00

2.2 KiB
Raw Blame History

Modell-Strategie

Grundprinzip

Teures Modell nur dort, wo Qualität den Unterschied macht. Günstiges Modell für mechanische, wiederholbare Aufgaben.

Modell-Übersicht (Stand April 2026)

Modell ID Stärke Relative Kosten
Opus 4.7 claude-opus-4-7 Höchste Reasoning-Qualität, adaptives Thinking ●●●●●
Sonnet 4.6 claude-sonnet-4-6 Ausgewogen, sehr gute Codequalität ●●●○○
Haiku 4.5 claude-haiku-4-5-20251001 Schnell, kostengünstig ●○○○○

Zuordnung nach Phase

Planung & Review → Opus 4.7

Warum: Ein schlechter Plan kostet mehr Zeit als das teurere Modell.

/model opus

Einsatz:

  • EnterPlanMode
  • /plan-review
  • Architektur-Entscheidungen
  • Risiko-Analysen

Implementierung → Sonnet 4.6

Warum: Ausreichende Qualität bei deutlich niedrigeren Kosten als Opus.

/model sonnet  (Standard / Default)

Einsatz:

  • Feature-Implementierung
  • Refactoring
  • Bug-Fixes
  • Frontend-Entwicklung

Tests / Lint / Format → Haiku 4.5

Warum: Mechanische Aufgaben brauchen kein Reasoning.

/model haiku

Einsatz:

  • test-runner-Agent
  • Auto-Format-Hook
  • PR-Beschreibung generieren
  • Einfache Datei-Operationen

Security-Audit → Opus 4.7

Warum: Sicherheitslücken zu übersehen kostet mehr als das Modell.

/model opus

Einsatz:

  • security-audit-Agent
  • Permission-Scan im PreToolUse-Hook

Kontext-Degradation

Bei langen Sessions sinkt die Qualität aller Modelle:

  • Sonnet: Degradation ab ~300k Tokens
  • Opus: Robuster, aber ab ~400k Tokens trotzdem besser compacten

Strategie:

  1. /compact "aktueller Stand: [Zusammenfassung]" bei 200350k
  2. Neue Session + Subagenten bei > 350k
  3. Subagenten schützen Haupt-Kontext generell (immer bevorzugen für isolierte Aufgaben)

Fast Mode

/fast aktiviert Opus 4.7 mit schnellerer Ausgabe (kein Downgrade). Sinnvoll bei: Langen Implementierungen mit Opus, wo Wartezeit stört.

Kosten-Faustregeln

  • 10 Story-Punkte Implementierung: ~80% Sonnet, ~20% Opus
  • Security-Audit pro Story: immer Opus (< 5% der Gesamtkosten, schützt vor Regressionen)
  • Test-Runner: immer Haiku (< 2% der Gesamtkosten)
  • Faustregel: Opus nur für Entscheidungen, Sonnet für Umsetzung, Haiku für Verifikation