# anthropic-claude-code-quality-postmortem-2026-04-23

## Veille

Claude Code Quality Post-Mortem März-April 2026 — Drei Vorfälle bei Caching/Reasoning/Prompt — Anthropic Engineering Blog

## Titre Article

An Update on Recent Claude Code Quality Reports

## Date

2026-04-23

## URL

https://www.anthropic.com/engineering/april-23-postmortem

## Keywords

post-mortem, Claude Code, Qualitätsverschlechterung, reasoning effort, Caching-Bug, prompt caching, system prompt, extended thinking, Intelligenzregression, Claude Agent SDK, Claude Cowork, Opus 4.7, Rollback, Qualitätsprozess, Ablationsevaluierung

## Authors

Anthropic

## Ton

**Profil**: Von Anthropic veröffentlichter Engineering-Post-Mortem-Beitrag, technisch-transparentes Register, mittleres bis fortgeschrittenes Niveau.

**Beschreibung**: Anthropic nimmt einen Ton bewusster technischer Transparenz ein, wie er für Engineering-Post-Mortems im Silicon-Valley-Stil typisch ist. Der Stil ist faktisch, chronologisch und detailliert, mit einer klaren Absicht der Rechenschaftspflicht gegenüber den Nutzern. Der Artikel unterscheidet methodisch drei separate Vorfälle, jeweils dokumentiert mit Daten, Grundursache, Auswirkung und Behebung. Der Wortschatz ist technisch, aber zugänglich (Reasoning Effort, Prompt Caching, Ablationstests). Die Autorität ergibt sich aus der Position des Herausgebers des Produkts selbst — Anthropic räumt seine Fehler ein und legt Korrekturmaßnahmen dar. Die Zielgruppe ist die Entwicklergemeinschaft, die Claude Code, das Claude Agent SDK und Claude Cowork nutzt, sowie die breitere Tech-Community, die sich mit Produktzuverlässigkeit befasst.

## Pense-betes

- Drei unterschiedliche Vorfälle beeinträchtigten zwischen März und April 2026 die Qualität von Claude Code — die API selbst war nie betroffen, was darauf hindeutet, dass die Probleme spezifisch im Scaffolding/Harness von Claude Code lagen
- Vorfall 1 (4. März - 7. April): Die Änderung des standardmäßigen Reasoning-Levels von `high` auf `medium` zur Reduzierung der Latenz führte zu einem wahrgenommenen Intelligenzrückgang. Trotz UX-Iterationen (Hinweise, Selektor) blieben die Nutzer bei `medium`. Behoben durch Standardeinstellung `xhigh` für Opus 4.7 und `high` für die übrigen Modelle
- Vorfall 2 (26. März - 10. April): ein kritischer Prompt-Caching-Bug — der Header `clear_thinking_20251015` mit `keep:1`, der bei seit mehr als 1 Stunde inaktiven Sitzungen nur einmal ausgeführt werden sollte, löste bei jedem folgenden Turn erneut aus und löschte fortschreitend den Reasoning-Kontext. Folgen: kaskadierende Cache-Misses, Claude „vergesslich und repetitiv", beschleunigter Verbrauch der Nutzungskontingente
- Der Caching-Bug war schwer zu erkennen, da unabhängige interne Experimente und Anzeigeänderungen das Problem während der Tests verschleierten — ein klassisches Muster von Testbarkeits-Schulden
- Bemerkenswerte Tatsache: Opus 4.7 identifizierte mit dem Code-Review-Tool den Bug rückwirkend, als es mit dem vollständigen Repository-Kontext versorgt wurde, während Opus 4.6 dazu nicht in der Lage war — eine konkrete Illustration des Fähigkeitssprungs zwischen Modellversionen
- Vorfall 3 (16.-20. April): eine Ausführlichkeitsbeschränkung im System-Prompt („Text zwischen Tool-Aufrufen auf <= 25 Wörter begrenzen, finale Antworten auf <= 100 Wörter") verursachte laut Ablationstests einen Intelligenzrückgang von 3 % sowohl bei Opus 4.6 als auch bei Opus 4.7
- Die drei Vorfälle offenbaren eine wiederkehrende Spannung im Engineering von Coding-Agenten: Optimierung von Latenz/Kosten vs. Erhaltung der Reasoning-Qualität — jede Abkürzung hat kognitive Kosten für das Modell
- Nutzerrückmeldungen über `/feedback` und reproduzierbare Beispiele wurden als entscheidend für die Identifizierung und Behebung dieser Probleme gewürdigt — eine Bestätigung des Community-Feedback-Modells
- Angekündigte Prozessverbesserungen: verstärkte interne Nutzung öffentlicher Builds, modellspezifische Evaluierungen, Dokumentation von Ablationstests, Stabilisierungsphasen, gestaffelte Rollouts, Einrichtung des Kontos @ClaudeDevs auf X
- Alle Probleme bis zum 20. April behoben (v2.1.116), mit einem Reset der Nutzungslimits für alle Abonnenten am 23. April — eine ungewöhnliche kommerzielle Geste, die die wahrgenommene Schwere der Auswirkungen widerspiegelt

## RésuméDe400mots

In diesem technischen Post-Mortem dokumentiert Anthropic drei unterschiedliche Vorfälle, die zwischen März und April 2026 die wahrgenommene Qualität von Claude Code, dem Claude Agent SDK und Claude Cowork beeinträchtigten, wobei präzisiert wird, dass die zugrunde liegende API zu keinem Zeitpunkt betroffen war.

Der erste Vorfall (4. März - 7. April) betraf eine Konfigurationsänderung des standardmäßigen Reasoning-Levels, das von „high" auf „medium" umgestellt wurde, um Einfrieren der Oberfläche durch erweitertes Denken im High-Modus zu beheben. Interne Tests zeigten, dass der Medium-Modus „leicht geringere Intelligenz bei deutlich reduzierter Latenz" bot. Nutzer meldeten jedoch schnell, dass Claude „weniger intelligent" wirke. Trotz mehrerer Design-Iterationen (Benachrichtigungen, Effort-Auswahl) blieben die Nutzer beim Medium-Standard. Anthropic machte die Entscheidung schließlich rückgängig, indem es auf Stufe „xhigh" für Opus 4.7 und „high" für die übrigen Modelle wechselte.

Der zweite Vorfall (26. März - 10. April) ist der technischste und schädlichste. Eine Prompt-Caching-Optimierung, die alte Denkabschnitte aus seit mehr als einer Stunde inaktiven Sitzungen bereinigen sollte, enthielt einen Implementierungsfehler. Der API-Header `clear_thinking_20251015` mit dem Parameter `keep:1` sollte nur einmal ausgeführt werden, löste jedoch bei jedem folgenden Turn erneut aus und löschte dabei fortschreitend den Reasoning-Kontext von Claude. Dies verursachte kaskadierende Cache-Misses, wodurch Claude „vergesslich und repetitiv" wurde und die Nutzungskontingente schneller aufgebraucht wurden. Der Bug erwies sich als schwer erkennbar, da unabhängige interne Experimente das Problem verschleierten. Bemerkenswert ist, dass es das Code-Review-Tool von Opus 4.7 war, das, gespeist mit dem vollständigen Repository-Kontext, den Bug rückwirkend identifizierte — Opus 4.6 war dazu nicht in der Lage gewesen.

Der dritte Vorfall (16.-20. April) resultierte aus einer dem System-Prompt hinzugefügten Anweisung zur Begrenzung der Ausführlichkeit (Text zwischen Tool-Aufrufen auf 25 Wörter begrenzt, finale Antworten auf 100 Wörter). Interne Tests hatten keine Regression festgestellt, doch umfassendere Ablationstests zeigten einen Intelligenzrückgang von 3 % sowohl bei Opus 4.6 als auch bei Opus 4.7.

Alle Probleme waren bis zum 20. April mit Version 2.1.116 behoben. Anthropic setzte am 23. April die Nutzungslimits für alle Abonnenten zurück. Das Unternehmen kündigte mehrere Prozessverbesserungen an: verstärkte interne Nutzung öffentlicher Builds, modellspezifische Evaluierungen, systematische Ablationstests, Stabilisierungsphasen, gestaffelte Rollouts und die Einrichtung des Kontos @ClaudeDevs auf X für eine detailliertere Produktkommunikation.

## GrapheDeConnaissance

- Anthropic —publie→ post-mortem qualité Claude Code avril 2026 (DOCUMENT, 0.98)
- Trois incidents de dégradation qualité —observé_dans→ Claude Code (TECHNOLOGIE, 0.98)
- Niveau de raisonnement medium par défaut —remplace→ niveau de raisonnement high par défaut (CONCEPT, 0.97)
- Changement reasoning effort —réduit→ intelligence perçue par les utilisateurs (CONCEPT, 0.95)
- Bug prompt caching —permet→ cache misses en cascade et perte de contexte (CONCEPT, 0.97)
- Anthropic —affirme_que→ l'en-tête clear_thinking_20251015 devait s'exécuter une seule fois sur les sessions inactives (AFFIRMATION, 0.95)
- Anthropic —affirme_que→ l'en-tête clear_thinking_20251015 se déclenchait à chaque tour suivant (bug) (AFFIRMATION, 0.97)
- Opus 4.7 —résout→ identification rétrospective du bug de cache (EVENEMENT, 0.93)
- Opus 4.7 —surpasse→ Opus 4.6 (TECHNOLOGIE, 0.9)
- Contrainte verbosité —mesure→ baisse de 3% d'intelligence (tests d'ablation) (MESURE, 0.95)
- Anthropic —publie→ réinitialisation des limites d'utilisation de tous les abonnés (23 avril) (EVENEMENT, 0.95)
- Anthropic —a_créé→ @ClaudeDevs (ORGANISATION, 0.9)
- Remontées utilisateurs /feedback —permet→ identification et résolution des bugs (CONCEPT, 0.92)
- Anthropic —affirme_que→ l'API Claude n'a jamais été affectée par les trois incidents (AFFIRMATION, 0.98)

---
Canonical: https://www.thekb.eu/de/fiches/anthropic-claude-code-quality-postmortem-2026-04-23/
