# anthropic-claude-code-quality-postmortem-2026-04-23

## Veille

Claude Code Quality Post-Mortem March-April 2026 — Three Caching/Reasoning/Prompt Incidents — Anthropic Engineering Blog

## Titre Article

An Update on Recent Claude Code Quality Reports

## Date

2026-04-23

## URL

https://www.anthropic.com/engineering/april-23-postmortem

## Keywords

post-mortem, Claude Code, degrado qualità, reasoning effort, bug di caching, prompt caching, system prompt, extended thinking, regressione intelligenza, Claude Agent SDK, Claude Cowork, Opus 4.7, rollback, processo qualità, valutazione ablation

## Authors

Anthropic

## Ton

**Profilo**: Post-mortem tecnico pubblicato da Anthropic, registro tecnico-trasparente, livello intermedio-avanzato.

**Descrizione**: Anthropic adotta un tono di deliberata trasparenza tecnica, tipico dei post-mortem ingegneristici della Silicon Valley. Lo stile è fattuale, cronologico e dettagliato, con una chiara intenzione di rendere conto agli utenti. L'articolo distingue metodicamente tre incidenti separati, ciascuno documentato con le proprie date, causa radice, impatto e risoluzione. Il vocabolario è tecnico ma accessibile (reasoning effort, prompt caching, ablation testing). L'autorevolezza deriva dalla posizione dell'editore stesso del prodotto — Anthropic riconosce i propri errori e dettaglia le misure correttive. Il pubblico di riferimento è la comunità di sviluppatori che utilizza Claude Code, il Claude Agent SDK e Claude Cowork, oltre alla più ampia comunità tech interessata all'affidabilità dei prodotti.

## Pense-betes

- Tre distinti incidenti hanno degradato la qualità di Claude Code tra marzo e aprile 2026 — l'API stessa non è mai stata compromessa, il che indica che i problemi erano specifici allo scaffolding/harness di Claude Code
- Incidente 1 (4 marzo - 7 aprile): il cambio del livello di reasoning predefinito da `high` a `medium` per ridurre la latenza ha causato un calo percepito di intelligenza. Nonostante le iterazioni UX (avvisi, selettore), gli utenti sono rimasti su `medium`. Risolto impostando come predefinito `xhigh` per Opus 4.7 e `high` per gli altri modelli
- Incidente 2 (26 marzo - 10 aprile): un bug critico del prompt caching — l'header `clear_thinking_20251015` con `keep:1`, destinato a essere eseguito una sola volta sulle sessioni inattive da più di 1h, si attivava a ogni turno successivo, cancellando progressivamente il contesto di reasoning. Conseguenze: cascata di cache miss, Claude "smemorato e ripetitivo", consumo accelerato delle quote di utilizzo
- Il bug di caching è stato difficile da individuare perché esperimenti interni non correlati e modifiche di visualizzazione mascheravano il problema durante i test — un classico pattern di debito di testabilità
- Fatto notevole: Opus 4.7 con lo strumento Code Review ha identificato il bug a posteriori quando gli è stato fornito il contesto completo del repository, mentre Opus 4.6 non ci era riuscito — un'illustrazione concreta del salto di capacità tra versioni di modello
- Incidente 3 (16-20 aprile): un vincolo di verbosità nel system prompt ("mantieni il testo tra le chiamate agli strumenti <= 25 parole, le risposte finali <= 100 parole") ha causato un calo di intelligenza del 3% misurato tramite test di ablation, sia per il modello Opus 4.6 sia per Opus 4.7
- I tre incidenti rivelano una tensione ricorrente nell'ingegneria degli agenti di coding: ottimizzare latenza/costo vs. preservare la qualità del reasoning — ogni scorciatoia comporta un costo cognitivo per il modello
- Le segnalazioni degli utenti tramite `/feedback` e gli esempi riproducibili sono stati riconosciuti come determinanti per identificare e risolvere questi problemi — una validazione del modello di feedback della community
- Miglioramenti di processo annunciati: maggiore uso interno di build pubbliche, valutazioni per singolo modello, documentazione degli ablation, periodi di stabilizzazione, rollout graduali, creazione dell'account @ClaudeDevs su X
- Tutti i problemi risolti entro il 20 aprile (v2.1.116), con un azzeramento dei limiti di utilizzo per tutti gli abbonati il 23 aprile — un gesto commerciale insolito che riflette la gravità percepita dell'impatto

## RésuméDe400mots

In questo post-mortem tecnico, Anthropic documenta tre distinti incidenti che hanno degradato la qualità percepita di Claude Code, del Claude Agent SDK e di Claude Cowork tra marzo e aprile 2026, precisando che l'API sottostante non è mai stata compromessa.

Il primo incidente (4 marzo - 7 aprile) ha riguardato una modifica di configurazione al livello di reasoning predefinito, passato da "high" a "medium" per risolvere problemi di blocco dell'interfaccia causati dall'extended thinking in modalità high. I test interni mostravano che la modalità medium offriva "un'intelligenza leggermente inferiore con una latenza significativamente ridotta." Tuttavia, gli utenti hanno rapidamente segnalato che Claude sembrava "meno intelligente." Nonostante diverse iterazioni di design (notifiche, selettore di effort), gli utenti sono rimasti sul valore predefinito medium. Anthropic ha infine ribaltato la decisione passando al livello "xhigh" per Opus 4.7 e "high" per gli altri modelli.

Il secondo incidente (26 marzo - 10 aprile) è il più tecnico e il più dannoso. Un'ottimizzazione del prompt caching, destinata a ripulire le vecchie sezioni di thinking dalle sessioni inattive da più di un'ora, conteneva un difetto di implementazione. L'header API `clear_thinking_20251015` con il parametro `keep:1` doveva essere eseguito una sola volta, ma si attivava a ogni turno successivo, cancellando progressivamente il contesto di reasoning di Claude. Ciò ha causato una cascata di cache miss, rendendo Claude "smemorato e ripetitivo" ed esaurendo più rapidamente le quote di utilizzo. Il bug si è rivelato difficile da individuare perché esperimenti interni non correlati mascheravano il problema. Da notare che è stato lo strumento Code Review di Opus 4.7, alimentato con il contesto completo del repository, a identificare il bug a posteriori — Opus 4.6 non ci era riuscito.

Il terzo incidente (16-20 aprile) è derivato da un'istruzione aggiunta al system prompt che limitava la verbosità (testo tra le chiamate agli strumenti limitato a 25 parole, risposte finali a 100 parole). I test interni non avevano rilevato alcuna regressione, ma test di ablation più estesi hanno rivelato un calo di intelligenza del 3% sia per Opus 4.6 sia per Opus 4.7.

Tutti i problemi sono stati risolti entro il 20 aprile con la versione 2.1.116. Anthropic ha azzerato i limiti di utilizzo per tutti gli abbonati il 23 aprile. L'azienda ha annunciato diversi miglioramenti di processo: maggiore uso interno di build pubbliche, valutazioni per singolo modello, test di ablation sistematici, periodi di stabilizzazione, rollout graduali e la creazione dell'account @ClaudeDevs su X per una comunicazione di prodotto più dettagliata.

## GrapheDeConnaissance

- Anthropic —publie→ post-mortem qualité Claude Code avril 2026 (DOCUMENT, 0.98)
- Trois incidents de dégradation qualité —observé_dans→ Claude Code (TECHNOLOGIE, 0.98)
- Niveau de raisonnement medium par défaut —remplace→ niveau de raisonnement high par défaut (CONCEPT, 0.97)
- Changement reasoning effort —réduit→ intelligence perçue par les utilisateurs (CONCEPT, 0.95)
- Bug prompt caching —permet→ cache misses en cascade et perte de contexte (CONCEPT, 0.97)
- Anthropic —affirme_que→ l'en-tête clear_thinking_20251015 devait s'exécuter une seule fois sur les sessions inactives (AFFIRMATION, 0.95)
- Anthropic —affirme_que→ l'en-tête clear_thinking_20251015 se déclenchait à chaque tour suivant (bug) (AFFIRMATION, 0.97)
- Opus 4.7 —résout→ identification rétrospective du bug de cache (EVENEMENT, 0.93)
- Opus 4.7 —surpasse→ Opus 4.6 (TECHNOLOGIE, 0.9)
- Contrainte verbosité —mesure→ baisse de 3% d'intelligence (tests d'ablation) (MESURE, 0.95)
- Anthropic —publie→ réinitialisation des limites d'utilisation de tous les abonnés (23 avril) (EVENEMENT, 0.95)
- Anthropic —a_créé→ @ClaudeDevs (ORGANISATION, 0.9)
- Remontées utilisateurs /feedback —permet→ identification et résolution des bugs (CONCEPT, 0.92)
- Anthropic —affirme_que→ l'API Claude n'a jamais été affectée par les trois incidents (AFFIRMATION, 0.98)

---
Canonical: https://www.thekb.eu/it/fiches/anthropic-claude-code-quality-postmortem-2026-04-23/
