# anthropic-claude-code-quality-postmortem-2026-04-23

## Veille

Claude Code Quality Post-Mortem March-April 2026 — Three Caching/Reasoning/Prompt Incidents — Anthropic Engineering Blog

## Titre Article

An Update on Recent Claude Code Quality Reports

## Date

2026-04-23

## URL

https://www.anthropic.com/engineering/april-23-postmortem

## Keywords

post-mortem, Claude Code, degradación de calidad, reasoning effort, bug de caching, prompt caching, system prompt, extended thinking, regresión de inteligencia, Claude Agent SDK, Claude Cowork, Opus 4.7, rollback, proceso de calidad, evaluación de ablación

## Authors

Anthropic

## Ton

**Perfil**: Post-mortem de ingeniería publicado por Anthropic, registro técnico-transparente, nivel intermedio-avanzado.

**Descripción**: Anthropic adopta un tono de transparencia técnica deliberada, típico de los post-mortems de ingeniería de Silicon Valley. El estilo es factual, cronológico y detallado, con una clara intención de rendir cuentas a los usuarios. El artículo distingue metódicamente tres incidentes separados, cada uno documentado con sus fechas, causa raíz, impacto y resolución. El vocabulario es técnico pero accesible (reasoning effort, prompt caching, ablation testing). La autoridad proviene de la posición del propio editor del producto — Anthropic reconoce sus errores y detalla las medidas correctivas. El público objetivo es la comunidad de desarrolladores que usan Claude Code, el Claude Agent SDK y Claude Cowork, así como la comunidad tecnológica más amplia preocupada por la fiabilidad de los productos.

## Pense-betes

- Tres incidentes distintos degradaron la calidad de Claude Code entre marzo y abril de 2026 — la API en sí nunca se vio afectada, lo que indica que los problemas eran específicos del scaffolding/harness de Claude Code
- Incidente 1 (4 de marzo - 7 de abril): el cambio del nivel de razonamiento por defecto de `high` a `medium` para reducir la latencia causó una caída percibida de inteligencia. A pesar de las iteraciones de UX (avisos, selector), los usuarios se mantuvieron en `medium`. Resuelto fijando por defecto `xhigh` para Opus 4.7 y `high` para los demás modelos
- Incidente 2 (26 de marzo - 10 de abril): un bug crítico de prompt caching — el encabezado `clear_thinking_20251015` con `keep:1`, pensado para ejecutarse una sola vez en sesiones inactivas durante más de 1h, se activaba en cada turno posterior, borrando progresivamente el contexto de razonamiento. Consecuencias: fallos de caché en cascada, Claude "olvidadizo y repetitivo", consumo acelerado de las cuotas de uso
- El bug de caching fue difícil de detectar porque experimentos internos no relacionados y cambios de visualización enmascararon el problema durante las pruebas — un patrón clásico de deuda de testabilidad
- Dato notable: Opus 4.7 con la herramienta Code Review identificó el bug retrospectivamente cuando se le dio el contexto completo del repositorio, mientras que Opus 4.6 no pudo — una ilustración concreta del salto de capacidad entre versiones de modelo
- Incidente 3 (16-20 de abril): una restricción de verbosidad en el system prompt ("mantener el texto entre llamadas a herramientas <= 25 palabras, respuestas finales <= 100 palabras") causó una caída del 3% en inteligencia medida mediante pruebas de ablación, para los modelos Opus 4.6 y 4.7
- Los tres incidentes revelan una tensión recurrente en la ingeniería de agentes de codificación: optimizar latencia/coste frente a preservar la calidad de razonamiento — cada atajo conlleva un coste cognitivo para el modelo
- Los reportes de usuarios vía `/feedback` y los ejemplos reproducibles fueron reconocidos como fundamentales para identificar y resolver estos problemas — validación del modelo de feedback comunitario
- Mejoras de proceso anunciadas: mayor uso interno de builds públicas, evaluaciones por modelo, documentación de ablación, periodos de estabilización, despliegues por fases, creación de la cuenta @ClaudeDevs en X
- Todos los problemas resueltos el 20 de abril (v2.1.116), con un restablecimiento de los límites de uso para todos los suscriptores el 23 de abril — un gesto comercial inusual que refleja la gravedad percibida del impacto

## RésuméDe400mots

En este post-mortem de ingeniería, Anthropic documenta tres incidentes distintos que degradaron la calidad percibida de Claude Code, el Claude Agent SDK y Claude Cowork entre marzo y abril de 2026, especificando que la API subyacente nunca se vio afectada.

El primer incidente (4 de marzo - 7 de abril) implicó un cambio de configuración en el nivel de razonamiento por defecto, que pasó de "high" a "medium" para resolver problemas de congelamiento de la interfaz causados por el pensamiento extendido en modo high. Las pruebas internas mostraron que el modo medium ofrecía "una inteligencia ligeramente menor con una latencia significativamente reducida". Sin embargo, los usuarios reportaron rápidamente que Claude parecía "menos inteligente". A pesar de varias iteraciones de diseño (notificaciones, selector de esfuerzo), los usuarios se mantuvieron en el valor por defecto medium. Anthropic finalmente revirtió su decisión cambiando al nivel "xhigh" para Opus 4.7 y "high" para los demás modelos.

El segundo incidente (26 de marzo - 10 de abril) es el más técnico y el más dañino. Una optimización de prompt caching destinada a limpiar las secciones de pensamiento antiguas de sesiones inactivas durante más de una hora contenía un fallo de implementación. El encabezado de API `clear_thinking_20251015` con el parámetro `keep:1` debía ejecutarse una sola vez, pero se activaba en cada turno posterior, borrando progresivamente el contexto de razonamiento de Claude. Esto provocó fallos de caché en cascada, haciendo que Claude fuera "olvidadizo y repetitivo" y agotando las cuotas de uso más rápido. El bug resultó difícil de detectar porque experimentos internos no relacionados enmascararon el problema. Cabe destacar que fue la herramienta Code Review de Opus 4.7, alimentada con el contexto completo del repositorio, la que identificó el bug retrospectivamente — Opus 4.6 no había podido hacerlo.

El tercer incidente (16-20 de abril) resultó de una instrucción añadida al system prompt que limitaba la verbosidad (texto entre llamadas a herramientas limitado a 25 palabras, respuestas finales a 100 palabras). Las pruebas internas no habían detectado ninguna regresión, pero pruebas de ablación más amplias revelaron una caída del 3% en inteligencia tanto para Opus 4.6 como para Opus 4.7.

Todos los problemas se resolvieron el 20 de abril con la versión 2.1.116. Anthropic restableció los límites de uso para todos los suscriptores el 23 de abril. La empresa anunció varias mejoras de proceso: mayor uso interno de builds públicas, evaluaciones por modelo, pruebas de ablación sistemáticas, periodos de estabilización, despliegues por fases y la creación de la cuenta @ClaudeDevs en X para una comunicación de producto más detallada.

## GrapheDeConnaissance

- Anthropic —publie→ post-mortem qualité Claude Code avril 2026 (DOCUMENT, 0.98)
- Trois incidents de dégradation qualité —observé_dans→ Claude Code (TECHNOLOGIE, 0.98)
- Niveau de raisonnement medium par défaut —remplace→ niveau de raisonnement high par défaut (CONCEPT, 0.97)
- Changement reasoning effort —réduit→ intelligence perçue par les utilisateurs (CONCEPT, 0.95)
- Bug prompt caching —permet→ cache misses en cascade et perte de contexte (CONCEPT, 0.97)
- Anthropic —affirme_que→ l'en-tête clear_thinking_20251015 devait s'exécuter une seule fois sur les sessions inactives (AFFIRMATION, 0.95)
- Anthropic —affirme_que→ l'en-tête clear_thinking_20251015 se déclenchait à chaque tour suivant (bug) (AFFIRMATION, 0.97)
- Opus 4.7 —résout→ identification rétrospective du bug de cache (EVENEMENT, 0.93)
- Opus 4.7 —surpasse→ Opus 4.6 (TECHNOLOGIE, 0.9)
- Contrainte verbosité —mesure→ baisse de 3% d'intelligence (tests d'ablation) (MESURE, 0.95)
- Anthropic —publie→ réinitialisation des limites d'utilisation de tous les abonnés (23 avril) (EVENEMENT, 0.95)
- Anthropic —a_créé→ @ClaudeDevs (ORGANISATION, 0.9)
- Remontées utilisateurs /feedback —permet→ identification et résolution des bugs (CONCEPT, 0.92)
- Anthropic —affirme_que→ l'API Claude n'a jamais été affectée par les trois incidents (AFFIRMATION, 0.98)

---
Canonical: https://www.thekb.eu/es/fiches/anthropic-claude-code-quality-postmortem-2026-04-23/
