# chow-compound-engineering-v260-review-pipeline-2026-03-31

## Veille

Compound Engineering v2.60, revisión de código obligatoria con puntuación de confianza, pipeline plan→work→review reforzado

## Titre Article

Compound Engineering: 3/31/2026

## Date

2026-03-31

## URL

https://x.com/trevin/status/2038893322333507781

## Keywords

Compound Engineering, revisión de código obligatoria, puntuación de confianza, falsos positivos, pipeline agéntico, ce:work, ce:plan, ce:brainstorm, ce:review, descubrimiento de pruebas, modo headless, profundización interactiva, diagramas condicionales, mermaid, agrupación de feedback de PR, document-review, aprendizajes basados en pistas, Claude Code skills, SDLC, ciclo de vida del software, SDLC agéntico

## Authors

Trevin Chow

## Ton

**Perfil**: Changelog/notas de versión enriquecidas, registro técnico-casual, nivel de detalle para profesionales.

**Descripción**: Chow adopta el formato de un changelog anotado, donde cada sección detalla una skill o funcionalidad actualizada con el contexto del «por qué» además del «qué». El tono es el de un mantenedor de proyecto que se dirige directamente a su comunidad de usuarios: casual («we know many of you just wanna rip»), autoirónico («I may change my mind on this») y pragmático. Cada decisión de diseño se justifica con un razonamiento explícito («mandate first, then reduce noise, otherwise we'd be mandating noise»). La redacción es densa en detalle técnico, pero se mantiene accesible gracias a un estilo conversacional. El público objetivo son los usuarios activos de Compound Engineering / Claude Code que quieren entender los cambios y su razón de ser.

## Pense-betes

- v2.60.0 del 31 de marzo de 2026 — hilo conductor: ajustar el pipeline de extremo a extremo (revisiones, planes, menor fricción)
- **ce:review — cambio principal**: modo headless para invocación programática + revisión de código hecha OBLIGATORIA en todo el pipeline (ce:work, ce:brainstorm, ce:plan). Revisión completa por defecto, la revisión limitada requiere justificación
- Rúbrica de confianza de 6 niveles (0.00–1.00) con un umbral de supresión de 0.60. 6 categorías de falsos positivos apuntadas: problemas preexistentes, quisquillosidad de estilo, patrones intencionales, gestionados en otro lugar, reformulación del código, consejos genéricos
- ~49 % de reducción en los falsos positivos sin pérdida de detección real de errores
- Verificación de intención: los hallazgos se contrastan con el contexto de la PR (título, cuerpo, issue vinculada) — los hallazgos que contradicen el objetivo de la PR se suprimen
- Consenso multi-persona: si 2 o más revisores persona señalan el mismo problema, aumento de confianza de +0.10
- Hallazgos en tablas delimitadas por pipes (ya no en prosa libre) para facilitar el escaneo y la consistencia
- Filosofía: «imponer primero, reducir el ruido después — de lo contrario estaríamos imponiendo ruido»
- **ce:work**: ahora acepta prompts en bruto sin un plan previo. Evaluación automática de la complejidad (trivial → omite el ceremonial, media → tareas en línea, compleja → recomienda planificar)
- Descubrimiento universal de pruebas antes de la implementación. Deliberación por tarea: «pruebas abordadas» sustituye al binario «pruebas superadas»
- 5ª verificación del revisor de pruebas: detecta cambios de comportamiento (nuevas ramas, mutaciones de estado, cambios de API) sin las pruebas correspondientes
- Detección de nombres de rama autogenerados (p. ej. «worktree-printing-ruby-raven») + sugerencia de renombrado
- **ce:brainstorm**: error corregido — la Fase 1.1 impedía leer archivos técnicos, dando lugar a afirmaciones no verificadas («la tabla X no existe» sin comprobar el esquema). Ahora: se permite la verificación del estado actual, las afirmaciones no verificadas se etiquetan como suposiciones
- **ce:plan**: modo de profundización interactivo — aceptar, rechazar o discutir los hallazgos de cada agente antes de su integración (en lugar de la fusión automática). Soporte para /ce:plan «deepen» para invocar directamente el enriquecimiento
- document-review hecha obligatoria tras la profundización. Los planes señalan los escenarios de prueba vacíos en las unidades funcionales
- **Ayudas visuales condicionales**: generación automática de diagramas (mermaid/ASCII) cuando la complejidad supera umbrales (5+ unidades no lineales, 3+ superficies en interacción). Umbral más alto para las descripciones de PR
- **resolve-pr-feedback**: agrupación de comentarios de PR por categoría de preocupación y proximidad espacial. Tras 2 ciclos de corrección-verificación, los problemas restantes se convierten en «patrones recurrentes». Filtro de accionabilidad (ignora 👍, insignias, texto de envoltorio)
- **document-review** simplificado: 3 niveles → 2 niveles (auto / presente). Sugerencia del siguiente paso según el tipo de documento
- **ce:compound**: esquema basado en pistas — bug-track (diagnóstico completo) vs. knowledge-track (plantilla ligera). Verificación de descubribilidad: comprueba que docs/solutions/ esté referenciado en AGENTS.md o CLAUDE.md
- Infraestructura: normalización centralizada del campo model (corrige el mapeo incorrecto Qwen→sonnet), soporte para MiniMax, limpieza de argument-hints

## RésuméDe400mots

Trevin Chow detalla las actualizaciones de Compound Engineering que culminan en la v2.60.0 del 31 de marzo de 2026. El hilo conductor es el ajuste del pipeline de extremo a extremo: las revisiones de código son menos ruidosas y ahora obligatorias, los planes detectan más lagunas antes de la implementación, y la fricción del uso cotidiano sigue disminuyendo.

El cambio más significativo concierne a ce:review. Un modo headless permite la invocación programática por otras skills, lo que desbloqueó el siguiente paso: hacer obligatoria la revisión de código en todo el pipeline (ce:work, ce:brainstorm, ce:plan). La revisión completa es el nivel por defecto, y la revisión limitada requiere justificación explícita. Para evitar «imponer ruido», se añadió simultáneamente una rúbrica de confianza de 6 niveles (0.00–1.00) con un umbral de supresión de 0.60. Se apuntan seis categorías de falsos positivos: problemas preexistentes, quisquillosidad de estilo, patrones intencionales, casos gestionados en otro lugar, reformulación del código y consejos genéricos. Resultado: una reducción del 49 % en los falsos positivos sin pérdida de detección real. Los hallazgos se verifican con el contexto de la PR, y el consenso multi-persona aumenta la confianza en 0.10.

ce:work ahora acepta prompts en bruto sin un plan previo, con evaluación automática de la complejidad. El descubrimiento universal de pruebas antes de la implementación garantiza la sincronización código/prueba. Una nueva verificación detecta cambios de comportamiento sin las pruebas correspondientes.

ce:brainstorm corrige un error sutil en el que la Fase 1.1 impedía a los agentes leer archivos técnicos, produciendo afirmaciones no verificadas como «esta tabla no existe» sin comprobar el esquema. Ahora se permite la verificación del estado actual mientras que las decisiones de implementación siguen reservadas para la planificación.

ce:plan incorpora un modo de profundización interactivo que permite aceptar, rechazar o discutir los hallazgos de cada agente antes de su integración. La revisión de documentos se vuelve obligatoria después del enriquecimiento.

Una funcionalidad transversal genera automáticamente diagramas (mermaid/ASCII) cuando la complejidad supera ciertos umbrales. resolve-pr-feedback detecta ahora el «whack-a-mole» agrupando comentarios similares. document-review pasa de 3 a 2 niveles y sugiere el siguiente paso según el tipo de documento. Por último, ce:compound adopta un esquema basado en pistas (bug vs. conocimiento) con una verificación de descubribilidad.

## GrapheDeConnaissance

- Compound Engineering —publie→ v2.60.0 (EVENEMENT, 0.99)
- revue de code obligatoire —fait_partie_de→ Compound Engineering (METHODOLOGIE, 0.98)
- ce:review —réduit→ faux positifs de 49% (CONCEPT, 0.95)
- ce:review —utilise→ scoring confiance 6 niveaux (METHODOLOGIE, 0.97)
- ce:work —permet→ prompts bruts sans plan (CONCEPT, 0.95)
- ce:work —utilise→ découverte universelle de tests (METHODOLOGIE, 0.93)
- ce:brainstorm —résout→ bug vérification fichiers techniques Phase 1.1 (CONCEPT, 0.92)
- ce:plan —utilise→ mode deepening interactif (METHODOLOGIE, 0.93)
- Trevin Chow —dirige→ Compound Engineering (METHODOLOGIE, 0.95)
- Compound Engineering —permet→ diagrammes mermaid conditionnels (CONCEPT, 0.9)
- resolve-pr-feedback —utilise→ clustering des commentaires PR similaires (METHODOLOGIE, 0.88)
- ce:compound —utilise→ schema track-based bug vs knowledge (METHODOLOGIE, 0.9)

---
Canonical: https://www.thekb.eu/es/fiches/chow-compound-engineering-v260-review-pipeline-2026-03-31/
