# chow-compound-engineering-v260-review-pipeline-2026-03-31

## Veille

Compound Engineering v2.60, verpflichtende Code-Review mit Konfidenzbewertung, gehärtete plan→work→review-Pipeline

## Titre Article

Compound Engineering: 3/31/2026

## Date

2026-03-31

## URL

https://x.com/trevin/status/2038893322333507781

## Keywords

Compound Engineering, verpflichtende Code-Review, Konfidenzbewertung, Fehlalarme, agentische Pipeline, ce:work, ce:plan, ce:brainstorm, ce:review, Test-Erkennung, Headless-Modus, interaktive Vertiefung, bedingte Diagramme, Mermaid, PR-Feedback-Clustering, document-review, Track-basierte Learnings, Claude Code Skills, SDLC, Softwarelebenszyklus, agentischer SDLC

## Authors

Trevin Chow

## Ton

**Profil**: Angereichertes Changelog/Release Notes, technisch-lockeres Register, detaillierte Ebene für Praktiker.

**Beschreibung**: Chow übernimmt das Format eines kommentierten Changelogs, wobei jeder Abschnitt einen aktualisierten Skill oder ein Feature detailliert beschreibt und zusätzlich zum „Was" auch den „Warum"-Kontext liefert. Der Ton ist der eines Projekt-Maintainers, der direkt zu seiner Nutzer-Community spricht: locker („wir wissen, dass viele von euch einfach nur loslegen wollen"), selbstironisch („ich könnte meine Meinung dazu noch ändern") und pragmatisch. Jede Design-Entscheidung wird mit expliziter Begründung untermauert („erst verpflichten, dann Rauschen reduzieren, sonst würden wir Rauschen verpflichtend machen"). Der Schreibstil ist dicht mit technischen Details, bleibt aber durch einen konversationellen Stil zugänglich. Die Zielgruppe besteht aus aktiven Nutzern von Compound Engineering / Claude Code, die die Änderungen und deren Begründung verstehen wollen.

## Pense-betes

- v2.60.0 vom 31. März 2026 — roter Faden: Straffung der Pipeline Ende-zu-Ende (Reviews, Pläne, reduzierte Reibung)
- **ce:review — wichtigste Änderung**: Headless-Modus für programmatischen Aufruf + Code-Review über die gesamte Pipeline hinweg VERPFLICHTEND (ce:work, ce:brainstorm, ce:plan). Full Review standardmäßig, Limited Review erfordert Begründung
- 6-stufige Konfidenz-Rubrik (0,00–1,00) mit einem Unterdrückungsschwellenwert von 0,60. 6 gezielte False-Positive-Kategorien: bereits bestehende Probleme, Stil-Nitpicks, beabsichtigte Muster, andernorts behandelt, Code-Wiederholung, generische Ratschläge
- ~49 % Reduktion der Fehlalarme ohne Verlust bei der echten Bug-Erkennung
- Absichtsprüfung: Befunde werden gegen den PR-Kontext geprüft (Titel, Beschreibung, verknüpftes Issue) — Befunde, die dem Ziel des PR widersprechen, werden unterdrückt
- Multi-Persona-Konsens: Wenn 2 oder mehr Persona-Reviewer dasselbe Problem markieren, Konfidenzsteigerung um +0,10
- Befunde in Pipe-getrennten Tabellen (kein Freitext mehr) für bessere Überprüfbarkeit und Konsistenz
- Philosophie: „erst verpflichten, dann Rauschen reduzieren — sonst würden wir Rauschen verpflichtend machen"
- **ce:work**: akzeptiert nun Rohprompts ohne vorherigen Plan. Automatische Komplexitätsbewertung (trivial → Zeremonie überspringen, mittel → Inline-Tasks, komplex → empfiehlt Planung)
- Universelle Test-Erkennung vor der Implementierung. Pro-Task-Abwägung: „Tests abgedeckt" ersetzt das binäre „Tests bestehen"
- 5. Prüfung des Testing-Reviewers: erkennt Verhaltensänderungen (neue Branches, State-Mutationen, API-Änderungen) ohne entsprechende Tests
- Erkennung automatisch generierter Branch-Namen (z. B. „worktree-printing-ruby-raven") + Umbenennungsvorschlag
- **ce:brainstorm**: Fehler behoben — Phase 1.1 verhinderte das Lesen technischer Dateien, was zu ungeprüften Behauptungen führte („Tabelle X existiert nicht", ohne das Schema zu prüfen). Jetzt: Verifikation des aktuellen Zustands ist erlaubt, ungeprüfte Behauptungen werden als Annahmen gekennzeichnet
- **ce:plan**: interaktiver Vertiefungsmodus — die Befunde jedes Agenten vor der Integration akzeptieren, ablehnen oder diskutieren (statt automatischem Merge). Unterstützung für /ce:plan „deepen", um die Anreicherung direkt aufzurufen
- document-review wird nach der Vertiefung verpflichtend. Pläne markieren leere Testszenarien bei funktionalen Einheiten
- **Bedingte visuelle Hilfsmittel**: automatische Diagrammerstellung (Mermaid/ASCII), wenn die Komplexität Schwellenwerte überschreitet (5+ nichtlineare Einheiten, 3+ interagierende Oberflächen). Höherer Schwellenwert für PR-Beschreibungen
- **resolve-pr-feedback**: Clustering von PR-Kommentaren nach Themenkategorie und räumlicher Nähe. Nach 2 Fix-Verify-Zyklen werden verbleibende Probleme zu „wiederkehrenden Mustern". Handlungsrelevanz-Filter (ignoriert 👍, Badges, Wrapper-Text)
- **document-review** vereinfacht: 3 Stufen → 2 Stufen (auto / present). Vorschlag für den nächsten Schritt basierend auf dem Dokumenttyp
- **ce:compound**: Track-basiertes Schema — Bug-Track (vollständige Diagnose) vs. Knowledge-Track (leichtgewichtige Vorlage). Auffindbarkeitsprüfung: verifiziert, dass docs/solutions/ in AGENTS.md oder CLAUDE.md referenziert wird
- Infrastruktur: zentralisierte Normalisierung des Model-Felds (fehlerhaftes Qwen→Sonnet-Mapping behoben), MiniMax-Unterstützung, Bereinigung der Argument-Hints

## RésuméDe400mots

Trevin Chow beschreibt die Updates von Compound Engineering, die in Version 2.60.0 vom 31. März 2026 münden. Der rote Faden ist die Straffung der Ende-zu-Ende-Pipeline: Code-Reviews sind weniger rauschbehaftet und nun verpflichtend, Pläne erkennen mehr Lücken vor der Implementierung, und die tägliche Nutzungsreibung nimmt weiter ab.

Die bedeutendste Änderung betrifft ce:review. Ein Headless-Modus ermöglicht den programmatischen Aufruf durch andere Skills, was den nächsten Schritt ermöglichte: Code-Review über die gesamte Pipeline hinweg (ce:work, ce:brainstorm, ce:plan) verpflichtend zu machen. Full Review ist die Standardstufe, wobei Limited Review eine explizite Begründung erfordert. Um zu vermeiden, „Rauschen zu verpflichten", wurde gleichzeitig eine 6-stufige Konfidenz-Rubrik (0,00–1,00) mit einem Unterdrückungsschwellenwert von 0,60 hinzugefügt. Sechs Kategorien von Fehlalarmen werden gezielt adressiert: bereits bestehende Probleme, Stil-Nitpicks, beabsichtigte Muster, andernorts behandelte Fälle, Code-Wiederholung und generische Ratschläge. Ergebnis: eine Reduktion der Fehlalarme um 49 % ohne Verlust bei der echten Erkennung. Befunde werden gegen den PR-Kontext geprüft, und ein Multi-Persona-Konsens erhöht die Konfidenz um 0,10.

ce:work akzeptiert nun Rohprompts ohne vorherigen Plan, mit automatischer Komplexitätsbewertung. Eine universelle Test-Erkennung vor der Implementierung stellt die Synchronisation von Code und Tests sicher. Eine neue Prüfung erkennt Verhaltensänderungen ohne entsprechende Tests.

ce:brainstorm behebt einen subtilen Fehler, bei dem Phase 1.1 Agenten daran hinderte, technische Dateien zu lesen, was zu ungeprüften Behauptungen wie „diese Tabelle existiert nicht" führte, ohne das Schema zu prüfen. Nun ist die Verifikation des aktuellen Zustands erlaubt, während Implementierungsentscheidungen weiterhin der Planung vorbehalten bleiben.

ce:plan erhält einen interaktiven Vertiefungsmodus, der es erlaubt, die Befunde jedes Agenten vor der Integration zu akzeptieren, abzulehnen oder zu diskutieren. Die Dokumentenprüfung wird nach der Anreicherung verpflichtend.

Eine übergreifende Funktion generiert automatisch Diagramme (Mermaid/ASCII), wenn die Komplexität bestimmte Schwellenwerte überschreitet. resolve-pr-feedback erkennt nun „Whack-a-Mole"-Muster durch Clustering ähnlicher Kommentare. document-review wechselt von 3 auf 2 Stufen und schlägt den nächsten Schritt basierend auf dem Dokumenttyp vor. Schließlich übernimmt ce:compound ein Track-basiertes Schema (Bug vs. Knowledge) mit einer Auffindbarkeitsprüfung.

## GrapheDeConnaissance

- Compound Engineering —publie→ v2.60.0 (EVENEMENT, 0.99)
- revue de code obligatoire —fait_partie_de→ Compound Engineering (METHODOLOGIE, 0.98)
- ce:review —réduit→ faux positifs de 49% (CONCEPT, 0.95)
- ce:review —utilise→ scoring confiance 6 niveaux (METHODOLOGIE, 0.97)
- ce:work —permet→ prompts bruts sans plan (CONCEPT, 0.95)
- ce:work —utilise→ découverte universelle de tests (METHODOLOGIE, 0.93)
- ce:brainstorm —résout→ bug vérification fichiers techniques Phase 1.1 (CONCEPT, 0.92)
- ce:plan —utilise→ mode deepening interactif (METHODOLOGIE, 0.93)
- Trevin Chow —dirige→ Compound Engineering (METHODOLOGIE, 0.95)
- Compound Engineering —permet→ diagrammes mermaid conditionnels (CONCEPT, 0.9)
- resolve-pr-feedback —utilise→ clustering des commentaires PR similaires (METHODOLOGIE, 0.88)
- ce:compound —utilise→ schema track-based bug vs knowledge (METHODOLOGIE, 0.9)

---
Canonical: https://www.thekb.eu/de/fiches/chow-compound-engineering-v260-review-pipeline-2026-03-31/
