# willison-fable-judgement-delegation-subagents-2026-07-03

## Veille

Kurze Notiz von Simon Willison (Weblog), die zwei Tipps wiedergibt, die während eines *Fireside Chat* bei AIE mit Cat Wu und Thariq Shihipar (Claude Code Team) zu hören waren: **das Modell (Fable, und in gewissem Maße Opus) sein eigenes Urteilsvermögen ausüben lassen, statt ihm Regeln zu diktieren** — veranschaulicht anhand der Entscheidung, ob Tests geschrieben werden sollen. Zweiter Tipp, von Jesse Vincent: um **wertvolle Fable-Tokens zu sparen** (angesichts einer bevorstehenden Preiserhöhung), Fable bitten, **kleine Aufgaben an weniger leistungsfähige Modelle zu delegieren**, wobei es selbst beurteilt, welches geeignet ist. Willison zeigt den genauen verwendeten Prompt (« *use your judgement to decide an appropriate lower power model and run that in a subagent* ») sowie die **Memory-Datei**, die Claude Code daraufhin schrieb. Bereich: Prompt Engineering, Coding Agents, Token-Ökonomie, Multi-Modell-Orchestrierung.

## Titre Article

Fable's judgement

## Date

2026-07-03

## URL

https://simonwillison.net/2026/Jul/3/judgement/

## Keywords

Modellurteilsvermögen, Delegation an Subagents, Model Override, Token-Ökonomie, Fable, Opus, Sonnet, Haiku, Claude Code, Agent-Memory, Memory-Datei, Prompt Engineering, Cat Wu, Thariq Shihipar, Jesse Vincent, nicht überspezifizieren, Token-Preiserhöhung

## Authors

Simon Willison

## Ton

**Profil**: sehr kurze Blog-Notiz (« note »), Ich-Perspektive, konversationelles Praktiker-Register, geringe Dichte, aber hoher Nutzwert. Mittleres bis hohes technisches Niveau, gerichtet an alltägliche Nutzer von Coding Agents.

**Stil**: anekdotisch und unmittelbar — Willison gibt Tipps wieder, die er erhalten hat (« *the most interesting tips I got* »), wendet sie **live** an (« *I prompted Claude Code just now* ») und liefert das rohe Ergebnis (den genauen Prompt, die generierte Memory-Datei) mit einem ehrlichen empirischen Fazit (« *So far it seems to be working well* »). Autorität durch **reproduzierbare Demonstration** statt Argumentation: Er theoretisiert nicht, er zeigt das Artefakt. Keine Metapher; utilitaristischer Ton, fast ein öffentliches *Laborbuch*. Der wirtschaftliche Druck (« *the few days we have left before the prices go up* ») verleiht dem Tipp einen zeitkritischen, vergänglichen Charakter. **Zielgruppe**: Entwickler, die Claude Code / Fable nutzen, kosten- und effizienzbewusst.

## Pense-betes

- **Kerngedanke: Urteilsvermögen schlägt Vorschrift.** Tipp von Cat Wu & Thariq Shihipar (Claude Code Team, *Fireside Chat* bei AIE): **Fable** (und in gewissem Maße **Opus**) selbst entscheiden lassen, *wie* gearbeitet wird, statt starre Regeln zu diktieren. Das Modell verfügt über genug Urteilsvermögen, um eigene Entscheidungen zu treffen.
- **Kanonisches Beispiel — Tests.** Statt der expliziten Regel « *only use automated testing for larger features, don't update and run tests for small copy or design changes* » ist es besser, Fable einfach zu sagen, es solle **sein eigenes Urteilsvermögen einsetzen**, um zu entscheiden, wann Tests geschrieben werden. Die fest codierte Regel ist fragiler als kontextuelles Urteilsvermögen.
- **Zweiter Tipp (Jesse Vincent) — Fable-Tokens durch Delegation sparen.** Zeitkritischer Kontext: **bevorstehende Preiserhöhung** (« *the few days we have left before the prices go up* »). Gegenmaßnahme: Fable bitten, **kleine Aufgaben an weniger leistungsfähige Modelle abzugeben**, wobei es selbst beurteilt, welches geeignet ist — statt alles mit dem Premium-Modell zu verarbeiten.
- **Der genaue verwendete Prompt**: « *For all coding tasks use your judgement to decide an appropriate lower power model and run that in a subagent* ». Das Muster kombiniert beide Tipps: delegiertes Urteilsvermögen **+** Multi-Modell-Orchestrierung über **Subagents** mit *Model Override*.
- **Das generierte Artefakt — eine Memory-Datei.** Claude Code schrieb eigenständig `~/.claude/projects/<project>/memory/delegate-coding-to-subagents.md` (Frontmatter `type: feedback`, `node_type: memory`), die **die Regel und ihre Anwendungsweise kodiert**: *sonnet* für umfangreiche Implementierung, *haiku* für triviale/mechanische Änderungen; **Urteilsvermögen, Review und Synthese verbleiben beim Hauptmodell** (Design, Audit, Datensynthese = nie delegiert).
- **Zugrunde liegende Delegationsdoktrin**: « *implementation work rarely needs the top-tier model; judgment, review, and synthesis stay with the main loop* ». Der Hauptloop behält den Kopf; die Hände (Code schreiben) rutschen eine Modellstufe tiefer.
- **Empirisches Ergebnis (nicht quantifiziert, ehrlich)**: « *I'm getting a ton of work done and my Fable allowance is shrinking less quickly than before.* » → Produktivität gehalten, Fable-Verbrauch verlangsamt.
- **Bezug zu diesem Repository**: Der beschriebene Mechanismus (Memory-Datei `type: feedback` unter `~/.claude/projects/.../memory/`) ist **genau** das hier verwendete persistente Memory-System. Willisons Notiz ist eine öffentliche Demonstration desselben Musters « *delegate coding to subagents with model override* » — direkt übertragbar auf unseren Workflow.
- **Verwandt**: gleiche Familie wie die Fiche zum *Compounding Knowledge Lifecycle* (Agent-Memory, das *Feedback* erfasst, um es wiederzugeben) und wie die Tipps zu *Loop Engineering* / Subagent-Orchestrierung.

## RésuméDe400mots

In dieser kurzen, am 3. Juli 2026 veröffentlichten Notiz gibt Simon Willison zwei sich ergänzende Tipps wieder, wie man das Beste aus Coding Agents herausholt — gehört während eines *Fireside Chat*, den er bei AIE mit **Cat Wu** und **Thariq Shihipar** vom Claude Code Team moderierte.

Das erste Prinzip: **dem Modell sein eigenes Urteilsvermögen überlassen, statt vorzuschreiben, wie es arbeiten soll**. Dies gilt für **Fable** und in gewissem Maße für **Opus**. Das gegebene Beispiel betrifft Tests. Man *kann* eine explizite Regel formulieren — « *only use automated testing for larger features, don't update and run tests for small copy or design changes* » —, es ist jedoch **vorzuziehen, Fable einfach zu bitten, sein Urteilsvermögen einzusetzen**, um zu entscheiden, wann Tests geschrieben werden sollen. Das kontextuelle Urteilsvermögen des Modells erweist sich als robuster als die fest codierte Regel.

Der zweite Tipp, weitergegeben von **Jesse Vincent**, wendet dieselbe Philosophie auf die **Token-Ökonomie** an. Der Kontext ist zeitkritisch: Die Preise für Fable-Tokens sollen in wenigen Tagen steigen. Um diese wertvolle Ressource nicht zu verbrauchen, besteht die Idee darin, **Fable zu bitten, kleinere Aufgaben an weniger leistungsfähige Modelle zu delegieren**, wobei es selbst beurteilt, welches geeignet ist.

Willison wendet den Tipp sofort an und dokumentiert die Erfahrung von Anfang bis Ende. Er liefert den **genauen Prompt**, der an Claude Code gesendet wurde: « *For all coding tasks use your judgement to decide an appropriate lower power model and run that in a subagent* ». Als Antwort darauf hat Claude Code **spontan eine Memory-Datei geschrieben** (`~/.claude/projects/<project>/memory/delegate-coding-to-subagents.md`, `type: feedback`). Diese Datei hält die Anweisung nicht nur fest: Sie **kodifiziert deren Anwendung** — *sonnet* für umfangreiche Implementierung, *haiku* für triviale oder mechanische Änderungen —, während sie dem **Hauptmodell** vorbehält, was Urteilsvermögen erfordert: Design, Audit, Datensynthese, Review. Die Begründung passt in einen Satz: Implementierungsarbeit benötigt selten das leistungsstärkste Modell, während Urteilsvermögen, Review und Synthese im Hauptloop verbleiben.

Das Fazit ist empirisch und maßvoll formuliert: « *So far it seems to be working well. I'm getting a ton of work done and my Fable allowance is shrinking less quickly than before.* » Die Notiz veranschaulicht somit anhand eines reproduzierbaren Falls eine doppelte Best Practice: Agenten mit Urteilsvermögen **nicht überzuspezifizieren** und **mehrere Modellstufen über Subagents zu orchestrieren**, um Premium-Tokens zu schonen.

## GrapheDeConnaissance

- Cat Wu —recommande→ laisser Fable et Opus exercer leur propre jugement plutôt que dicter des règles (AFFIRMATION, 0.95)
- Thariq Shihipar —travaille_chez→ équipe Claude Code (ORGANISATION, 0.95)
- Cat Wu —travaille_chez→ équipe Claude Code (ORGANISATION, 0.95)
- Jesse Vincent —recommande→ déléguer les petites tâches à des modèles moins puissants pour économiser les tokens Fable (AFFIRMATION, 0.93)
- Fable —permet→ décision contextuelle sur l'écriture des tests (jugement du modèle) (CONCEPT, 0.9)
- Simon Willison —utilise→ délégation des tâches de code à des subagents à modèle moins puissant (METHODOLOGIE, 0.95)
- Délégation à des subagents —utilise→ model override (Sonnet, Haiku) (TECHNOLOGIE, 0.92)
- Délégation à des subagents —réduit→ Fable (CONCEPT, 0.9)
- Claude Code —a_créé→ Fichier mémoire (DOCUMENT, 0.95)
- Fichier mémoire —affirme_que→ "implementation work rarely needs the top-tier model; judgment, review, and synthesis stay with the main loop" (CITATION, 0.92)
- Sonnet —s_applique_à→ implémentation substantielle de code (CONCEPT, 0.9)
- Haiku —s_applique_à→ éditions triviales ou mécaniques (CONCEPT, 0.9)
- Jugement du modèle —s_oppose_à→ règles explicites codées en dur (CONCEPT, 0.88)
- Simon Willison —affirme_que→ "I'm getting a ton of work done and my Fable allowance is shrinking less quickly than before" (CITATION, 0.9)

---
Canonical: https://www.thekb.eu/de/fiches/willison-fable-judgement-delegation-subagents-2026-07-03/
