# shihipar-claude-code-lessons-building-skills-2026-06-03

## Veille

Blogbeitrag von **Anthropic / claude.com** von **Thariq Shihipar** (Member of Technical Staff, Claude Code-Team), veröffentlicht am **3. Juni 2026**, der Anthropics **interne Erfahrung** bei der Konzeption und Nutzung von **Skills** destilliert. **Rahmenthese**: Ein Skill ist keine einfache Markdown-Datei, sondern ein **Ordner** (Anweisungen + Skripte + Ressourcen + Konfiguration + Hooks), den der Agent **entdeckt und bearbeitet**; *« Man sollte das gesamte Dateisystem als eine Form von Context Engineering und progressiver Offenlegung betrachten. »* Der Artikel liefert zwei strukturierende Beiträge. **(A) Eine Taxonomie von 9 bei Anthropic beobachteten Skill-Kategorien**: (1) **Library/API Reference** (Dokumentation für interne Bibliotheken/CLIs mit *Gotchas* — z. B. `billing-lib`, `internal-platform-cli`, `sandbox-proxy`); (2) **Product Verification** (Testing/Verifikation via Playwright oder tmux — `signup-flow-driver`, `checkout-verifier`, `tmux-cli-driver`); (3) **Data Fetching & Analysis** (Zugriff auf Daten-/Monitoring-Stacks — `funnel-query`, `cohort-compare`, `grafana`, `datadog`); (4) **Business Process Automation** (wiederkehrende Workflows — `standup-post`, `weekly-recap`, `create-<ticket>-ticket`); (5) **Code Scaffolding** (Framework-Boilerplate — `new-migration`, `create-app`); (6) **Code Quality & Review** (`adversarial-review`, `code-style`, `testing-practices`); (7) **CI/CD & Deployment** (`babysit-pr`, `deploy-<service>`, `cherry-pick-prod`); (8) **Runbooks** (Multi-Tool-Diagnosen — `<service>-debugging`, `oncall-runner`, `log-correlator`); (9) **Infrastructure Operations** (Wartung mit Schutzmechanismen — `<resource>-orphans`, `cost-investigation`). **(B) Eine Reihe von Best Practices**: Nicht das Offensichtliche wiederholen (*« Claude weiß bereits, wie man programmiert, und kann die Codebasis lesen »* → auf das zielen, was dem Standardverhalten widerspricht); den **Gotchas-Abschnitt** verfeinern (*« der Inhalt mit dem höchsten Signalwert in jedem Skill »*); **progressive Offenlegung** über den Dateibaum (je nach Situation auf Referenzdateien verweisen, statt alles im Voraus zu laden); **für das Modell geschriebene Beschreibungen** (*« das Beschreibungsfeld ist keine Zusammenfassung, sondern eine Beschreibung, wann dieser Skill ausgelöst werden soll »*); **Setup-Abläufe** (Konfiguration in `config.json`, andernfalls Abfrage via `AskUserQuestion`); **persistenter Speicher** (Append-only-Logs / JSON über die Variable `${CLAUDE_PLUGIN_DATA}`); **Hilfsskripte** (*« erlaubt es Claude, seine Turns auf Komposition zu verwenden … statt Boilerplate neu zu konstruieren »*); **hooks conditionnels** (nur für die Dauer des Skills aktiviert — z. B. ein Sicherheits-Hook, der destruktive Befehle blockiert). **Verbreitung bei Anthropic**: Skills werden in `./.claude/skills` gespeichert, informell über Slack in einem Sandbox-Ordner geteilt und dann per **PR** in den internen **Marketplace** überführt, sobald sie an Zugkraft gewinnen; **Nutzungsmessung** über einen **hook PreToolUse**, der Aufrufe protokolliert (und so populäre gegenüber wenig genutzten Skills sichtbar macht). Direkte Fortsetzung der Fiche [[shihipar-claude-code-html-unreasonable-effectiveness-markdown-2026-05-10]] (gleicher Autor) und konkrete Ergänzung zu den Skills-Fiches von Anthropic/Willison/Vincent sowie zum Harness Engineering.

## Titre Article

Lessons from building Claude Code: How we use skills

## Date

2026-06-03

## URL

https://claude.com/blog/lessons-from-building-claude-code-how-we-use-skills

## Keywords

Skills, Claude Code, Anthropic, interner Erfahrungsbericht, Skill-Ordner, Context Engineering, progressive Offenlegung, neun Skill-Kategorien, Library-API-Referenz, Produktverifikation, Datenabruf und -analyse, Geschäftsprozessautomatisierung, Code-Scaffolding, Codequalität und Review, CI/CD-Deployment, Runbooks, Infrastrukturbetrieb, Gotchas, Gotchas-Abschnitt, Claude weiß bereits, wie man programmiert, Beschreibung als Auslöser, Beschreibungsfeld ist keine Zusammenfassung, Setup-Ablauf, config.json, AskUserQuestion, persistenter Speicher, Append-only-Logs, CLAUDE_PLUGIN_DATA, Hilfsskripte, Komposition vs. Boilerplate, hooks conditionnels, Sicherheits-Hook, PreToolUse-Hook, Skill-Nutzungsmessung, interner Marketplace, .claude/skills, PR-basierte Verbreitung, Slack-Sandbox, Playwright, tmux, grafana, datadog, adversarial-review, babysit-pr, oncall-runner, Thariq Shihipar, trq212

## Authors

**Thariq Shihipar** (Member of Technical Staff chez Anthropic, équipe **Claude Code** ; @trq212 / @trq sur X, thariqs.github.io), pour le blog **claude.com**. Même auteur que la fiche *Using Claude Code: The Unreasonable Effectiveness of HTML* (2026-05-10). Publié le **3 juin 2026**.

## Ton

**Profil**: Praktiker-Feedback eines Ingenieurs (*builder-to-builder*), erste Person Plural (*« wie wir Skills nutzen »*, *« wir verwenden einen PreToolUse-Hook »*), gerichtet an ein sachkundiges technisches Publikum — Ingenieure und Power-User, die eigene Skills entwickeln. **Didaktisch-präskriptives, dichtes und operatives** Register, **hohes** technisches Niveau (Umgebungsvariablen, Hooks, Dateibäume, Namenskonventionen).

**Stil**: Technische Prosa, gegliedert in zwei Blöcke — eine **Taxonomie** (9 Kategorien mit echten Anthropic-Skill-Namen als Beispiele), gefolgt von einer handlungsorientierten **Liste von Best Practices**. Die Autorität stützt sich auf eine **Insider**-Position: das, was das Team, das Claude Code gebaut hat, *von innen* beobachtet. Jeder Ratschlag ist in einem konkreten Befund verankert (*« häufige Fehlerquellen, auf die Claude stößt »*) statt in einer Allgemeinaussage. Ehrlichkeit über den tatsächlichen Zweck der Objekte (das `description`-Feld dient dem Modell-Routing, nicht dem Menschen).

**Zentrale Aphorismen**:
- ***« Claude weiß bereits, wie man programmiert, und kann die Codebasis lesen. »*** (Anti-Redundanz: nur dokumentieren, was dem Standard widerspricht).
- ***« Der Inhalt mit dem höchsten Signalwert in jedem Skill ist der Gotchas-Abschnitt. »***
- ***« Man sollte das gesamte Dateisystem als eine Form von Context Engineering und progressiver Offenlegung betrachten. »***
- ***« Das Beschreibungsfeld ist keine Zusammenfassung, sondern eine Beschreibung, wann dieser Skill ausgelöst werden soll. »***
- ***« Claude Skripte und Bibliotheken zu geben, erlaubt es Claude, seine Turns auf Komposition zu verwenden und zu entscheiden, was als Nächstes zu tun ist, statt Boilerplate neu zu konstruieren. »***

**Metaphern / wirksame Rahmenmodelle**:
- ***Das Dateisystem als Context Engineering*** — der Dateibaum eines Skills = ein Mechanismus der progressiven Offenlegung, kein bloßes Bündel von Anweisungen.
- ***Die Beschreibung als Auslöser, nicht als Zusammenfassung*** — richtet das Schreiben auf das Modell-Routing aus.
- ***Die Turns des Modells als knappe Ressource*** — Hilfsskripte sparen Denkvermögen für die Komposition auf hohem Niveau.
- ***Der organische Lebenszyklus von Skills*** — von einem über Slack geteilten Sandbox-Ordner bis zur Beförderung per PR in den Marketplace, gemessen durch Nutzungs-Hooks.

**Epistemische Position**: Zeugnis interner Autorität (Anthropic / Claude Code-Team), reich an benannten Beispielen; präskriptiv, aber in empirischer Beobachtung der Nutzung im Unternehmensmaßstab verankert. Zu gewichten als Erfahrungsbericht eines Anbieters über die eigene Praxis (keine unabhängige Studie), jedoch mit starker Glaubwürdigkeit hinsichtlich des operativen „Wie“.

**Autorität**: (a) **Anthropic-Insider** zum Referenzwerkzeug; (b) **unmittelbar wiederverwendbare Taxonomie** (9 Kategorien, die den gesamten SDLC + Ops abdecken); (c) **konkrete Beispiele** echter Skill-Namen; (d) im **großen Maßstab getestete** Ratschläge (Marketplace + interne Nutzungsmessung).

## Pense-betes

- **Datum / Quelle**: **3. Juni 2026**, Blog **claude.com** (Anthropic). Autor: **Thariq Shihipar** (Claude Code-Team, @trq212). Direkte Fortsetzung seiner Fiche [[shihipar-claude-code-html-unreasonable-effectiveness-markdown-2026-05-10]].
- **Zentrale Rahmung**: Ein Skill = **ein Ordner** (Anweisungen + Skripte + Ressourcen + Konfiguration + Hooks), keine einzelne .md-Datei. *« Das gesamte Dateisystem als eine Form von Context Engineering und progressiver Offenlegung. »* ### Die 9 Skill-Kategorien (Anthropic-Taxonomie) | # | Kategorie | Zweck | Genannte Beispiele | |---|-----------|----------|----------------| | 1 | **Library/API Reference** | Dokumentation für interne Bibliotheken/CLIs + Gotchas | `billing-lib`, `internal-platform-cli`, `sandbox-proxy` | | 2 | **Product Verification** | Testing/Verifikation (Playwright, tmux) | `signup-flow-driver`, `checkout-verifier`, `tmux-cli-driver` | | 3 | **Data Fetching & Analysis** | Zugriff auf Daten/Monitoring + Abfragemuster | `funnel-query`, `cohort-compare`, `grafana`, `datadog` | | 4 | **Business Process Automation** | Wiederkehrende Workflows | `standup-post`, `weekly-recap`, `create-<ticket>-ticket` | | 5 | **Code Scaffolding** | Framework-Boilerplate | `new-migration`, `create-app`, `new-<framework>-workflow` | | 6 | **Code Quality & Review** | Stil + Review | `adversarial-review`, `code-style`, `testing-practices` | | 7 | **CI/CD & Deployment** | Build / Push / Deploy | `babysit-pr`, `deploy-<service>`, `cherry-pick-prod` | | 8 | **Runbooks** | Multi-Tool-Diagnosen nach Symptom | `<service>-debugging`, `oncall-runner`, `log-correlator` | | 9 | **Infrastructure Operations** | Wartung + Schutzmechanismen | `<resource>-orphans`, `dependency-management`, `cost-investigation` | ### Best Practices (Checkliste)
- **Anti-Redundanz**: *« Claude weiß bereits, wie man programmiert »* → nur dokumentieren, was **dem Standardansatz des Modells widerspricht**.
- **Gotchas-Abschnitt** = Inhalt mit dem **höchsten Signalwert**; er wird aus tatsächlichen Fehlerquellen aufgebaut (z. B. uneinheitliche Feldbenennungen, Append-only-Tabellen).
- **Progressive Offenlegung**: Claude je nach Situation auf Referenzdateien verweisen, statt alles im Voraus zu laden.
- **Flexibilität**: die nötigen Informationen liefern, ohne zu stark einzuschränken — dem Agenten Anpassung ermöglichen.
- **Setup-Ablauf**: die Konfiguration speichern (`config.json`); falls nicht vorhanden, den Nutzer über **`AskUserQuestion`** befragen.
- **Beschreibung = Auslöser**: für das **Modell-Routing** schreiben, mit Aktivierungsformulierungen — *« keine Zusammenfassung, sondern eine Beschreibung, wann dieser Skill ausgelöst werden soll »*.
- **Speicher**: Append-only-/JSON-Logs, stabiles Verzeichnis über **`${CLAUDE_PLUGIN_DATA}`** → der Agent erinnert sich an frühere Durchläufe.
- **Hilfsskripte**: Bibliotheken/Funktionen bereitstellen → der Agent verwendet seine *Turns* für die **Komposition**, nicht für den Neuaufbau von Boilerplate.
- **hooks conditionnels**: **nur** während des Aufrufs des Skills und für die Dauer der Sitzung aktiviert (z. B. ein Hook, der destruktive Befehle blockiert) — im Kontext nützlich, aber unerwünscht, wenn *dauerhaft aktiv*. ### Verbreitung & Messung (bei Anthropic)
- Skills gespeichert in **`./.claude/skills`** (Repo) oder über einen internen Plugin-**Marketplace**.
- **Organischer Zyklus**: Sandbox-Ordner → informelle Slack-Weitergabe → Zugkraft → **PR** in den Marketplace.
- **Nutzungsmessung**: **hook PreToolUse**, der Aufrufe protokolliert → identifiziert populäre gegenüber wenig genutzten Skills. ### Für Einsätze / Präsentationen nutzbar
- **Sofort einsetzbares Mapping-Raster**: Die Skills eines Teams anhand der **9 Kategorien** auditieren (deckt Dev + Daten + Ops + Prozess ab), Lücken aufspüren.
- Das Triptychon **Gotchas / progressive Offenlegung / Beschreibung-als-Auslöser** = goldene Regeln für das Schreiben von Skills, die in eine firmeninterne *Skill-Writing-Guideline* integriert werden sollten.
- Konvergiert mit *Harness Engineering* (Böckeler, Stufe 5 der Every-Skala [[taylor-entis-every-eight-levels-ai-adoption-2026-06-02]]) und mit den Skills-Fiches (Anthropic *Agent Skills*, Willison, Vincent *Superpowers*, Lattice). Spezifischer Beitrag: **Nutzungsrückmeldung im Unternehmensmaßstab** + die **Mechanik von Verbreitung/Messung**.

## RésuméDe400mots

Veröffentlicht am **3. Juni 2026** im Blog von Anthropic von **Thariq Shihipar** (Claude Code-Team), destilliert dieser Artikel die interne Erfahrung des Unternehmens im Umgang mit **Skills**. Die einleitende Rahmung korrigiert eine reduktive Sichtweise: Ein Skill ist keine isolierte Markdown-Datei, sondern ein **Ordner**, der Anweisungen, Skripte, Ressourcen, Konfiguration und Hooks zusammenführt, den der Agent **erkundet und bearbeitet**. Die strukturierende Maxime: *« Man sollte das gesamte Dateisystem als eine Form von Context Engineering und progressiver Offenlegung betrachten. »*

Der Artikel bietet zunächst eine **Taxonomie von neun Kategorien** von bei Anthropic beobachteten Skills, illustriert mit echten Namen: **(1) Library/API Reference** (Dokumentation für interne Bibliotheken/CLIs mit Gotchas); **(2) Product Verification** (Testing via Playwright/tmux); **(3) Data Fetching & Analysis** (grafana, datadog, Standardabfragen); **(4) Business Process Automation** (Standups, Recaps, Tickets); **(5) Code Scaffolding** (Boilerplate, Migrationen); **(6) Code Quality & Review** (`adversarial-review`, code-style); **(7) CI/CD & Deployment** (`babysit-pr`, Deploy); **(8) Runbooks** (Multi-Tool-Diagnosen nach Symptom); **(9) Infrastructure Operations** (Wartung mit Schutzmechanismen).

Anschließend folgt ein Korpus an **Best Practices**. Die erste ist die **Anti-Redundanz**: *« Claude weiß bereits, wie man programmiert, und kann die Codebasis lesen »* — man muss dokumentieren, was **dem Standardverhalten widerspricht**, nicht das Offensichtliche. Der wertvollste Inhalt ist der **Gotchas-Abschnitt** (*« der Inhalt mit dem höchsten Signalwert in jedem Skill »*), gespeist von tatsächlich angetroffenen Fehlerquellen. Die **progressive Offenlegung** erfolgt über den Dateibaum: Claude wird je nach Situation auf die passende Referenzdatei verwiesen. **Beschreibungen** müssen für das **Modell** geschrieben werden, nicht für den Menschen: *« das Beschreibungsfeld ist keine Zusammenfassung, sondern eine Beschreibung, wann dieser Skill ausgelöst werden soll. »* Für die Konfiguration speichert ein **Setup-Ablauf** die Parameter (`config.json`) oder fragt den Nutzer über `AskUserQuestion` ab. **Persistenter Speicher** erfolgt über Append-only-/JSON-Logs im stabilen Verzeichnis `${CLAUDE_PLUGIN_DATA}`. **Hilfsskripte** entlasten die Denkressourcen des Modells: *« erlaubt es Claude, seine Turns auf Komposition zu verwenden … statt Boilerplate neu zu konstruieren. »* Schließlich sind **hooks conditionnels** (z. B. das Blockieren destruktiver Befehle) nur für die Dauer des Skills aktiviert.

Auf der Seite der **Verbreitung** speichert Anthropic seine Skills in `./.claude/skills`; sie entstehen in einem über Slack geteilten Sandbox-Ordner, gewinnen an Zugkraft und werden dann per **PR** in einen internen Marketplace überführt. **Die Nutzung wird gemessen** durch einen hook PreToolUse, der Aufrufe protokolliert und so populäre sowie überarbeitungsbedürftige Skills sichtbar macht. Ein operativer Leitfaden, der unmittelbar für das Schreiben, Verteilen und Messen von Skills im organisatorischen Maßstab wiederverwendbar ist.

## GrapheDeConnaissance

- Thariq Shihipar —publie→ Lessons from building Claude Code: How we use skills (DOCUMENT, 0.97)
- Anthropic —publie→ Lessons from building Claude Code: How we use skills (DOCUMENT, 0.97)
- Thariq Shihipar —fait_partie_de→ équipe Claude Code (ORGANISATION, 0.95)
- Skill —est_instance_de→ dossier d'instructions scripts et ressources (CONCEPT, 0.95)
- Skill —est_instance_de→ progressive disclosure (METHODOLOGIE, 0.93)
- Anthropic —utilise→ taxonomie 9 catégories de skills (CONCEPT, 0.92)
- Thariq Shihipar —affirme_que→ la section Gotchas est le contenu à plus fort signal d'une skill (AFFIRMATION, 0.93)
- champ description —permet→ Skill (CONCEPT, 0.94)
- helper scripts —permet→ de consacrer les turns du modèle à la composition (CONCEPT, 0.9)
- CLAUDE_PLUGIN_DATA —permet→ un répertoire stable de mémoire persistante (CONCEPT, 0.9)
- hooks conditionnels —s_applique_à→ Skill (CONCEPT, 0.9)
- Anthropic —utilise→ un marketplace interne par PR pour distribuer les skills (METHODOLOGIE, 0.88)
- hook PreToolUse —mesure→ l'usage des skills (CONCEPT, 0.9)
- Thariq Shihipar —recommande→ ne pas documenter ce que Claude sait déjà (AFFIRMATION, 0.92)
- AskUserQuestion —permet→ Skill (CONCEPT, 0.85)

---
Canonical: https://www.thekb.eu/de/fiches/shihipar-claude-code-lessons-building-skills-2026-06-03/
