Ausführlicher Leitfaden von **Anthropic** von **Louis Claxton** (Applied-AI-Team), veröffentlicht am **21. August 2026** im claude.com-Blog: eine angegebene Lesezeit von **40 Minuten**, rund **64.000 Zeichen**, präsentiert als Sammlung von *Plays*, die aus der Arbeit des Teams mit seinen Kunden stammen. (A) Die Diagnose: Da Code nicht mehr der Engpass ist, verschiebt sich dieser auf die Phasen vor und nach dem Bau (Planung, Review/Test, Deployment); zeilenweise Kontrollen greifen nicht mehr, sobald der Agent den Großteil des Diffs schreibt, und die Governance-Kosten steigen, da Ausnahmen weiterhin über periodische Ausschüsse laufen. (B) Die Antwort: sechs Phasen (Plan, Design, Build, Test, Deploy, Maintain), organisiert als **Schleife** statt als Kette, jede endet mit einem **committeten Artefakt**, das die nächste Phase liest — `intent.md`, `spec.md`, `plan.md`, der Diff und seine Tests, der PR und seine Befunde, der Vorfallbericht. (1) Institutionelles Wissen wird zu versionierten Dateien: `CLAUDE.md`, Skills, `REVIEW.md`, `bands.yaml`. (2) Governance gliedert sich in zwei Schichten, wobei der Skill als beratende Kontrolle positioniert ist und der Hook als deterministische Schicht dahinter. Funktionstrennung wird als Invariante festgelegt — der Agent, der den Code schreibt, kann ihn nicht genehmigen —, und der Beitrag schließt mit *„The loop keeps running. Human judgement stays above it.“* Der Korpus enthält bereits [[clinton-anthropic-secure-ai-native-sdlc-2026-07-21]] zur Sicherheitsseite desselben Zyklus sowie [[hingel-augment-how-ai-changes-sdlc-six-stages-2026-06-08]] zur selben Sechs-Phasen-Gliederung aus Sicht eines Wettbewerbers.
#AI-native SDLC#software development lifecycle#plays
Louis Claxton (Anthropic, équipe Applied AI) · sur le blog claude.com ; contributions créditées à Jim Blackhurst · Will Steuk et Jamal Arif.
Leitfaden von **Michael Segner**, veröffentlicht am **20. August 2026** im Blog von claude.com in der Kategorie *Claude Code*: ein **5-minütiger** Lesetext mit angekündigten rund **31.500 Zeichen** Fließtext, auch als PDF verfügbar. Angegebenes Material: Interviews mit **mehr als einem Dutzend** Startups, fünfzehn davon namentlich genannt — **Artemis Security**, **Cainex**, **Clay**, **ClickHouse**, **Cognition**, **Commure**, **Crosby**, **Emergent**, **Harvey**, **Heidi**, **Higgsfield**, **Omni**, **Parahelp**, **Translucent**, **Zingage**. (A) Fünf Betriebsregeln: *everyone ships*, *automate the tedium*, *trust, but verify*, *build for rebuilding*, *prototype, dogfood, productionize*, jede abgeschlossen mit Produkt-Tipps und zusammengefasst in einer abschließenden Checkliste. (B) Ein Textkörper aus zugeschriebenen Zitaten, wobei jede Regel durch namentlich genannte Führungskräfte illustriert wird statt durch eine aggregierte Kennzahl. Die vier hervorgehobenen Zahlen stammen von den interviewten Unternehmen: **+30 %** mehr ausgelieferte Features (ClickHouse), **2- bis 3-fache** Engineering-Produktivität (Omni), **100 %** der Bug-Triage automatisiert (Clay), **mehr als 6.000 PRs pro Woche** (Artemis Security). Zwei Passagen weichen vom Erfahrungsbericht-Register ab: **Cainex**s Selbstkorrekturschleife bei der medizinischen Kodierung, Schritt für Schritt beschrieben, sowie der interne Einsatz von **Claude Tag** bei **Anthropic** als Erstreagierer für den CI/CD-Bereitschaftsdienst. Die eingangs gestellte Frage — *„Wie würde es aussehen, wenn eine Organisation ihren Produktentwicklungszyklus von Grund auf mit Claude Code aufbauen würde?"* — knüpft an [[claxton-anthropic-ai-native-sdlc-playbook-2026-08-21]] an, das am folgenden Tag vom selben Verlag veröffentlicht wurde, und führt [[cherny-wu-reflecting-year-claude-code-2026-07-17]] weiter.
#Claude Code#Startups#everyone ships
Michael Segner · auteur du guide sur le blog claude.com (fonction non affichée par la page) ; entretiens avec les dirigeants de quinze entreprises nommées.
Unternehmensblogbeitrag von **Block** (`block.xyz/inside`), nicht namentlich gezeichnet — als Autor wird **„Block“** angegeben —, veröffentlicht am **18. August 2026**, ~930 Wörter, der **die Open-Source-Stellung von Berd** ankündigt, Blocks interne Desktop-Anwendung für die Arbeit mit Agenten, und die Designthese darlegt, die sie geleitet hat: Agenten Charakter zu verleihen *"not only through roles, instructions, skills, and tools, but through distinctive visual identities"* — daher die selbst entwickelten animierten Figuren, die *"Gloopies"*. Der Beitrag geht von einer Beobachtung der Fragmentierung aus (*"The technology was powerful, but the experience around it was fragmented"*) und einem präzise benannten Interface-Problem: *"the product gives people little sense of how the agent is configured, which context and tools are available to it, and how it differs from another agent"*. Zwei strukturierende Beiträge. **(A) Eine dreistufige Gliederung**: **goose** bleibt das Framework und die *Runtime*, die die Agent-Loop trägt; **Berd** ist der Desktop-Client (Projekte, Kontext, Sitzungen, Agenten, Konfiguration); beide kommunizieren über das **Agent Client Protocol**. **Buzz** wird als Fortsetzung bezeichnet, für den Moment, in dem aus Solo-Arbeit Zusammenarbeit wird (*"Start alone, then go multiplayer"*). **(B) Sechs an Buzz weitergereichte Anforderungen**, als Fazit formuliert: *"private space, durable context, recognizable agent identities, reusable skills, visible configuration, and clearer visibility into an agent's configured context, tools, and capabilities"* — ein Raster, das sich direkt zur Bewertung eines Agent-Clients wiederverwenden lässt. Der Text selbst unterscheidet Identität von Fähigkeit: *"The avatars make the agent recognizable. Its role, skills, and tools make it useful."* Es werden keine Nutzungszahlen genannt, und für die Open-Source-Stellung wird keine Lizenz angegeben.
#Berd#Block#Open Source
**Aucun auteur nommé** : le billet est signé **« Block »** — le champ *Author* de la page porte le nom de l'entreprise. Publié le **18 août 2026** sur `block.xyz/inside` · le blog **corporate** · et non sur `engineering.block.xyz`.
Offizielle Produktseite von **DeepSeek**, veröffentlicht am **13. August 2026**, **nicht namentlich gezeichnet**, ca. 450 Wörter, die die *Developer-Preview*-Veröffentlichung von **DeepSeek Harness** (`dsh`) ankündigt — ein Coding-Agent-Harness, **Open Source unter der MIT-Lizenz**, dessen Repository am selben Tag eröffnet wurde. Eine Drei-Wort-These, wiederholt im Titel und in der Repository-Beschreibung: *« Everything is a plugin »*, gepaart mit einem zweiten Versprechen, *« Every run is traceable »*. Die Seite formuliert die Gleichung *« AGENT = MODEL + HARNESS »* und listet die steckbaren Fähigkeiten auf — *« models, tools, skills, sessions, sandboxes, storage, loops, scheduling, and the UI »*. Vier Modi werden ausgeliefert: **Standard** (vollständiger Coding-Agent), **Code** (Tools, die über das *Code Mode SDK* freigelegt werden und es dem Modell erlauben, mehrstufige Operationen innerhalb eines TypeScript-Programms zu komponieren), **Minimal** (*« two-tool coding agent with persistent bash and str_replace_editor »*, ausdrücklich *« for benchmarking models in a minimal environment »*), und **Creator** (Laufzeitinspektion, In-Memory-Plugin-Tests). Die technische Substanz liegt im Repository, nicht auf der Seite: `docs/architecture.md` formuliert eine Logging-Invariante — *« Model-visible means logged. Anything that reaches a model request must be reconstructable from the log, and a runtime invariant asserts it »* — und stellt fest, dass *« there is no privileged core to patch »*. Der technische Kern stammt nicht von DeepSeek selbst: DSH baut auf **Cordis** auf (dem `cordiverse`-Projekt, einem Dritten), **vendort** in `vendor/` mit Manifest und Sync-Verfahren, und die Seite platziert das *« Cordis paper »* auf derselben Navigationsebene wie „GitHub“ und „Developer docs“. Zwei LLM-Adapter werden ausgeliefert — `dsh-llm-deepseek` und `dsh-llm-pi-ai`, ein generischer Multi-Provider-Adapter. Das Repository warnt in Großbuchstaben: *« THERE WILL BE COMPATIBILITY-BREAKING CHANGES »*, und `CLAUDE.md` legt fest, dass `SESSION_FORMAT_VERSION` bei `0` bleibt, *« with no compatibility promise »*, wobei Backends alte Formate auf der Festplatte ablehnen. Zeitachse: DSH erscheint an dem Tag, an dem **DeepSeek-V4-Pro GA erreicht**, drei Tage bevor am **16. August 2026 um 16:00 UTC** ein neuer API-Preisplan in Kraft tritt, mit Spitzen-/Nebenzeittarifen und einem Nebenzeit-Rabatt von **−50 %**.
#DeepSeek Harness#dsh#Agent-Harness
**DeepSeek** (DeepSeek AI, laboratoire chinois) · en tant qu'institution. Page produit **non signée** : aucun auteur · aucun ingénieur mis en avant · aucun billet de blog ni papier technique associé. Le « nous » n'apparaît qu'une fois · en dernière phrase — *« We look forward to exploring the limits of intelligence with developers worldwide »*. Publiée le **13 août 2026**. La page est rendue en JavaScript : `curl` sur l'URL renvoie **HTTP 202 avec un corps vide** · le texte n'existant qu'après exécution du bundle. Deux documents de politique sont liés en pied de page — *Safe Use Policy* et *Data Processing Statement*.
Interner Rechercheureport vom **12. August 2026**, der zu Präsentationszwecken alles öffentlich Dokumentierte über **Buzz** zusammenfasst — den Workspace für Menschen und Agenten von **Block**, der am **21. Juli 2026** unter der Lizenz **Apache 2.0** eingeführt wurde. Er aggregiert die beiden bereits veröffentlichten Engineering-Beiträge neben der Unternehmensankündigung, das GitHub-Repository, die Presseberichterstattung, X sowie **drei unabhängige Praxisberichte**, die die einzigen nicht selbst berichteten Daten des Dossiers darstellen. **(A) Eine durch Zitat dokumentierte Begriffslücke**: Der Launch-Tweet von **Jack Dorsey** kündigt *„model-agnostic, decentralized, self-sovereign, and open source“* an; Blocks `ARCHITECTURE.md` stellt fest: *„The relay is the single source of truth. All reads and writes flow through it. There is no peer-to-peer event exchange, no gossip, no replication.“* Der Relay ist somit pro Community einzig und maßgeblich: Buzz' „Dezentralisierung“ ist eine **organisatorische Souveränität** — Self-Hosting und portable Identität — keine Netzwerkredundanz. Formulierung von **TFTC**: *„Two of those three hold cleanly. The third needs a qualifier.“* **(B) Eine Asymmetrie zwischen nachgewiesener Rigorosität und Ausnutzungsrisiko.** Auf der einen Seite ein für ein v0.4.x/0.5.x seltenes Maß an Formalismus: Spezifikation der Mandanten-Isolation **mechanisiert in TLA+**, in **Tamarin** verifizierte Autorisierungseigenschaften, ein modellgeprüftes Git-Speicherprotokoll, ein hash-verkettetes Append-only-Audit-Log, 127 *event kinds*, NIP-01/42/98/34. Auf der anderen Seite ist Kanalmitgliedschaft die Berechtigungseinheit — *„channel membership is not fine-grained tool authorization“* (João Queirós) —, Agenten laufen in `--dangerously-skip-permissions` außerhalb jeder Sandbox auf der Maschine eines Menschen, und die Beobachtbarkeit fehlt: *„Buzz tells me an agent got a message. It doesn't tell me what happens next“* (DevTools Daily, das stille OOM-Kills berichtet). Block räumt es ein: *„the agent can do anything, and security rests entirely on restricting who can tell it what to do“*. **(C) Der technische Stack**, der in den veröffentlichten Beiträgen fehlt: **Rust**-Relay (Axum WS + REST), **Postgres**, **Redis**, **S3/MinIO** via Blossom, Desktop-Client **Tauri + React**. Die Agentenintegration erfolgt über **`buzz-acp`**, ein **ACP**-Harness, das goose, Codex und Claude Code einbindet und **ACP ↔ MCP** übersetzt, sowie **`buzz-agent`**, einen hauseigenen Agenten. Der Report korrigiert sich an einem Punkt selbst: Die *„+33% more work“* in Blocks TL;DR sind das **Verhältnis abgeschlossener Aufgaben (20 gegenüber 15 von 44)**, kein Punktzahlgewinn — die Punktzahl selbst steigt von 59,1 % auf 71,5 %, also **+12,4 Punkte**.
#Buzz#buzz.xyz#Block
**Deep Research Veille Interne** — rapport non signé · produit le **12 août 2026** en préparation d'une présentation. Aucune URL publique ; source archivée dans `raw-data/`.
Ankündigung von **Google** am **6. August 2026**: Google tritt als **Core Maintainer** der Spezifikation **Agent Plugins 1.0.0** bei, einem offenen, *anbieterneutralen* Packaging-Format für die gemeinsame Verteilung von **Agent Skills** und **MCP servern**. Die Spezifikation wurde von einem **TSC** veröffentlicht, dessen Core Maintainer von **Amazon, Cursor, Microsoft, OpenAI und Vercel** stammen; Google tritt ihnen bei, vertreten durch **Kevin Hou** (Senior Staff Engineer, Google DeepMind). Die beiden gepackten Bausteine — Agent Skills und MCP — stammen von **Anthropic**, das auf dieser Liste der Maintainer nicht erscheint. **Die Diagnose** passt in einen Satz: *„The core problem isn't the components. It's the manifest.“* Ein Skill ist portabel, ein MCP server ist portabel; die Kiste, in der sie stecken, ist es nicht, und jeder Client musste sie sich selbst ausdenken — daher die Forks, die Kopien identischer Komponenten und ihr Auseinanderdriften. **Das Format** passt in eine Einschränkung: *„A plugin is a directory. That's the whole idea, and the restraint is the point.“* Eine `plugin.json` mit zwei nützlichen Zeilen (`$schema` und `name`), Skills in `skills/` im Agent-Skills-Format, servers deklariert in `mcp.json` mit einem **expliziten `type` bei jedem Eintrag** (stdio, Streamable HTTP oder das veraltete HTTP+SSE) — kein erratener Transport aus der Form des Konfigurationsobjekts mehr. Die Stärke des Designs liegt in dem, was das Manifest **nicht** kann: Komponenten weder verlagern noch inline deklarieren, sodass es keinen zu konfigurierenden Discovery-Pfad und keine zu erlernende Rangfolge gibt. Operatives Korollar: Komponenten **scheitern unabhängig voneinander** — ein `mcp.json`-server, der nicht startet, reißt nicht die Skills des Plugins mit sich; der Client überspringt den Eintrag, macht weiter und meldet den Fehler. Das akzeptierte Schlupfloch ist das **Reverse-Domain**-Verzeichnis (`com.example.client/`), ein Erweiterungsraum, der vollständig einem Client gehört (hooks, agents, commands) und von anderen Clients ignoriert wird: *„the portable core stays small because the non-portable parts have somewhere legitimate to go.“* Ein Abschnitt widmet sich Fällen, in denen das Format nicht gerechtfertigt ist — *„Not every skill should be a Plugin“*: ein einzelner MCP server für einen einzelnen Client, `mcp.json` genügt; ein einzelner Skill braucht kein Plugin. Was v1 unter *future considerations* ausdrücklich ausschließt: **kein Installationsmechanismus, kein Distributionsprotokoll, kein Berechtigungsmodell, keine Sandboxing-Anforderung, keine Vertrauens- oder Herkunftsprüfung, keine UX**. All das fügt sich in einen unabhängig adoptierbaren vierschichtigen Stack — **finden** (Agentic Resource Discovery), **beschreiben** (AI Catalog, das den Typ `application/agent-plugins+json` registrieren würde), **packen** (Agent Plugins), **ausführen** (MCP + Agent Skills). Zwei Google-Produkte liefern bereits aus: **Agents CLI** und **Data Agent Kit** (BigQuery, Spanner, Cloud SQL).
**Skill**-Eintrag: **hyperresearch** von **Jordan Gibbs** ist ein **Deep-Research-Harness**, das Claude Code in einen dokumentarischen Rechercheagenten verwandelt, ausgeliefert als PyPI-Paket (MIT, Python 3.11-3.13), das **20 Claude Code Skills**, eine CLI, einen MCP-Server und eine lokale Web-UI installiert. Stand **3. August 2026**: 1.568 Stars, 170 Forks, Repo erstellt am 9. April 2026, letzter Push am 1. August. **Der Kern ist eine 16-stufige, nach Tiers adaptive Pipeline** — `light` (~30-40 Min.), `full` (~1,5-2,5 Std.), `dissertation` (4-8 Std., 25.000-80.000 Wörter über 300-450 Quellen) — die einen Prompt entgegennimmt und einen adversarial geprüften Bericht mit vollständiger Provenienz zurückgibt. **Die zentrale Architekturentscheidung ist zusammen mit ihrem Fehlermodus dokumentiert**: Der Einstiegs-Skill ist ein **schlanker Router** ohne eigene Prozedur, wobei jeder Schritt in seinem eigenen Skill lebt, der **frisch im Moment seines Aufrufs** geladen wird, weil die Vorgängerversion *„ein einzelner 1200-Zeilen-Skill war, der komprimiert wurde, bevor Layer 4 seine Dreifachentwurf-Prozedur brauchte. Der Orchestrator vergaß die Prozedur, schrieb einen einzigen Entwurf und produzierte einen Bericht mit flacher Bewertung“* war. **Zwei tragende Prinzipien.** *„Patchen, niemals neu erzeugen“*: Nach der Synthese sind nur chirurgische `Edit`-Nachbesserungen möglich, wobei der Patcher und der Politur-Auditor auf Ebene der Claude-Code-Allowlist auf `[Read, Edit]` werkzeugseitig gesperrt sind, sodass sie *„physisch keinen neuen Entwurf schreiben können“*. *„Die kanonische Recherchefrage ist Gesetz“*: Der wortgetreue Prompt wird einmal in `query.md` persistiert und von jedem Schritt und jedem Subagenten erneut gelesen. **Sechzehn Subagenten** mit konfigurierbarer Rolle und Modell (Fetcher und Cite-Checker auf Sonnet, Kritiker, Synthesizer und Patcher auf Opus). **Der Vault** ist ein persistenter, in SQLite indizierter Markdown-Speicher — *„Markdown ist Wahrheit, SQLite ist Cache“* — mit einem Notiz-Lebenszyklus (`draft → review → evergreen`, `stale → deprecated → archive`), nachvollziehbarer Provenienz, einem zusammengesetzten Qualitätsscore (Quellentyp, Zitationsautorität via OpenAlex und Semantic Scholar mit Retraction-Flags, internem PageRank) und einem **Unabhängigkeitsaudit**, das syndizierte Kopien zusammenfasst — *„fünf Nachdrucke einer Pressemitteilung wiegen so viel wie eine Quelle“*. **Drei mechanische Schranken vor der Auslieferung**: Zitationsintegrität (jedes zitierte Zitat muss **wortgetreu** in einer Vault-Notiz existieren), ein bei jeder zitierten DOI aufgefrischter Retraction-Sweep und eine Zitat-zu-Satz-Verknüpfungsprüfung durch ein skeptisches LLM. **Zu markierender Vorbehalt**: Die Eingangsbehauptung — *„führt derzeit das DeepResearch-Bench-RACE-Ranking an“* — wird durch ihre eigene Fußnote widerlegt, *„zukunftsgerichtete Projektion aus einem stratifizierten Pilotversuch … Eine Drittvalidierung steht noch aus“*. Eine Projektion ist kein Ranking, dennoch platziert das Diagramm sie vor Gemini und OpenAI Deep Research.
#Skill#Deep Research#Research-Harness
**Jordan Gibbs** — auteur et mainteneur du dépôt `jordan-gibbs/hyperresearch`. Le projet est distribué sous **licence MIT** et publié sur **PyPI** (`pip install hyperresearch`). Signaux d'adoption au 3 août 2026 : **1 568 étoiles** · **170 forks** · 13 issues ouvertes · dépôt créé le **9 avril 2026** et poussé le **1er août 2026** — soit une traction rapide sur moins de quatre mois. Topics déclarés : `agents` · `agentskills` · `claude-code` · `deep-research` · `deep-research-agent`.
Landingpage der **offiziellen Spezifikation** des **Agent Client Protocol (ACP)** (`agentclientprotocol.com/get-started/introduction`), abgerufen am **2. August 2026**. Es handelt sich nicht um einen datierten Artikel, sondern um ein **lebendes Artefakt**: Die Fiche ist nach ihrem Beobachtungszeitpunkt datiert, nicht nach einem Veröffentlichungsdatum. **Ein-Satz-Missionsaussage**: *« The Agent Client Protocol (ACP) standardizes communication between code editors/IDEs and coding agents and is suitable for both local and remote scenarios. »* **Das genannte Problem** lässt sich in drei Zeilen fassen: Coding Agents und Editoren sind **eng gekoppelt**, und *« interoperability isn't the default »* — jeder Editor muss für jeden Agenten eine eigene Integration bauen, jeder Agent muss editorspezifische APIs implementieren. Drei benannte Konsequenzen: **Integrationsaufwand** (jedes Agent-Editor-Paar erfordert individuelle Arbeit), **eingeschränkte Kompatibilität** (ein Agent erreicht nur eine Teilmenge der Editoren), **Developer-Lock-in** (*« choosing an agent often means accepting their available interfaces »*). **Die Lösung ist explizit an LSP orientiert** — *« similar to how the Language Server Protocol (LSP) standardized language server integration »* — mit gegenseitigem Nutzen: Ein Agent, der ACP spricht, funktioniert mit **jedem** kompatiblen Editor, ein Editor, der ACP unterstützt, erhält Zugang zum **gesamten** ACP-Agenten-Ökosystem. **Zwei Deployment-Modi, und das ist der am meisten unterschätzte Punkt**: **Lokale** Agenten laufen als Subprozess des Editors über **JSON-RPC auf stdio**, aber **Remote**-Agenten sind über **HTTP oder WebSocket** geplant — die Unterstützung wird als *« work in progress »* deklariert, mit laufender Zusammenarbeit mit agentischen Plattformen. **Technische Abstammung von MCP, stärker als bloße Komplementarität**: ACP *« re-uses the JSON representations used in MCP where possible »* und ergänzt Typen, die spezifisch auf die UX-Bedürfnisse des agentischen Codings zugeschnitten sind (die **Diff**-Anzeige wird als Beispiel genannt); das Standardformat für lesbaren Text ist **Markdown**, gewählt, damit der Editor nicht zum Rendern von HTML gezwungen ist. **Zwei Beobachtungen zu Governance und Versionierung**, die der Seite selbst entnommen sind, nicht dem umgebenden Diskurs: Die Navigation zeigt **v1 (Latest)** und **v2 (Draft)** — und **nicht ein „ACP 1.2“** —, und die Navigationsleiste verlinkt **Zed Industries *und* JetBrains** gleichrangig nebeneinander, neben einer **ACP Registry**, **RFDs**, einem **Community**-Bereich, **Publications**, **Updates** und einer **Brand**-Seite. Angekündigte offizielle Bibliotheken: **Kotlin, Java, Python, Rust, TypeScript**, plus ein Community-Track.
#Agent Client Protocol#ACP#offenes Protokoll
**Projet Agent Client Protocol** — spécification collective · sans signature individuelle sur cette page. La barre de navigation du site lie deux organisations au même niveau : **Zed Industries** (à l'origine du protocole) et **JetBrains**. La présence d'une section **RFDs** (*requests for discussion*) · d'une page **Community** et d'un **ACP Registry** indique une structure de gouvernance ouverte plutôt qu'une documentation produit.
Tech-Watch-Notiz von **Didier Girard** vom **2. August 2026**, ausgelöst durch die Frage eines Kollegen ("Was ist ACP?"), die ein Problem behandelt, das nicht terminologisch, sondern **dokumentarisch** ist. **Drei Protokolle konkurrieren um das Akronym**, ohne jede technische Überschneidung: **Agent Client Protocol** (Client ↔ Agent — Zed, August 2025, JSON-RPC 2.0 über stdio, Apache-2.0, "das, was LSP für Sprachen war"), **Agentic Commerce Protocol** (Agent ↔ Händler — OpenAI + Stripe, 29. Sept. 2025, in Konkurrenz zu Googles **UCP** vom 11. Jan. 2026, gestützt auf **AP2**), und **Agent Communication Protocol** (Agent ↔ Agent — IBM Research / BeeAI, marginal, aber suchverfälschend). **Der Kern der Notiz ist nicht die Entwirrung, sondern das beobachtete Scheitern**: Der Autor sucht "ACP" in seiner Tech-Watch-Wissensdatenbank und erhält **zwölf Treffer, alle zum Commerce-Protokoll, keinen zu dem von Zed** — *"unsere Watch-Agenten hatten das Akronym indexiert, ohne es zu disambiguieren"*. Daraus folgt eine Regel des Knowledge Engineering: ***"ein nacktes Akronym wird nie indexiert"*** — die Entität ist "Agent Client Protocol", "ACP" ist **nur ein Alias**, getragen von drei verschiedenen Entitäten. Es folgt eine strukturierende Klarstellung (**MCP verbindet einen Agenten mit seinen Tools, ACP verbindet einen Client mit einem Agenten; beide stapeln sich**), dann der Lehrbuchfall: **Buzz**, von **Block** am 21. Juli 2026 unter Apache-2.0 veröffentlicht — ein selbst hostbarer Arbeitsbereich auf Basis von **Nostr**, in dem jeder menschliche oder agentische Teilnehmer ein **Schlüsselpaar** ist und jede Nachricht, jeder Workflow-Schritt oder Git-Push ein **signiertes Ereignis** in einem Append-only-Log ist. Eine vollständig protokollbasierte Architektur (`buzz-acp` ein ACP-Harness über stdio, `buzz-agent` ein ACP-Agent, der ein LLM aufruft, `buzz-dev-mcp` ein MCP-Shell- + Editier-Server), daher Agenten-Agnostizismus: **Goose, Claude Code und Codex** docken über dasselbe Harness an, und **Hermes** (Nous Research) hat sich damit verbunden, ohne dass Block eine einzige Zeile geschrieben hätte — *"N+M statt N×M, im Produktivbetrieb"*. Die Notiz schließt mit der Frage des **Claude-Abonnements** gegenüber Drittanbieter-Agenten, mit einer fünfstufigen 2026er-Zeitleiste und einer **Gestaltungsregel**, die über diesen Fall hinaus gilt: Die Grenze ist nicht rechtlicher, sondern **architektonischer** Natur — ***"wer konsumiert, und in wessen Auftrag"*** (ein `owner-only`-Agent verbraucht Ihr Abonnement in Ihrem Auftrag; ein `anyone`-Agent in einem gemeinsamen Kanal leitet die Anfragen Ihrer Kollegen über Ihr Konto). **Am vorliegenden Korpus durchgeführte Überprüfung**: Die These bestätigt sich, und schärfer noch, als die Notiz behauptet — nicht nur ist "Agent Client Protocol" **vollständig abwesend**, sondern das nackte Akronym `ACP` **ist bereits als Entität typisiert** in zwei Fiches, und die KB-Seite `Agentic-Commerce-Protocol` **schreibt das Protokoll bereits Google zu**, obwohl es OpenAI + Stripe gehört. Die beschriebene Kollision ist kein zukünftiges Risiko: Sie hat **bereits einen Zuschreibungsfehler** im Graphen erzeugt.
**Didier Girard** — auteur de la note. Écrit ici depuis la position de **praticien de la veille outillée** : le déclencheur est une question de collègue · le matériau principal est le comportement observé de sa propre base de connaissances · et la conclusion est une **règle de curation** adoptée en interne. Le texte alterne donc deux voix — l'explicateur de protocoles et l'ingénieur de la connaissance qui constate un défaut chez lui et en tire une norme.
Referenzseite, veröffentlicht auf **eventuallycoding.com** am **28. Juli 2026** von **Hugo Lassiège** (Lyon, vom Entwickler zum Unternehmer, Autor von Bloggrify, Hakanai und Writizzy). Der Autor kündigt sie selbst so an: *„Das wird eher eine Referenzseite als ein Artikel sein“*, gedacht für seine eigene Ressourcenseite. **Thema**: eine erschöpfende, werkzeuggestützte Beschreibung einer **Solo-Softwarefabrik**, in der *„der produzierte Code inzwischen fast zu 100 % generiert ist“*, über mehrere polyglotte Monorepos hinweg (Nuxt, Kotlin, JS — Hakanai, Writizzy, Bloggrify) in **kontinuierlicher Auslieferung in Produktion**. **Vorab getroffene Unterscheidung**: Dies ist kein **vibe coding** im Sinne von Karpathy (Experimentieren, sich treiben lassen), sondern **context engineering** — *„den gesamten notwendigen Kontext zum richtigen Zeitpunkt geben, damit die Software einer Absicht entspricht und systematisch kontrolliert wird“*, mit dem Satz, der die Verantwortung begründet: *„Auch wenn ich den Code nicht schreibe, bin ich dafür verantwortlich und muss die Kontrolle darüber behalten.“* **Das gesamte Werkzeug-Set beantwortet drei Fragen**, und das ist das am besten wiederverwendbare Lese-Raster des Textes: *„Was weiß der Agent?“* (Kontext, Gedächtnis, Code-Graph) — *„Was kann er deterministisch, ohne zu improvisieren?“* (Skills, Prozeduren) — *„Was stoppt ihn, wenn er einen Fehler macht?“* (Hooks, Architekturtests, Qualitäts-Gates). **Sechs im Detail beschriebene Schichten**: (1) **Kontext** — Wurzel-`CLAUDE.md` + themenbezogene `.claude/rules/*.md`, bedingt geladen über `paths:` + `.agents/*.md` für nicht-technische Belange (Personas, Positionierung, Tonalität); (2) **Skills** — rund dreißig, Existenzkriterium *„wenn ich dasselbe ein drittes Mal erkläre“*; (3) **Tools** — JetBrains-IDE-MCP, **GitNexus** (Code-Graph: `impact(symbol)`, `detect_changes()`), Claude-mem, RTK-Filter-Wrapper, Sentry, schreibgeschützte Datenbank; (4) **ausführbare Leitplanken** — Harness-Hooks, **Architekturtests**, Pattern-Linting (**ast-grep** für Architekturentscheidungen, nicht nur ESLint); (5) **Fabrik** — blockierendes Qualitäts-Gate mit `needs:` auf dem Qualitäts-Job, fünf Teststufen; (6) **Produktprozess** — nummerierte Specs mit einem Skill zum Verfassen **und einem Skill zum Abschließen**, Design in Claude Design, gestufte Auslieferung hinter Feature-Flags, Unterscheidung zwischen **Feature Flipping** (Unleash) und **Gating** (Kundenvertrag). **Die Regel, die alles zusammenfasst**: *„Was zählt, muss ausführbar sein. Eine Anweisung wird ‚meistens‘ befolgt … Ein Hook oder ein Test wird immer befolgt.“* **Eine Seltenheit für dieses Genre**: ein Abschnitt „Zu verbessern“, der vier gelebte Einschränkungen offenlegt — die **Unmöglichkeit, die Veralterung einer Regel zu messen** (*„Ich habe keine Möglichkeit zu wissen, ob eine alte Regel obsolet geworden ist“*), das **Kaninchenloch**, das durch eine Boyscout-Regel entsteht, das **Fehlen einer Paketierung** von Skills über Projekte hinweg, und vor allem das Eingeständnis der Spannung: *„Ich werde in den Implementierungsphasen immer weniger nützlich“*, *„hin- und hergerissen zwischen der Zufriedenheit, eine immer effizientere Fabrik zu haben, und dem Risiko, Wissen zu verlieren.“*
#Softwarefabrik#context engineering#vibe coding
**Hugo Lassiège** — développeur devenu entrepreneur · basé à **Lyon** · écrit du code depuis 2001 et tient **eventuallycoding.com** (le blog a porté le nom `hakanai.free.fr` avant de devenir *Eventuallycoding* en 2013). *Eventuallycoding* est le nom-parapluie qui regroupe ses projets · sa chaîne YouTube et ses blogs.
Analyse von Janakiram MSV (The New Stack, 20. Juli 2026) über die **architektonische Konvergenz** der Enterprise-Agentenplattformen der drei Hyperscaler: Innerhalb von neun Monaten haben sich **Amazon Bedrock AgentCore**, **Microsoft Foundry** und die **Gemini Enterprise Agent Platform** auf **dieselben sechs Primitiven** geeinigt — Runtime, Memory, Tool-Gateway, Identität, Observability, Governance — unter unterschiedlichen Markennamen. Was vor 18 Monaten noch eine fragmentierte Sammlung von Bibliotheken war, wird zu einer eigenständigen **Plattformschicht**. Die These: Diese Konvergenz wiederholt die **PaaS-Wende von 2011–2016**, als **Cloud Foundry** und **Heroku** VMs, Load Balancer, Warteschlangen und Secret Stores um einen portablen **Anwendungsvertrag** herum vereinheitlichten — nur dass hier **noch kein gleichwertiger Vertrag existiert** und **kein Open-Source-Projekt ihn für sich beansprucht hat**. Konsequenz: Ein Unternehmen kann **einen Agenten nicht von einer Cloud in eine andere verschieben** (Sitzungszustand, Traces und Identität landen allesamt bei einem einzigen Anbieter; eine Migration bedeutet, alles neu aufzubauen). Der Autor schlägt eine **zeilenweise Abbildung** des Cloud-Foundry-Vertrags auf Agenten vor, formuliert drei Gestaltungsprinzipien (den Agenten als **eine einzige deploybare Einheit** verpacken, Fähigkeiten **anhängen** statt Anbieter einzubetten, die **operative** Schicht in die Abstraktion integrieren), zeigt auf, was offene Protokolle (MCP, A2A, OpenTelemetry) außen vor lassen — den **Lebenszyklus** — und liefert drei Due-Diligence-Fragen: **Governance** (neutrale Foundation vs. Anbieter), **Packaging** (dasselbe Artefakt auf zwei Clouds ohne Neuschreiben), **Zustand** (exportierbares Memory). Fazit: Wer am Ende die **Agenten-Control-Plane** besitzt, wird definieren, *was ein Agent ist*.
**Wiederkehrender Bericht von Mozilla**, *The state of open source AI*, **v1.0.1, Juli 2026**, eingeleitet durch einen Brief von **Raffi Krikorian** (CTO): sieben Abschnitte, eine interaktive Website und ein herunterladbarer Bericht. These, formuliert im Titel von Abschnitt 1: *« The model layer has commoditized. Value accrues to the harness above it. »* **Fähigkeitsstand**: Auf dem *Artificial Analysis Intelligence Index v4.1* erzielt das beste geschlossene Modell **61** Punkte (Claude Opus 5) und das beste offene Modell **57** (**Kimi K3**), Rang vier insgesamt und vor drei der größten geschlossenen Labore; auf dem *Epoch Capabilities Index* beträgt der Abstand **6 Punkte** (K3 bei 156 gegenüber GPT-5.6 Sol bei 162), beschrieben als *« about one release cycle »*, bei sich überlappenden Konfidenzintervallen. **Sägezahnförmige Frontier**: Offene Modelle führen bei Frontend-Code (K3 mit 1.679 Elo in der LMArena Frontend Code Arena, sechs von sieben Domänen), liefern sich ein Kopf-an-Kopf-Rennen bei agentischer Terminalarbeit (88,3 gegenüber 88,8 im Terminal-Bench 2.1) und geben bei professioneller Wissensarbeit Boden ab (Fable 5 führt vor K3 mit 92 Elo im GDPval-AA v2). **Nutzungsverschiebung**: Der Anteil der über OpenRouter geleiteten Tokens, die an Open-Weight-Modelle gehen, stieg von einem vernachlässigbaren Niveau auf ein Drittel Ende 2025 und dann auf eine **Mehrheit bis Mitte 2026**, wobei die sieben Modelle mit dem höchsten Volumen alle offen gewichtet sind — der Bericht selbst merkt an, dass *« by request count, closed US providers still lead »*, wobei der Vorsprung der offenen Modelle ein Vorsprung beim Token-Volumen ist, der sich auf Coding- und agentische Workloads konzentriert. **Der zentrale Gegensatz**: *« Open ships easy. Open deploys hard. »* — 79 % der Entwickler, die KI einführen, nutzen offene Modelle gegenüber 71 % bei geschlossenen, aber nur **53 %** der Teams mit offenen Modellen erreichen die Produktion **gegenüber 63 %**, und die Lücke wächst mit der Organisationsgröße (geschlossen 54 % → 73 %, offen 53 % → 57 %), was *« rules out a resources explanation »*. Die Reifegradkarte des Stacks (48 Komponenten, 9 Schichten) zeigt zwei durchgängig kalte Spalten — **Standardisierung** und ***Enterprise Readiness*** — identifiziert als die operative Lücke. **Abschnitt 5**: *« The agentic harness is another user agent »*, und *« The model is eating the harness »* — bei jedem Modell, für das beide Varianten existieren, gewinnt inzwischen der Harness des jeweiligen Labors selbst, wobei sich die Lücke von 21,8 Punkten auf etwa 3 verringert hat. Daher die Formel: *« A harness tuned tightly to one lab's weights… degrades on anyone else's model, so the tighter the tuning, the less swappable the weights underneath. Lock-in arrives as a side effect of optimization. »*
#Mozilla#state of open source AI#Open Weights
**Mozilla** — éditeur du rapport · avec une introduction signée **Raffi Krikorian** · *Chief Technology Officer*. Publié en **juillet 2026** (v1.0.1). Données issues de sources tierces créditées (Artificial Analysis, Epoch AI, OpenRouter, LMArena) et d'une enquête propre menée avec **SlashData** (*Mozilla / SlashData 2026 developer survey*, n = 1 410 sur la question des freins).
Fundierter technischer Leitfaden (Blog der Agentur Lushbinary) zum **Loop Engineering**: Gestaltung der Systeme, die Coding-Agenten in einer Schleife steuern, statt sie manuell zu prompten. Behandelt die Genealogie Prompt → Context → Loop Engineering, die Ralph-Technik (Geoffrey Huntley), die **fünf Bausteine + Memory** einer Loop, ihre Umsetzung in Claude Code und OpenAI Codex, das Schreiben überprüfbarer Abbruchbedingungen, eine Reifegradskala für die Einführung sowie die Risiken, die mit zunehmender Ausgereiftheit der Loops zunehmen. Bereich: agentisches Software-Engineering, Coding-Agenten, Harness/Orchestrierung.
Sonntäglicher Tüftler-Beitrag von **Mark Dembo** (Head of Solutions, Developer Platform & AI bei **Cloudflare**), veröffentlicht am **7. Juni 2026** auf seinem persönlichen Blog. **Erzählung**: Inspiriert von **Steve Ruiz** kauft sich der Autor ein kleines Gerät **M5Stack Stick 3** (~30 €) und baut sich, die Veröffentlichung von **Opus 4.8** nutzend, einen **DIY-KI-Agenten** „aus reiner Neugier, ohne Ziel". **Iteration 1 (45 Min.)**: Er wirft die Dokumentation des Geräts **Claude Code** vor, das Python-Skripte (~200 LOC, *„zero blast radius“*) generiert, die das Wetter in München und dann in mehreren Städten anzeigen; ein **Cloudflare Workers + Workers AI Backend** ergänzt **Text-to-Speech (TTS)**, **Push-to-Talk** (Speech-to-Text) und ein zentrales **kleines LLM** zur Beantwortung von Fragen. **Iteration 2 (ein echter Agent)**: Umstellung der REST-Endpunkte auf **WebSocket**-Transport via **Cloudflare Agents SDK** + **Dynamic Worker execution** → das Muster ***„Code Mode“*** (der Agent schreibt und führt Code aus, um seine Aufgabe zu erledigen). Der Agent beantwortet daraufhin Fragen zu öffentlichen Daten (11! = Fakultät, der Champions-League-Sieger via `fetch()` auf Wikipedia, das Wetter für eine beliebige Stadt). **Iteration 3 (echte Befugnisse)**: Verbindung zu **Todoist** über einen **MCP OAuth**-Flow → 50 Tools auf einmal, daher zwei Probleme: **Context Bloat** und **echtes Schadensrisiko**. Die Lösung stützt sich auf Cloudflares **MCP Server Portal** + die Claude-Connector-Einstellungen: pro Tool **Always allow / Ask for approval / Disable** (*Disabled*-Tools gelangen nie in den Kontext; ein **LLM-Klassifikator** akzeptiert nur eindeutige „Allow“-Freigaben und **verweigert standardmäßig**). **Erklärte Haltung**: Reduzierung seiner Rolle auf ***„idea generator, executor and judge“*** (und selten technischer Anleiter), ein „Human-in-the-Loop“-Ablauf, den er als wenig *„2026“* empfindet (Copy-Paste in UIFlow). **Was er NICHT getan hat**: keine Latenz-/Streaming-Optimierung, keine optimistischen LLM-Aufrufe, keine Evals, ***„I did not even look at the code once.“*** **Verwunderung**: 30 € + ein Anthropic-Session-Fenster + ein paar Cent Cloudflare-Inferenz → ein Objekt, das zuhört und spricht, gesteuert in natürlicher Sprache; *„the true unlock is how accessible it is.“* Scharfer Kontrast zu [[thomas-pragdave-failing-faster-code-rot-ai-velocity-2026-06-06]] (hier rechtfertigt *„zero blast radius“*, den Code nie anzusehen); illustriert konkret *Code Mode* / *„the agent just writing and executing code,“* das **MCP**-Muster ([[claude-skills-bigger-than-mcp-willison-2025-10-16]]), *Ask for approval*-artige Tool-Governance (uber-engineering-agent-identity-crisis-zero-trust-spire-2026-05-21) sowie die Doktrin der *systems around the model* aus dropbox-okumura-beyond-code-generation-engineering-productivity-ai-agents-2026-05-28.
#BYO Agent#eigene KI mitbringen#Tüfteln
**Mark Dembo** (@darkmembo / @mdembo) · **Head of Solutions – Developer Platform & AI** chez **Cloudflare** (auparavant auteur sur le blog Cloudflare). Billet personnel publié sur son blog *markpauldembo.com* le **7 juin 2026** (description : *« Thoughts about tinkering on a Sunday »*).
Blogbeitrag von **Pasquale Pillitteri** (Softwareingenieur, Palermo), veröffentlicht am **29. Mai 2026** (FR-Version), 18 Minuten Lesezeit, Rubrik *Claude Code & Anthropic*. **Kernthese**: *« Claude Opus 4.8 ist das leistungsstärkste SEO-Modell des Jahres 2026, aber fast alle nutzen es falsch »* — kein Modellproblem, sondern ein **System**-Problem. Die goldene Regel: ***« Strategie ist ein Whiteboard, Produktion ist ein Fließband »*** — SEO muss **in zwei getrennte Phasen aufgeteilt werden**, und deren Vermischung ist *« der schnellste Weg, ein Modell zu verschwenden, das fünf Dollar pro Million Input-Token und fünfundzwanzig für Output kostet »*. **Modellkontext**: Opus 4.8 veröffentlicht am **28. Mai 2026** (41 Tage nach Opus 4.7), **1-Mio.-Token**-Kontext, **GraphWalks Long-Context F1 bei 1M: 40,3 % → 68,1 %**, **SWE-bench Verified 88,6 %**, **USAMO 2026 96,7 %** (+27,4 Punkte), **HLE with tool 57,9 %**, unveränderter Preis **5 $/25 $** pro Mio. Token, **Fast Mode 2,5× zu 10 $/50 $**, vier **Aufwandsstufen** (Low, High, Extra, Max). **Das zentrale Anti-Pattern** = *« das riesige Gespräch »* / **Context Drift**: die Vermischung von Strategie, Keyword-Recherche, Wettbewerbsanalyse und Texterstellung in einem einzigen Chat erzeugt einen *« Brei widersprüchlicher Absichten »* → das Modell driftet zu **generischen Best Practices** („holistic optimization“, „strategic approach“) statt zu datenverankerten Inhalten. **Phase 1 – Strategie (Whiteboard, visuelle UI, einmalig)**: Dashboard / Google Sheet / Claude.ai-Canvas, um gemeinsam anhand der Daten zu entscheiden. **3 Spielzüge**: (a) **klassifizierte Keyword-Recherche** (Tabelle mit Volumen / Schwierigkeit 0-100 / Intent / Geschäftspotenzial / Priorität = Volumen÷Schwierigkeit×Geschäftsgewichtung); (b) **visuelle Wettbewerbsanalyse** (Themenabdeckungs-Matrix, Lücken); (c) **phasenweise Roadmap** (Quick Wins M1-2 / mittelfristig M3-6 / Pillar-Seiten M7-12). Der **Extra/Max**-Modus ist hier gerechtfertigt (*« eine richtige strategische Entscheidung ist tausend gut geschriebene Seiten zu den falschen Keywords wert »*). 3 abgeschlossene Artefakte, gespeichert in Notion/Drive. **Phase 2 – Produktion (Fließband, Opus 4.8 + MCP)**: Das Modell wandelt sich vom Strategen zur **Ausführungsmaschine**; jede Entscheidung wird über das **Model Context Protocol** in **Live-Daten verankert**. **Minimaler MCP-Stack**: **GSC MCP** (AminForou/mcp-gsc, 500+ Stars), **offizieller Ahrefs MCP** (98 Stars), **GA4 MCP**; das Repo `modelcontextprotocol/servers` = **86.440 Stars**, **10.000+ aktive Server**, 97 Mio. SDK-Downloads/Monat. Setup ~35 Min., monatliches Refresh ~20 Min. **Wöchentliche Schleife**: ein einziger Prompt zieht Live-Daten, erstellt das Brief (Top-10-SERP + GSC + Ahrefs), leitet H2/H3 ab, schreibt, prüft die Dichte, schlägt Titel vor → **+45 % Produktivität**, Entwurf in **6-12 Min.** (expliziter Verweis auf **Ryan Law / Ahrefs Content Engineering**, 23 Skills). Erwähnt Anthropics **Dynamic Workflows** (bis zu 1.000 Subagenten). **4 häufige Fehler**: (1) die Zahlen nicht zu überprüfen (Stichprobenkontrolle verpflichtend, *trust & verify*); (2) Semrush/Ahrefs vollständig zu ersetzen (MCP ist eine **zusätzliche Schicht**, kein Ersatz); (3) die **Paid-Organic-Content-Lücke** zu ignorieren (Kundenfall aus dem Bildungsbereich: **2.742 verschwendete Begriffe / 351 Chancen** in 90 s identifiziert); (4) Opus 4.8 dort einzusetzen, wo **Haiku 4.5** ausreicht (Meta-Beschreibungen, Alt-Texte). **Kosten**: 1-3 $ pro Artikel mit 2.500 Wörtern. **Sonnet 4.6** genügt für die laufende Produktion, Opus 4.8 bleibt der Strategie vorbehalten. SEO-optimierter und selbstreferenzieller Artikel (der Autor schreibt über SEO in einem Inhalt, der selbst darauf ausgelegt ist, für „Opus 4.8 SEO“ zu ranken). Direkte Konvergenz mit **Ryan Law/Ahrefs** (zitiert), **Systemen rund um das Modell** (Dropbox/Okumura), **Skills-over-Prompts** (Lattice), Haiku/Sonnet/Opus-Modell-Routing (Gupta Token-to-Outcome).
#Claude Opus 4.8#KI-SEO#Zweiphasen-Workflow
**Pasquale Pillitteri** — Ingénieur informatique / développeur logiciel basé à **Palerme** (Italie) · certifié Innovation Manager UNI 11814:2021. Auteur d'un blog tech actif (rubrique *Claude Code & Anthropic*) · avec une newsletter hebdomadaire (~3,4k lecteurs). Article publié en version **FR** le **29 mai 2026** (lendemain de la sortie d'Opus 4.8).
Manifest-artiger Artikel von **Thariq Shihipar** (Engineer & Serial Entrepreneur, Claude Code Team bei Anthropic), der eine **Änderung des Standard-Ausgabeformats für Agenten** ankündigt: die Ablösung von **Markdown durch HTML**. These: Markdown war das dominante Format zwischen Menschen und Agenten (einfach, portabel, editierbar, lesbar), ist aber zu **einem Engpass** geworden, da Agenten längere und reichhaltigere Artefakte produzieren (Specs, Pläne, Berichte, Code-Reviews). Jenseits von ca. 100 Zeilen liest niemand mehr eine Markdown-Datei. HTML löst sechs Einschränkungen gleichzeitig: **Informationsdichte** (Tabellen, CSS, SVG, Skripte, Canvas, Bilder), **visuelle Klarheit** (navigierbares, mobil-responsives Layout), **einfaches Teilen** (ein S3-Link, direkt im Browser öffenbar), **bidirektionale Interaktivität** (Schieberegler, Regler, „Copy as JSON/Prompt“-Buttons zur Rückkopplung in Claude Code), **native kontextuelle Aufnahme** (Claude Code liest die Codebasis + MCP Slack/Linear + Git-Historie + Chrome) und **Freude an der Nutzung** (der Autor stellt ausdrücklich fest: *„it's joyful“*). Fünf kanonische Anwendungen im Detail: (1) **Specs/Pläne/Exploration** in einem vergleichenden Raster, (2) **PR-Review** mit inline annotiertem Diff, (3) **Design & Prototypen** mit Animations-Schiebereglern, (4) **Berichte/Recherche/Lernen** (der Autor ließ einen Prompt-Caching-Explainer aus der Git-Historie generieren), (5) **maßgeschneiderte Wegwerf-Editoren** (Drag-and-Drop von Linear-Tickets, Feature-Flag-Editoren, Side-by-Side-Prompt-Tuner), die einen re-injizierbaren „Copy as Markdown/Diff/JSON“-Export erzeugen. Explizites Anti-Pattern: *„I'm a little bit afraid that people will read this article and turn it into a /html skill“* — der Autor **lehnt eine vorschnelle Skill-ifizierung ab** und empfiehlt stattdessen Prompting von Grund auf („make a HTML file“). Pragmatisches FAQ: Token-Kosten werden durch den 1-Mio.-Kontext von **Opus 4.7** absorbiert, 2-4× längere Generierungszeit, verrauschte HTML-Diffs (ein realer Nachteil), Stil wird über ein HTML-Referenz-Designsystem im Zaum gehalten.
#HTML#Markdown#Ausgabeformat
Thariq Shihipar (Engineer & serial entrepreneur, équipe Claude Code chez Anthropic — site : thariqs.github.io/html-effectiveness ; X : @trq212)
Google-Whitepaper (die Folge „Day 1“ einer Reihe von Addy Osmani, Shubham Saboo und Sokratis Kartakis), das den Wandel des Software-Entwicklungszyklus (SDLC) im Zeitalter von Coding-Agenten nachzeichnet. These: Der grundlegende Wandel ist keine neue Sprache, sondern der Übergang vom Schreiben von Code zum **Ausdrücken von Absicht**. Das Dokument entwirft ein Spektrum, das von *vibe coding* (Prompten und Akzeptieren) bis zu *agentischem Engineering* reicht (die KI setzt unter von Menschen entworfenen Einschränkungen, Tests und Feedback-Schleifen um), mit **context engineering** als zentraler Fähigkeit, dem Modell der **Software-Fabrik** (das eigentliche Liefergut der Entwickler ist das System, das den Code produziert), **Harness Engineering** (Agent = Modell + Harness) sowie einer CapEx/OpEx-Wirtschaftlichkeitsanalyse der Gesamtbetriebskosten.
Cat Wu und Boris Cherny (Anthropic) erklären, wie man Claude Code so nutzt wie seine Schöpfer: Antfooding, Plan-Modus, Subagents, Hooks und Erweiterbarkeit — Every's Podcast AI & I
#Claude Code#Cat Wu#Boris Cherny
Rhea Purohit (interviewer: Dan Shipper) · Cat Wu · Boris Cherny
Block/Goose — MCP-UI and the Future of Agentic Interfaces: interaktive Webkomponenten in Konversationen mit KI-Agenten via Model Context Protocol (block.github.io)