Zum Inhalt springen

root / tags / exploration

#exploration

2 Fiches

KI-Coding-Agenten & Skills Automatisch geprüfte Übersetzung

BYO Agent with M5Stack Stick 3

Sonntäglicher Tüftler-Beitrag von **Mark Dembo** (Head of Solutions, Developer Platform & AI bei **Cloudflare**), veröffentlicht am **7. Juni 2026** auf seinem persönlichen Blog. **Erzählung**: Inspiriert von **Steve Ruiz** kauft sich der Autor ein kleines Gerät **M5Stack Stick 3** (~30 €) und baut sich, die Veröffentlichung von **Opus 4.8** nutzend, einen **DIY-KI-Agenten** „aus reiner Neugier, ohne Ziel". **Iteration 1 (45 Min.)**: Er wirft die Dokumentation des Geräts **Claude Code** vor, das Python-Skripte (~200 LOC, *„zero blast radius“*) generiert, die das Wetter in München und dann in mehreren Städten anzeigen; ein **Cloudflare Workers + Workers AI Backend** ergänzt **Text-to-Speech (TTS)**, **Push-to-Talk** (Speech-to-Text) und ein zentrales **kleines LLM** zur Beantwortung von Fragen. **Iteration 2 (ein echter Agent)**: Umstellung der REST-Endpunkte auf **WebSocket**-Transport via **Cloudflare Agents SDK** + **Dynamic Worker execution** → das Muster ***„Code Mode“*** (der Agent schreibt und führt Code aus, um seine Aufgabe zu erledigen). Der Agent beantwortet daraufhin Fragen zu öffentlichen Daten (11! = Fakultät, der Champions-League-Sieger via `fetch()` auf Wikipedia, das Wetter für eine beliebige Stadt). **Iteration 3 (echte Befugnisse)**: Verbindung zu **Todoist** über einen **MCP OAuth**-Flow → 50 Tools auf einmal, daher zwei Probleme: **Context Bloat** und **echtes Schadensrisiko**. Die Lösung stützt sich auf Cloudflares **MCP Server Portal** + die Claude-Connector-Einstellungen: pro Tool **Always allow / Ask for approval / Disable** (*Disabled*-Tools gelangen nie in den Kontext; ein **LLM-Klassifikator** akzeptiert nur eindeutige „Allow“-Freigaben und **verweigert standardmäßig**). **Erklärte Haltung**: Reduzierung seiner Rolle auf ***„idea generator, executor and judge“*** (und selten technischer Anleiter), ein „Human-in-the-Loop“-Ablauf, den er als wenig *„2026“* empfindet (Copy-Paste in UIFlow). **Was er NICHT getan hat**: keine Latenz-/Streaming-Optimierung, keine optimistischen LLM-Aufrufe, keine Evals, ***„I did not even look at the code once.“*** **Verwunderung**: 30 € + ein Anthropic-Session-Fenster + ein paar Cent Cloudflare-Inferenz → ein Objekt, das zuhört und spricht, gesteuert in natürlicher Sprache; *„the true unlock is how accessible it is.“* Scharfer Kontrast zu [[thomas-pragdave-failing-faster-code-rot-ai-velocity-2026-06-06]] (hier rechtfertigt *„zero blast radius“*, den Code nie anzusehen); illustriert konkret *Code Mode* / *„the agent just writing and executing code,“* das **MCP**-Muster ([[claude-skills-bigger-than-mcp-willison-2025-10-16]]), *Ask for approval*-artige Tool-Governance (uber-engineering-agent-identity-crisis-zero-trust-spire-2026-05-21) sowie die Doktrin der *systems around the model* aus dropbox-okumura-beyond-code-generation-engineering-productivity-ai-agents-2026-05-28.

#BYO Agent#eigene KI mitbringen#Tüfteln

**Mark Dembo** (@darkmembo / @mdembo) · **Head of Solutions – Developer Platform & AI** chez **Cloudflare** (auparavant auteur sur le blog Cloudflare). Billet personnel publié sur son blog *markpauldembo.com* le **7 juin 2026** (description : *« Thoughts about tinkering on a Sunday »*).

KI-Coding-Agenten & Skills Automatisch geprüfte Übersetzung

Using Claude Code: The Unreasonable Effectiveness of HTML

Manifest-artiger Artikel von **Thariq Shihipar** (Engineer & Serial Entrepreneur, Claude Code Team bei Anthropic), der eine **Änderung des Standard-Ausgabeformats für Agenten** ankündigt: die Ablösung von **Markdown durch HTML**. These: Markdown war das dominante Format zwischen Menschen und Agenten (einfach, portabel, editierbar, lesbar), ist aber zu **einem Engpass** geworden, da Agenten längere und reichhaltigere Artefakte produzieren (Specs, Pläne, Berichte, Code-Reviews). Jenseits von ca. 100 Zeilen liest niemand mehr eine Markdown-Datei. HTML löst sechs Einschränkungen gleichzeitig: **Informationsdichte** (Tabellen, CSS, SVG, Skripte, Canvas, Bilder), **visuelle Klarheit** (navigierbares, mobil-responsives Layout), **einfaches Teilen** (ein S3-Link, direkt im Browser öffenbar), **bidirektionale Interaktivität** (Schieberegler, Regler, „Copy as JSON/Prompt“-Buttons zur Rückkopplung in Claude Code), **native kontextuelle Aufnahme** (Claude Code liest die Codebasis + MCP Slack/Linear + Git-Historie + Chrome) und **Freude an der Nutzung** (der Autor stellt ausdrücklich fest: *„it's joyful“*). Fünf kanonische Anwendungen im Detail: (1) **Specs/Pläne/Exploration** in einem vergleichenden Raster, (2) **PR-Review** mit inline annotiertem Diff, (3) **Design & Prototypen** mit Animations-Schiebereglern, (4) **Berichte/Recherche/Lernen** (der Autor ließ einen Prompt-Caching-Explainer aus der Git-Historie generieren), (5) **maßgeschneiderte Wegwerf-Editoren** (Drag-and-Drop von Linear-Tickets, Feature-Flag-Editoren, Side-by-Side-Prompt-Tuner), die einen re-injizierbaren „Copy as Markdown/Diff/JSON“-Export erzeugen. Explizites Anti-Pattern: *„I'm a little bit afraid that people will read this article and turn it into a /html skill“* — der Autor **lehnt eine vorschnelle Skill-ifizierung ab** und empfiehlt stattdessen Prompting von Grund auf („make a HTML file“). Pragmatisches FAQ: Token-Kosten werden durch den 1-Mio.-Kontext von **Opus 4.7** absorbiert, 2-4× längere Generierungszeit, verrauschte HTML-Diffs (ein realer Nachteil), Stil wird über ein HTML-Referenz-Designsystem im Zaum gehalten.

#HTML#Markdown#Ausgabeformat

Thariq Shihipar (Engineer & serial entrepreneur, équipe Claude Code chez Anthropic — site : thariqs.github.io/html-effectiveness ; X : @trq212)