Zum Inhalt springen

root / tags / humain-middleware

#humain middleware

2 Fiches

KI-Coding-Agenten & Skills Automatisch geprüfte Übersetzung

Efficient Tokens & Effective Teams in Buzz

Ein **Block-Engineering**-Benchmark-Beitrag vom **6. August 2026**, verfasst von **Atish Patel**, über **Buzz** – den am 21. Juli gestarteten Workspace für Mensch und Agent – der eine Kostenfrage stellt: Welches Agententeam ist **das günstigste, das zuverlässig erfolgreich ist**? Drei Befunde. **(A) Ein vollständig veröffentlichtes negatives Ergebnis**: Auf **Terminal-Bench 2.1** wurden **zwölf Teamzusammensetzungen** (Paare, Triaden, günstige Schwärme unter einem *Frontier*-Modell) gegen den jeweiligen Solo-Agenten antreten lassen, um den sie herum gebaut waren, und **keine schlug ihn bei gleichen Kosten**. Die Erklärung ist struktureller Natur – einer Aufgabe, die in Minuten erledigt ist, *„fehlt genug Struktur, um sie aufzuteilen"*, und *„mehr Agenten kaufen meist nur die Kosten, es zweimal zu erklären"*. **(B) Der Zeithorizont kehrt das Ergebnis um**: Auf **Long-Horizon Terminal-Bench** (44 Aufgaben, eine Aufgabe im Wert von Stunden Arbeit, gleicher Lead **GPT-5.6 Sol** mit *high*-Aufwand) schließt Solo 15 Aufgaben ab bei 59,1 %, +2 QuickBees 19 bei 64,1 %, +1 QuickBee +1 WorkerBee 19 bei 69,5 %, **+2 WorkerBees 20 bei 71,5 %** – ein Zugewinn von **+12,4 Punkten**, wovon 11,4 aus abgeschlossenen Aufgaben stammen. *„Gleiche Plätze, umgekehrtes Ergebnis, weil die Arbeit eine andere Form hat."* Diese Durchläufe liefen mit dem **3-fachen Timeout**, Solo eingeschlossen. **(C) Jenseits einer Schwelle kauft der Preis keine Qualität mehr**: Solo auf Terminal-Bench 2.1, **Opus 5 mit *xhigh*-Aufwand ist der teuerste Durchlauf (140,63 $) bei 75,0 %**, hinter sechs Durchläufen zwischen 20,08 $ und 109,82 $ und 79,5 % bis 88,4 % – als Ursache wird Over-Reasoning genannt, das 17 von 88 Aufgaben in den Timeout trieb. Unter den sechs besten Durchläufen liegt **eine 5,5-fache Preisspanne bei einer Punktzahldifferenz von 8,9 Punkten**: *„die Wahl zwischen ihnen ist überhaupt keine Qualitätsentscheidung. Es ist eine Budgetentscheidung."* Der Beitrag schlägt eine Taxonomie vor, die er selbst als *ad hoc* bezeichnet – **QuickBee**, **WorkerBee**, **SmartBee**, dazu der Mensch als *„Ehrenbiene"* – sowie zwei Teamformen: die permanente **Hive**, die sich die Präferenzen der Nutzenden merkt, und der einmalige **Swarm**, der sich das Projekt merkt. Rahmenbedingungen: alles läuft auf **Harbor**, gegen echte Buzz-Agenten auf einem **Live**-Relay, **ein Versuch pro Aufgabe, kein Retry**, Preise festgeschrieben zum **30.07.2026**.

#Buzz#Block#Agententeams

- **Atish Patel** — *« Building AI solutions @ Block »* · auteur unique du billet · publié le **6 août 2026** sur `engineering.block.xyz`.

Architektur & Konstruktion Automatisch geprüfte Übersetzung

Buzz!

**Block**-Ankündigung vom **21. Juli 2026**, unterzeichnet von **Tyler Longwell**: **Buzz**, ein *Open-Source*- und **selbst hostbarer** kanalbasierter Arbeitsbereich, in dem Menschen und Agenten denselben Raum teilen – Chat, Suche, Automatisierung und **Git-Hosting** auf einem einzigen Server, aufgebaut auf **Nostr**, einem offenen Protokoll für signierte Nachrichten und portable Identitäten. Ausgangsthese: *« Modelle können die Arbeit jetzt erledigen. Teams brauchen weiterhin einen Ort, um sie gemeinsam zu erledigen. Der Engpass ist von der Intelligenz zur Koordination gewandert. »* Drei technische Bausteine. **(A) Agentenidentität.** Ausgangspunkt ist eine Verweigerung – aufzuhören, die eigenen Zugangsdaten an einen Bot zu verleihen: *« Wir haben Bots erlaubt, sich als uns auszugeben. Das ist seltsam. Das ist gefährlich. »* Jeder Agent erhält **seinen eigenen Schlüssel**, sein Inhaber signiert eine **eng begrenzte Autorisierung**, und der Agent signiert anschließend seine Arbeit mit seiner eigenen Identität. Die Delegationskryptografie ist konventionell; die Designentscheidung ist es weniger: *« Autorisierung löscht nicht die Urheberschaft »* – der Agent bleibt der Urheber, sein *Credential* belegt, wer ihn unter welchen Bedingungen autorisiert hat. Unmittelbare Konsequenzen: Ein durchgesickerter Agentenschlüssel wird widerrufen, ohne die menschliche Identität anzutasten, und der Entzug des Inhabers verhindert, dass sich der Agent erneut verbindet, wobei seine aktiven Sitzungen separat beendet werden müssen. **(B) Git auf Objektspeicher.** Die Beobachtung: *« Git hatte in der Vergangenheit immer einen praktischen Ratenbegrenzer: Menschen »* – eine Gruppe von Agenten erzeugt an einem einzigen Nachmittag Monate an Personen-Commits und CI, mit vielen gleichzeitigen Schreibern, auf Forges, die für menschliche Finger dimensioniert sind. Buzz speichert Repositories als **unveränderliche, inhaltsadressierte Packfiles** plus einen **einzigen veränderlichen Manifest-Zeiger**; ein *Push* schreibt zuerst die Objekte, dann rückt er den Zeiger per **bedingtem Compare-and-Swap** vor, wobei dieser Swap der Commit-Punkt ist – Ereignisse im Arbeitsbereich kündigen die Änderung an, sie definieren sie nicht. Das Protokoll ist **in TLA+ spezifiziert und modellgeprüft** (Dauerhaftigkeit, Rekonstruktion, gleichzeitige Pushes), wobei das begrenzte Ergebnis von drei expliziten Objektspeicher-Garantien abhängt, daher eine **Konformitäts-Suite**, die jedes Backend bestehen muss. **(C) Interoperabilität und Datenschutz.** Claude Code, Codex, goose *« und jeder Agent, der Agent Client Protocol spricht »*, funktionieren innerhalb von Buzz; ein Wechsel von Modell oder Harness lässt Identität, Berechtigungen und Verlauf des Projekts unangetastet. Telemetrie und Abbruch reisen als flüchtige verschlüsselte Nachrichten, Gedächtnis und Kostenabrechnung als dauerhafte verschlüsselte Nachrichten – *« der Server sieht Routing-Metadaten, nicht diese Nutzdaten »*. Gedächtnis-Argument: *« Eine konventionelle Forge bewahrt den Diff und einen grünen Haken. Buzz bewahrt auch, warum der naheliegende Fix falsch war. »* Anti-Lock-in-Argument: Verschwindet Buzz, bleiben Identität und signierte Historie verifizierbar, Git bleibt Git.

#Buzz#Block#agentischer Arbeitsbereich

**Tyler Longwell** — *« Building multi-player AI at Block »* · auteur unique et signataire à la première personne. Publié le **21 juillet 2026** sur le blog Block Engineering.