Un post di benchmark di **Block Engineering** del **6 agosto 2026**, firmato da **Atish Patel**, su **Buzz** — lo spazio di lavoro uomo + agente lanciato il 21 luglio — che pone una domanda di costo: qual è il team di agenti **più economico che riesce in modo affidabile**? Tre risultati. **(A) Un risultato negativo, pubblicato per intero**: su **Terminal-Bench 2.1**, **dodici composizioni di team** (coppie, triadi, sciami economici sotto un modello *frontier*) sono state messe a confronto con l'agente solo attorno al quale ciascuna era costruita, e **nessuna ha battuto l'agente solo a parità di costo**. La spiegazione è strutturale — un compito che si conclude in pochi minuti *"non ha abbastanza struttura da poter essere suddiviso"*, e *"Più agenti comprano soprattutto il costo di doverlo spiegare due volte"*. **(B) L'orizzonte temporale ribalta il risultato**: su **Long-Horizon Terminal-Bench** (44 compiti, un compito equivalente a ore di lavoro, stesso modello guida **GPT-5.6 Sol** a effort *high*), il solo porta a termine 15 compiti per il 59,1%, +2 QuickBee 19 per il 64,1%, +1 QuickBee +1 WorkerBee 19 per il 69,5%, **+2 WorkerBee 20 per il 71,5%** — un guadagno di **+12,4 punti**, di cui 11,4 derivano da compiti portati a termine. *"Stessi posti, risultato opposto, perché il lavoro ha una forma diversa."* Queste esecuzioni sono girate a **3× il timeout**, solo incluso. **(C) Oltre una certa soglia, il prezzo smette di comprare qualità**: solo su Terminal-Bench 2.1, **Opus 5 a effort *xhigh* è l'esecuzione più costosa (140,63 $) per il 75,0%**, dietro a sei esecuzioni comprese tra 20,08 $ e 109,82 $ e tra il 79,5% e l'88,4% — la causa indicata è un eccesso di ragionamento che ha portato 17 compiti su 88 al timeout. Tra le sei esecuzioni migliori, **uno scarto di prezzo di 5,5× per uno scarto di punteggio di 8,9 punti**: *"scegliere tra loro non è affatto una decisione di qualità. È una decisione di budget."* Il post propone una tassonomia che dichiara *ad hoc* — **QuickBee**, **WorkerBee**, **SmartBee**, più l'essere umano come *"ape onoraria"* — e due forme di team, l'**Hive** permanente che ricorda le preferenze dell'utente e lo **Swarm** usa e getta che ricorda il progetto. Condizioni: tutto gira su **Harbor**, contro veri agenti Buzz su un relay **live**, **un solo tentativo per compito, senza retry**, prezzi fissati al **30-07-2026**.
#Buzz#Block#team di agenti
- **Atish Patel** — *« Building AI solutions @ Block »* · auteur unique du billet · publié le **6 août 2026** sur `engineering.block.xyz`.
Annuncio di **Block** del **21 luglio 2026**, firmato da **Tyler Longwell**: **Buzz**, uno spazio di lavoro *open source* e **self-hostable**, organizzato per canali, in cui esseri umani e agenti condividono la stessa stanza — chat, ricerca, automazione e **hosting Git** su un unico server, costruito su **Nostr**, un protocollo aperto per messaggi firmati e identità portabili. Tesi di apertura: *« I modelli ora sono in grado di fare il lavoro. I team hanno comunque bisogno di un posto dove farlo insieme. Il collo di bottiglia si è spostato dall'intelligenza al coordinamento. »* Tre elementi di ingegneria. **(A) Identità dell'agente.** Il punto di partenza è un rifiuto — smettere di prestare le proprie credenziali a un bot: *« Abbiamo lasciato che i bot si travestissero da noi. È strano. È pericoloso. »* Ogni agente riceve **una chiave propria**, il suo proprietario firma un'**autorizzazione a perimetro ristretto**, dopodiché l'agente firma il proprio lavoro con la propria identità. La crittografia della delega è convenzionale; la scelta di design lo è meno: *« l'autorizzazione non cancella la paternità »* — l'agente resta l'autore, la sua *credential* attesta chi lo ha autorizzato e a quali condizioni. Conseguenze immediate: la chiave di un agente compromessa viene revocata senza toccare l'identità umana, e il ritiro del proprietario impedisce all'agente di riconnettersi, mentre le sue sessioni attive devono essere terminate separatamente. **(B) Git su object storage.** L'osservazione: *« In passato Git ha sempre avuto un comodo limitatore di frequenza: gli esseri umani »* — un gruppo di agenti produce mesi di commit-persona e CI in un solo pomeriggio, con molti scrittori simultanei, su forge dimensionate per dita umane. Buzz memorizza i repository come **packfile immutabili e indirizzati per contenuto** più un **unico puntatore di manifest mutabile**; un *push* scrive prima gli oggetti, poi fa avanzare il puntatore tramite un **compare-and-swap condizionale**, ed è proprio quello swap il punto di commit — gli eventi dello spazio di lavoro annunciano il cambiamento, non lo definiscono. Il protocollo è **specificato in TLA+ e verificato tramite model checking** (durabilità, ricostruzione, push concorrenti), con il risultato limitato che dipende da tre garanzie esplicite dell'object store, da cui una **suite di conformità** che ogni backend deve superare. **(C) Interoperabilità e privacy.** Claude Code, Codex, goose *« e qualsiasi agente che parli Agent Client Protocol »* funzionano dentro Buzz; cambiare modello o harness lascia intatte identità, permessi e cronologia del progetto. Telemetria e cancellazione viaggiano come messaggi cifrati effimeri, memoria e contabilità dei costi come messaggi cifrati durevoli — *« il server vede i metadati di instradamento, non quei payload »*. Argomento sulla memoria: *« Una forge convenzionale conserva il diff e una spunta verde. Buzz conserva anche il motivo per cui la correzione ovvia era sbagliata. »* Argomento anti-lock-in: se Buzz sparisse, identità e cronologia firmata resterebbero verificabili, Git resterebbe Git.
#Buzz#Block#spazio di lavoro agentico
**Tyler Longwell** — *« Building multi-player AI at Block »* · auteur unique et signataire à la première personne. Publié le **21 juillet 2026** sur le blog Block Engineering.