Guida di ampio respiro di **Anthropic** a cura di **Louis Claxton** (team Applied AI), pubblicata il **21 agosto 2026** sul blog claude.com: una lettura dichiarata di **40 minuti**, circa **64.000 caratteri**, presentata come una raccolta di *plays* tratti dal lavoro del team con i propri clienti. (A) La diagnosi: con il codice non più il collo di bottiglia, lo spostamento avviene verso le fasi a monte e a valle della scrittura (piano, revisione/test, deploy), i controlli riga per riga smettono di reggere quando è l'agente a scrivere la maggior parte del diff, e il costo della governance aumenta perché le eccezioni continuano a passare per comitati periodici. (B) La risposta: sei fasi (Plan, Design, Build, Test, Deploy, Maintain) organizzate come un **loop** piuttosto che una catena, ciascuna conclusa da un **artefatto committato** che la fase successiva legge — `intent.md`, `spec.md`, `plan.md`, il diff e i suoi test, la PR e i suoi findings, il record dell'incidente. (1) La conoscenza istituzionale diventa file versionati: `CLAUDE.md`, skill, `REVIEW.md`, `bands.yaml`. (2) La governance si divide in due livelli, con la skill posizionata come controllo consultivo e l'hook come livello deterministico dietro di essa. La separazione dei compiti è posta come invariante — l'agente che scrive il codice non può approvarlo — e il pezzo si chiude con *"The loop keeps running. Human judgement stays above it."* Il corpus contiene già [[clinton-anthropic-secure-ai-native-sdlc-2026-07-21]] sul versante sicurezza dello stesso ciclo, e [[hingel-augment-how-ai-changes-sdlc-six-stages-2026-06-08]] sulla stessa scomposizione in sei fasi vista da un concorrente.
#AI-native SDLC#software development lifecycle#plays
Louis Claxton (Anthropic, équipe Applied AI) · sur le blog claude.com ; contributions créditées à Jim Blackhurst · Will Steuk et Jamal Arif.
Guida firmata da **Michael Segner**, pubblicata il **20 agosto 2026** sul blog claude.com nella categoria *Claude Code*: una lettura di **5 minuti** annunciata per circa **31.500 caratteri** di testo, offerta anche in PDF. Materiale dichiarato: interviste a **più di una dozzina** di startup, quindici delle quali nominate — **Artemis Security**, **Cainex**, **Clay**, **ClickHouse**, **Cognition**, **Commure**, **Crosby**, **Emergent**, **Harvey**, **Heidi**, **Higgsfield**, **Omni**, **Parahelp**, **Translucent**, **Zingage**. (A) Cinque regole operative: *everyone ships*, *automate the tedium*, *trust, but verify*, *build for rebuilding*, *prototype, dogfood, productionize*, ciascuna chiusa da suggerimenti sui prodotti e riunite in una checklist finale. (B) Un corpo composto da citazioni attribuite, ogni regola illustrata da dirigenti nominati piuttosto che da una metrica aggregata. Le quattro cifre in evidenza sono quelle delle aziende intervistate: **+30%** di funzionalità rilasciate in più (ClickHouse), **da 2 a 3×** produttività ingegneristica (Omni), **100%** del bug triage automatizzato (Clay), **più di 6.000 PR a settimana** (Artemis Security). Due passaggi si discostano dal registro testimoniale: il ciclo di autocorrezione di **Cainex** sulla codifica medica, descritto passo per passo, e l'uso interno di **Claude Tag** in **Anthropic** come primo responsabile per la reperibilità CI/CD. La domanda posta in apertura — *"what would it look like if an organization built their product development lifecycle with Claude Code from the ground up?"* — si collega a [[claxton-anthropic-ai-native-sdlc-playbook-2026-08-21]], pubblicato il giorno successivo dallo stesso editore, e prolunga [[cherny-wu-reflecting-year-claude-code-2026-07-17]].
#Claude Code#startup#everyone ships
Michael Segner · auteur du guide sur le blog claude.com (fonction non affichée par la page) ; entretiens avec les dirigeants de quinze entreprises nommées.
Post del blog aziendale di **Block** (`block.xyz/inside`), non firmato — l'autore indicato è **"Block"** —, pubblicato il **18 agosto 2026**, ~930 parole, che annuncia **l'apertura open source di Berd**, l'applicazione desktop interna di Block per lavorare con gli agenti, ed espone la tesi progettuale che l'ha guidata: dare carattere agli agenti *"non solo attraverso ruoli, istruzioni, skill e strumenti, ma attraverso identità visive distintive"* — da cui i personaggi animati proprietari, i *"Gloopies"*. Il post parte da un'osservazione di frammentazione (*"The technology was powerful, but the experience around it was fragmented"*) e da un problema d'interfaccia denominato con precisione: *"the product gives people little sense of how the agent is configured, which context and tools are available to it, and how it differs from another agent"*. Due contributi strutturanti. **(A) Un'articolazione a tre livelli**: **goose** resta il framework e il *runtime* che sostiene l'agent loop; **Berd** è il client desktop (progetti, contesto, sessioni, agenti, configurazione); i due comunicano tramite l'**Agent Client Protocol**. **Buzz** è designato come il seguito, per quando il lavoro solitario diventa collaborativo (*"Start alone, then go multiplayer"*). **(B) Sei requisiti trasmessi a Buzz**, formulati come conclusione: *"private space, durable context, recognizable agent identities, reusable skills, visible configuration, and clearer visibility into an agent's configured context, tools, and capabilities"* — una griglia direttamente riutilizzabile per valutare un client di agenti. Il testo stesso distingue identità e capacità: *"The avatars make the agent recognizable. Its role, skills, and tools make it useful."* Non viene prodotta alcuna cifra d'uso e non è indicata alcuna licenza per l'apertura open source.
#Berd#Block#open source
**Aucun auteur nommé** : le billet est signé **« Block »** — le champ *Author* de la page porte le nom de l'entreprise. Publié le **18 août 2026** sur `block.xyz/inside` · le blog **corporate** · et non sur `engineering.block.xyz`.
Pagina prodotto ufficiale di **DeepSeek**, pubblicata il **13 agosto 2026**, **non firmata**, di circa 450 parole, che annuncia il rilascio in *developer preview* di **DeepSeek Harness** (`dsh`) — un harness per agenti di coding **open source con licenza MIT**, il cui repository è stato aperto lo stesso giorno. Una tesi in tre parole, ripetuta nel titolo e nella descrizione del repository: *« Everything is a plugin »*, affiancata da una seconda promessa, *« Every run is traceable »*. La pagina enuncia l'equazione *« AGENT = MODEL + HARNESS »* ed elenca le capacità innestabili come plugin — *« models, tools, skills, sessions, sandboxes, storage, loops, scheduling, and the UI »*. Vengono rilasciate quattro modalità: **modalità Standard** (agente di coding completo), **mode Code** (strumenti esposti tramite il *Code Mode SDK*, che permette al modello di comporre operazioni multi-step all'interno di un programma TypeScript), **mode Minimal** (*« two-tool coding agent with persistent bash and str_replace_editor »*, esplicitamente *« for benchmarking models in a minimal environment »*), e **modalità Creator** (ispezione a runtime, test di plugin in memoria). La sostanza tecnica risiede nel repository, non nella pagina: `docs/architecture.md` enuncia un invariante di logging — *« Model-visible means logged. Anything that reaches a model request must be reconstructable from the log, and a runtime invariant asserts it »* — e afferma che *« there is no privileged core to patch »*. Il nucleo tecnico non è farina del sacco di DeepSeek: DSH è costruito su **Cordis** (il progetto `cordiverse`, terza parte), **vendorizzato** in `vendor/` con un manifesto e una procedura di sincronizzazione, e la pagina colloca il *« Cordis paper »* allo stesso livello di navigazione di "GitHub" e "Developer docs". Vengono rilasciati due adapter LLM — `dsh-llm-deepseek` e `dsh-llm-pi-ai`, un adapter generico multi-provider. Il repository avverte in maiuscolo: *« THERE WILL BE COMPATIBILITY-BREAKING CHANGES »*, e `CLAUDE.md` specifica che `SESSION_FORMAT_VERSION` resta a `0` *« with no compatibility promise »*, con i backend che rifiutano i vecchi formati su disco. Cronologia: DSH viene rilasciato lo stesso giorno in cui **DeepSeek-V4-Pro raggiunge la GA**, tre giorni prima dell'entrata in vigore di un nuovo listino prezzi API il **16 agosto 2026 alle 16:00 UTC**, con tariffe di picco/fuori picco e uno sconto fuori picco del **−50%**.
#DeepSeek Harness#dsh#harness per agenti
**DeepSeek** (DeepSeek AI, laboratoire chinois) · en tant qu'institution. Page produit **non signée** : aucun auteur · aucun ingénieur mis en avant · aucun billet de blog ni papier technique associé. Le « nous » n'apparaît qu'une fois · en dernière phrase — *« We look forward to exploring the limits of intelligence with developers worldwide »*. Publiée le **13 août 2026**. La page est rendue en JavaScript : `curl` sur l'URL renvoie **HTTP 202 avec un corps vide** · le texte n'existant qu'après exécution du bundle. Deux documents de politique sont liés en pied de page — *Safe Use Policy* et *Data Processing Statement*.
Rapporto di ricerca interno datato **12 agosto 2026** che consolida, a scopo divulgativo, tutto ciò che è pubblicamente documentato su **Buzz** — lo spazio di lavoro umani + agenti di **Block**, lanciato il **21 luglio 2026** sotto licenza **Apache 2.0**. Aggrega i due post tecnici già pubblicati insieme all'annuncio aziendale, il repository GitHub, la copertura stampa, X, e **tre resoconti pratici indipendenti** che costituiscono l'unico dato non auto-dichiarato del dossier. **(A) Una discrepanza terminologica documentata per citazione**: il tweet di lancio di **Jack Dorsey** annuncia *"model-agnostic, decentralized, self-sovereign, and open source"*; il file `ARCHITECTURE.md` di Block afferma *"The relay is the single source of truth. All reads and writes flow through it. There is no peer-to-peer event exchange, no gossip, no replication."* Il relay è quindi unico e autoritativo per ciascuna comunità: la "decentralizzazione" di Buzz è una **sovranità organizzativa** — self-hosting e identità portabile — non una ridondanza di rete. La formulazione di **TFTC**: *"Two of those three hold cleanly. The third needs a qualifier."* **(B) Un'asimmetria tra rigore dimostrato e rischio di sfruttamento.** Da un lato, un grado di formalismo raro per una v0.4.x/0.5.x: specifica di isolamento multi-tenant **meccanizzata in TLA+**, proprietà di autorizzazione verificate in **Tamarin**, un protocollo di storage Git verificato tramite model-checking, un log di audit append-only con hash-chain, 127 *event kinds*, NIP-01/42/98/34. Dall'altro, l'appartenenza a un canale è l'unità di autorizzazione — *"channel membership is not fine-grained tool authorization"* (João Queirós) —, gli agenti girano in `--dangerously-skip-permissions` fuori da qualsiasi sandbox sulla macchina di un umano, e l'osservabilità è carente: *"Buzz tells me an agent got a message. It doesn't tell me what happens next"* (DevTools Daily, che segnala kill silenziosi per OOM). Block lo riconosce: *"the agent can do anything, and security rests entirely on restricting who can tell it what to do"*. **(C) Lo stack tecnico**, assente dai post pubblicati: relay in **Rust** (Axum WS + REST), **Postgres**, **Redis**, **S3/MinIO** via Blossom, client desktop **Tauri + React**. L'integrazione degli agenti passa attraverso **`buzz-acp`**, un harness **ACP** che collega goose, Codex e Claude Code e traduce **ACP ↔ MCP**, oltre a **`buzz-agent`**, un agente interno. Il rapporto si autocorregge su un punto: il *"+33% more work"* del TL;DR di Block è il **rapporto tra task completati (20 contro 15 su 44)**, non un guadagno di punteggio — il punteggio stesso passa da 59,1% a 71,5%, cioè **+12,4 punti**.
#Buzz#buzz.xyz#Block
**Deep Research Veille Interne** — rapport non signé · produit le **12 août 2026** en préparation d'une présentation. Aucune URL publique ; source archivée dans `raw-data/`.
Annuncio di **Google** del **6 agosto 2026**: Google aderisce come **Core Maintainer** alla specifica **Agent Plugins 1.0.0**, un formato di packaging aperto e *vendor-neutral* per distribuire insieme **Agent Skills** e **MCP servers**. La specifica è stata pubblicata da un **TSC** i cui Core Maintainer provengono da **Amazon, Cursor, Microsoft, OpenAI e Vercel**; Google li raggiunge, rappresentata da **Kevin Hou** (Senior Staff Engineer, Google DeepMind). I due mattoni impacchettati — Agent Skills e MCP — provengono da **Anthropic**, che non compare in questo elenco di maintainer. **La diagnosi** sta in una frase: *"The core problem isn't the components. It's the manifest."* Una skill è portabile, un server MCP è portabile; il contenitore che li racchiude non lo è, e ogni client ha dovuto inventarlo da sé — da cui i fork, le copie di componenti identici e la loro deriva. **Il formato** sta in un vincolo: *"A plugin is a directory. That's the whole idea, and the restraint is the point."* Un `plugin.json` con due righe utili (`$schema` e `name`), le skill in `skills/` nel formato Agent Skills, i server dichiarati in `mcp.json` con un **`type` esplicito su ogni voce** (stdio, Streamable HTTP, o il legacy HTTP+SSE) — niente più trasporto dedotto dalla forma dell'oggetto di configurazione. La forza del design sta in ciò che il manifest **non può** fare: né rilocare i componenti né dichiararli inline, quindi non esiste un percorso di discovery da configurare né un ordine di precedenza da imparare. Corollario operativo: i componenti **falliscono in modo indipendente** — un server `mcp.json` che non riesce ad avviarsi non trascina con sé le skill del plugin, il client salta la voce, prosegue e segnala il fallimento. La via di fuga accettata è la directory **reverse-domain** (`com.example.client/`), uno spazio di estensione posseduto interamente da un client (hook, agenti, comandi) che gli altri client ignorano: *"the portable core stays small because the non-portable parts have somewhere legitimate to go."* Una sezione è dedicata ai casi in cui il formato non è giustificato — *"Not every skill should be a Plugin"*: un singolo server MCP per un singolo client, `mcp.json` basta; una singola skill non necessita di alcun plugin. Ciò che v1 esclude esplicitamente, sotto *future considerations*: **nessun meccanismo di installazione, nessun protocollo di distribuzione, nessun modello di permessi, nessun requisito di sandboxing, nessuna verifica di fiducia o provenienza, nessuna UX**. Tutto questo rientra in uno stack a quattro livelli adottabile in modo indipendente — **trovare** (Agentic Resource Discovery), **descrivere** (AI Catalog, che dovrebbe registrare il tipo `application/agent-plugins+json`), **impacchettare** (Agent Plugins), **eseguire** (MCP + Agent Skills). Due prodotti Google sono già disponibili: **Agents CLI** e **Data Agent Kit** (BigQuery, Spanner, Cloud SQL).
Voce **Skill**: **hyperresearch** di **Jordan Gibbs** è un **harness di ricerca approfondita** che trasforma Claude Code in un agente di ricerca documentale, distribuito come pacchetto PyPI (MIT, Python 3.11-3.13) che installa **20 skill Claude Code**, una CLI, un server MCP e una UI web locale. Osservato il **3 agosto 2026**: 1.568 stelle, 170 fork, repository creato il 9 aprile 2026, ultimo push il 1° agosto. **Il nucleo è una pipeline a 16 passaggi adattiva per livelli (tier)** — `light` (~30-40 min), `full` (~1,5-2,5 h), `dissertation` (4-8 h, da 25.000 a 80.000 parole su 300-450 fonti) — che prende un prompt e restituisce un report sottoposto ad audit avversariale con provenienza completa. **La decisione architetturale centrale è documentata insieme al suo modo di fallimento**: la skill d'ingresso è un **router leggero (thin router)** senza procedura propria, ogni passaggio vive nella propria skill caricata **fresca al momento dell'invocazione**, perché la versione precedente era *« una singola skill di 1200 righe che veniva compattata via prima che il Layer 4 avesse bisogno della sua procedura di triplo abbozzo. L'orchestratore ha dimenticato la procedura, ha scritto un'unica bozza e ha prodotto un report dal punteggio piatto. »* **Due principi portanti.** *« Patch, mai rigenerare »*: dopo la sintesi, sono possibili solo ritocchi chirurgici con `Edit`, con il patcher e l'auditor di rifinitura bloccati sugli strumenti (`tool-locked`) a `[Read, Edit]` a livello di allowlist di Claude Code, in modo che *« non possano fisicamente scrivere (Write) una nuova bozza »*. *« La query di ricerca canonica è vangelo »*: il prompt testuale viene salvato una sola volta in `query.md` e riletto da ogni passaggio e da ogni subagente. **Sedici subagenti** con ruolo e modello configurabili (i fetcher e il cite-checker su Sonnet, i critici, il synthesizer e il patcher su Opus). **Il vault** è un archivio markdown persistente indicizzato in SQLite — *« Markdown è la verità, SQLite è la cache »* — con un ciclo di vita delle note (`draft → review → evergreen`, `stale → deprecated → archive`), provenienza tracciabile, un punteggio di qualità composito (tipo di fonte, autorità citazionale tramite OpenAlex e Semantic Scholar con segnalazioni di ritrattazione, PageRank interno), e un **audit di indipendenza** che raggruppa le copie sindacate — *« cinque ristampe di uno stesso comunicato stampa pesano quanto un'unica fonte »*. **Tre gate meccanici prima della pubblicazione**: l'integrità delle citazioni (ogni citazione riportata deve esistere **testualmente** in una nota del vault), una scansione delle ritrattazioni aggiornata su ogni DOI citato, e una verifica del collegamento citazione-frase da parte di un LLM scettico. **Riserva da segnalare**: l'affermazione d'apertura — *« attualmente in testa alla classifica DeepResearch-Bench RACE »* — è contraddetta dalla propria stessa nota a piè di pagina, *« proiezione prospettica da un pilota stratificato… la convalida da parte di terzi è in sospeso »*. Una proiezione non è una classifica, eppure il grafico la colloca davanti a Gemini e OpenAI Deep Research.
#skill#ricerca approfondita#harness di ricerca
**Jordan Gibbs** — auteur et mainteneur du dépôt `jordan-gibbs/hyperresearch`. Le projet est distribué sous **licence MIT** et publié sur **PyPI** (`pip install hyperresearch`). Signaux d'adoption au 3 août 2026 : **1 568 étoiles** · **170 forks** · 13 issues ouvertes · dépôt créé le **9 avril 2026** et poussé le **1er août 2026** — soit une traction rapide sur moins de quatre mois. Topics déclarés : `agents` · `agentskills` · `claude-code` · `deep-research` · `deep-research-agent`.
Landing page della **specifica ufficiale** dell'**Agent Client Protocol (ACP)** (`agentclientprotocol.com/get-started/introduction`), consultata il **2 agosto 2026**. Non si tratta di un articolo datato ma di un **artefatto vivo**: la scheda è datata in base alla sua osservazione, non a una data di pubblicazione. **Dichiarazione di missione in una frase**: *« The Agent Client Protocol (ACP) standardizes communication between code editors/IDEs and coding agents and is suitable for both local and remote scenarios. »* **Il problema enunciato** sta in tre righe: gli agenti di codifica e gli editor sono **strettamente accoppiati** e *« interoperability isn't the default »* — ogni editor deve costruire un'integrazione personalizzata per ogni agente, ogni agente deve implementare API specifiche dell'editor. Tre conseguenze nominate: **onere di integrazione** (ogni coppia agente-editor richiede lavoro personalizzato), **compatibilità limitata** (un agente raggiunge solo un sottoinsieme di editor), **dipendenza dal fornitore per lo sviluppatore** (*« choosing an agent often means accepting their available interfaces »*). **La soluzione è esplicitamente modellata su LSP** — *« similar to how the Language Server Protocol (LSP) standardized language server integration »* — con un beneficio reciproco: un agente che parla ACP funziona con **qualsiasi** editor compatibile, un editor che supporta ACP accede all'**intero** ecosistema di agenti ACP. **Due modalità di distribuzione, ed è il punto più sottovalutato**: gli agenti **locali** girano come sottoprocesso dell'editor via **JSON-RPC su stdio**, ma gli agenti **remoti** sono previsti su **HTTP o WebSocket** — supporto dichiarato *« work in progress »*, con collaborazione in corso con piattaforme agentiche. **Filiazione tecnica con MCP, più forte di una semplice complementarità**: ACP *« re-uses the JSON representations used in MCP where possible »*, aggiungendo tipi specifici alle esigenze UX della codifica agentica (la visualizzazione dei **diff** è l'esempio riportato); il formato predefinito per il testo leggibile è **Markdown**, scelto affinché l'editor non sia tenuto a renderizzare HTML. **Due osservazioni su governance e versioning** tratte dalla pagina stessa, non dal discorso circostante: la navigazione espone **v1 (Latest)** e **v2 (Draft)** — e **non un "ACP 1.2"** —, e la barra di navigazione collega **Zed Industries *e* JetBrains** allo stesso livello, accanto a un **ACP Registry**, alle **RFD**, a una sezione **Community**, a **Publications**, **Updates** e una pagina **Brand**. Librerie ufficiali annunciate: **Kotlin, Java, Python, Rust, TypeScript**, più un percorso community.
#Agent Client Protocol#ACP#protocollo aperto
**Projet Agent Client Protocol** — spécification collective · sans signature individuelle sur cette page. La barre de navigation du site lie deux organisations au même niveau : **Zed Industries** (à l'origine du protocole) et **JetBrains**. La présence d'une section **RFDs** (*requests for discussion*) · d'une page **Community** et d'un **ACP Registry** indique une structure de gouvernance ouverte plutôt qu'une documentation produit.
Nota di veglia tecnologica di **Didier Girard** datata **2 agosto 2026**, nata dalla domanda di un collega ("cos'è ACP?") per affrontare un problema che non è terminologico ma **documentario**. **Tre protocolli si contendono l'acronimo**, senza alcuna sovrapposizione tecnica: **Agent Client Protocol** (client ↔ agente — Zed, agosto 2025, JSON-RPC 2.0 su stdio, Apache-2.0, "ciò che LSP ha fatto per i linguaggi"), **Agentic Commerce Protocol** (agente ↔ commerciante — OpenAI + Stripe, 29 settembre 2025, in concorrenza con l'**UCP** di Google dell'11 gennaio 2026 sostenuto da **AP2**), e **Agent Communication Protocol** (agente ↔ agente — IBM Research / BeeAI, marginale ma che inquina le ricerche). **Il cuore della nota non è lo scioglimento dell'ambiguità ma il suo fallimento osservato**: l'autore cerca "ACP" nella propria base di conoscenza di veglia tecnologica e ottiene **dodici risultati, tutti relativi al protocollo di commercio, zero su quello di Zed** — *"i nostri agenti di veglia avevano indicizzato l'acronimo senza disambiguarlo"*. Da qui una regola di ingegneria della conoscenza: ***"un acronimo nudo non viene mai indicizzato"*** — l'entità è "Agent Client Protocol", "ACP" è **solo un alias**, portato da tre entità distinte. Segue una precisazione strutturante (**MCP collega un agente ai suoi strumenti, ACP collega un client a un agente; i due si sovrappongono**), poi il caso di scuola: **Buzz**, pubblicato da **Block** il 21 luglio 2026 sotto Apache-2.0 — uno spazio di lavoro auto-ospitabile costruito su **Nostr**, dove ogni partecipante umano o agente è una **coppia di chiavi** e ogni messaggio, passo di workflow o git push è un **evento firmato** in un log append-only. Un'architettura interamente basata su protocolli (`buzz-acp` un harness ACP su stdio, `buzz-agent` un agente ACP che chiama un LLM, `buzz-dev-mcp` un server shell + editing MCP), da cui l'agnosticismo verso gli agenti: **Goose, Claude Code e Codex** si collegano tramite lo stesso harness, e **Hermes** (Nous Research) vi si è collegato senza che Block scrivesse una sola riga — *"N+M invece di N×M, in produzione"*. La nota si chiude sulla questione dell'**abbonamento Claude** rispetto agli agenti terzi, con una cronologia in cinque tappe per il 2026 e una **regola di design** che vale oltre questo caso: la linea di demarcazione non è legale ma **architetturale** — ***"chi consuma, e per conto di chi"*** (un agente `owner-only` consuma il tuo abbonamento per tuo conto; un agente `anyone` in un canale condiviso instrada le richieste dei tuoi colleghi attraverso il tuo account). **Verifica effettuata su questo corpus**: la tesi regge, e in modo più netto di quanto affermi la nota — non solo "Agent Client Protocol" è **completamente assente**, ma l'acronimo nudo `ACP` **è già tipizzato come entità** in due schede, e la pagina della KB `Agentic-Commerce-Protocol` **attribuisce già il protocollo a Google** quando invece appartiene a OpenAI + Stripe. La collisione descritta non è un rischio futuro: ha **già prodotto un errore di attribuzione** nel grafo.
**Didier Girard** — auteur de la note. Écrit ici depuis la position de **praticien de la veille outillée** : le déclencheur est une question de collègue · le matériau principal est le comportement observé de sa propre base de connaissances · et la conclusion est une **règle de curation** adoptée en interne. Le texte alterne donc deux voix — l'explicateur de protocoles et l'ingénieur de la connaissance qui constate un défaut chez lui et en tire une norme.
Pagina di riferimento pubblicata su **eventuallycoding.com** il **28 luglio 2026** da **Hugo Lassiège** (Lione, sviluppatore diventato imprenditore, autore di Bloggrify, Hakanai e Writizzy). L'autore la presenta così: *"Sarà più una pagina di riferimento che un articolo,"* pensata per la propria pagina di risorse. **Argomento**: una descrizione esaustiva e strumentata di una **software factory solitaria** in cui *"il codice prodotto è ormai quasi al 100% generato,"* su più monorepo poliglotti (Nuxt, Kotlin, JS — Hakanai, Writizzy, Bloggrify) in **deployment continuo in produzione**. **Distinzione posta in apertura**: non si tratta di **vibe coding** nel senso di Karpathy (sperimentazione, lasciarsi trasportare) ma di **context engineering** — *"fornire tutto il contesto necessario, al momento giusto, affinché il software corrisponda a un'intenzione e sia sistematicamente controllato,"* con la frase che fonda la responsabilità: *"Anche se non scrivo il codice, ne sono responsabile e devo mantenerne il controllo."* **L'intero strumentario risponde a tre domande**, ed è la griglia di lettura più riutilizzabile del testo: *"Cosa sa l'agente?"* (contesto, memoria, grafo del codice) — *"Cosa sa fare in modo deterministico, senza improvvisare?"* (skill, procedure) — *"Cosa lo ferma quando sbaglia?"* (hook, test di architettura, quality gate). **Sei livelli dettagliati**: (1) **contesto** — `CLAUDE.md` radice + `.claude/rules/*.md` tematici caricati condizionatamente via `paths:` + `.agents/*.md` per le questioni non tecniche (persona, posizionamento, tono); (2) **skill** — una trentina, criterio di esistenza *"se spiego la stessa cosa una terza volta"*; (3) **strumenti** — MCP dell'IDE JetBrains, **GitNexus** (grafo del codice: `impact(symbol)`, `detect_changes()`), Claude-mem, wrapper di filtraggio RTK, Sentry, database in sola lettura; (4) **guardrail eseguibili** — hook dell'harness, **test di architettura**, linting di pattern (**ast-grep** per le decisioni architetturali, non solo ESLint); (5) **factory** — quality gate bloccante con `needs:` sul job di qualità, cinque stadi di test; (6) **processo di prodotto** — spec numerate con una skill di redazione **e una skill di chiusura**, design in Claude Design, consegna a stadi dietro feature flag, distinzione tra **feature flipping** (Unleash) e **gating** (contratto cliente). **La regola che riassume tutto**: *"Ciò che conta deve essere eseguibile. Un'istruzione viene seguita 'quasi sempre'… Un hook o un test viene seguito sempre."* **Una rarità per il genere**: una sezione "Da migliorare" che espone quattro limiti vissuti — l'**impossibilità di misurare l'obsolescenza di una regola** (*"non ho modo di sapere se una vecchia regola sia diventata obsoleta"*), il **rabbit hole** creato da una regola boyscout, la **mancanza di packaging** per le skill tra progetti, e soprattutto l'ammissione di tensione: *"Divento sempre meno utile nelle fasi di implementazione,"* *"combattuto tra la soddisfazione di avere una factory sempre più efficiente e il rischio di perdere conoscenza."*
#software factory#context engineering#vibe coding
**Hugo Lassiège** — développeur devenu entrepreneur · basé à **Lyon** · écrit du code depuis 2001 et tient **eventuallycoding.com** (le blog a porté le nom `hakanai.free.fr` avant de devenir *Eventuallycoding* en 2013). *Eventuallycoding* est le nom-parapluie qui regroupe ses projets · sa chaîne YouTube et ses blogs.
Analisi di Janakiram MSV (The New Stack, 20 luglio 2026) sulla **convergenza architetturale** delle piattaforme agent enterprise dei tre hyperscaler: in nove mesi, **Amazon Bedrock AgentCore**, **Microsoft Foundry** e **Gemini Enterprise Agent Platform** sono convergenti sugli **stessi sei primitivi** — runtime, memoria, tool gateway, identità, osservabilità, governance — sotto nomi commerciali diversi. Ciò che 18 mesi fa era una collezione frammentata di librerie sta diventando un **livello di piattaforma** a sé stante. La tesi: questa convergenza ripercorre l'**inflessione PaaS 2011-2016**, in cui **Cloud Foundry** ed **Heroku** hanno unificato VM, load balancer, code e secret store attorno a un **contratto applicativo** portabile — salvo che qui **non esiste ancora un contratto equivalente**, e **nessun progetto open source lo ha rivendicato**. Conseguenza: un'impresa non può **spostare un agente da un cloud all'altro** (stato di sessione, tracce e identità finiscono tutti presso un unico fornitore; migrare significa ricostruire tutto). L'autore propone una **mappatura riga per riga** del contratto Cloud Foundry sugli agenti, definisce tre principi di design (impacchettare l'agente come **una singola unità distribuibile**, **collegare** le capacità invece di incorporare i fornitori, integrare il livello **operativo** nell'astrazione), indica ciò che i protocolli aperti (MCP, A2A, OpenTelemetry) lasciano fuori campo — il **ciclo di vita** — e formula tre domande di due diligence: **governance** (fondazione neutrale vs. fornitore), **packaging** (lo stesso artefatto su due cloud senza riscriverlo), **stato** (memoria esportabile). Verdetto: chi finirà per possedere il **control plane degli agenti** definirà *cos'è un agente*.
**Rapporto ricorrente di Mozilla**, *The state of open source AI*, **v1.0.1, luglio 2026**, introdotto da una lettera di **Raffi Krikorian** (CTO): sette sezioni, un sito interattivo e un rapporto scaricabile. Tesi enunciata nel titolo della Sezione 1: *« Il livello del modello si è commoditizzato. Il valore si sposta sull'harness sovrastante. »* **Stato delle capacità**: sull'*Artificial Analysis Intelligence Index v4.1*, il miglior modello chiuso ottiene **61** punti (Claude Opus 5) e il miglior modello open **57** (**Kimi K3**), quarto in classifica generale e davanti a tre dei più grandi laboratori chiusi; sull'*Epoch Capabilities Index*, lo scarto è di **6 punti** (K3 a 156 contro GPT-5.6 Sol a 162), descritto come *« all'incirca un ciclo di release »*, con intervalli di confidenza sovrapposti. **Frontiera a dente di sega**: l'open è in testa nel codice frontend (K3 a 1.679 Elo sulla LMArena Frontend Code Arena, sei domini su sette), contende il lavoro agentico da terminale (88,3 contro 88,8 su Terminal-Bench 2.1), e cede terreno sul lavoro professionale di conoscenza (Fable 5 supera K3 di 92 Elo su GDPval-AA v2). **Spostamento d'uso**: la quota di token OpenRouter instradati verso modelli open-weight è salita da un livello trascurabile a un terzo entro fine 2025, poi a una **maggioranza entro metà 2026**, con i sette modelli a maggior volume tutti open-weight — il rapporto stesso osserva che *« in numero di richieste, i fornitori chiusi statunitensi restano in testa »*, il vantaggio open essendo un vantaggio in volume di token concentrato nei carichi di lavoro di coding e agentici. **Il contrasto centrale**: *« L'open si spedisce facilmente. L'open si distribuisce con difficoltà. »* — il 79% degli sviluppatori che adottano l'IA usa modelli open contro il 71% per il chiuso, ma solo il **53%** dei team su modello open raggiunge la produzione **contro il 63%**, e lo scarto si allarga con la dimensione dell'organizzazione (chiuso 54% → 73%, open 53% → 57%), il che *« esclude una spiegazione basata sulle risorse »*. La mappa di maturità dello stack (48 componenti, 9 livelli) mostra due colonne costantemente fredde — la **standardizzazione** e la ***prontezza enterprise*** — identificate come il divario operativo. **Sezione 5**: *« L'harness agentico è un altro user agent »*, e *« Il modello sta divorando l'harness »* — su ogni modello in cui entrambi esistono, l'harness proprietario del laboratorio ora vince, con lo scarto di 21,8 punti compresso a circa 3. Da cui la formula: *« Un harness calibrato strettamente sui pesi di un laboratorio… degrada su qualsiasi altro modello, quindi più stretta è la calibrazione, meno intercambiabili sono i pesi sottostanti. Il lock-in arriva come effetto collaterale dell'ottimizzazione. »*
#Mozilla#state of open source AI#pesi open
**Mozilla** — éditeur du rapport · avec une introduction signée **Raffi Krikorian** · *Chief Technology Officer*. Publié en **juillet 2026** (v1.0.1). Données issues de sources tierces créditées (Artificial Analysis, Epoch AI, OpenRouter, LMArena) et d'une enquête propre menée avec **SlashData** (*Mozilla / SlashData 2026 developer survey*, n = 1 410 sur la question des freins).
Guida tecnica approfondita (blog dell'agenzia Lushbinary) sul **Loop Engineering**: la progettazione dei sistemi che guidano gli agenti di codifica in un loop, anziché guidarli manualmente tramite prompt. Copre la filiazione prompt → context → loop engineering, la tecnica Ralph (Geoffrey Huntley), i **cinque building block + memoria** di un loop, la loro implementazione in Claude Code e OpenAI Codex, la scrittura di condizioni di arresto verificabili, una scala di maturità dell'adozione e i rischi che peggiorano man mano che i loop diventano più sofisticati. Dominio: ingegneria del software agentica, agenti di codifica, harness/orchestrazione.
#Loop engineering#agenti di codifica#harness engineering
Post di svago domenicale di **Mark Dembo** (Head of Solutions, Developer Platform & AI presso **Cloudflare**) pubblicato il **7 giugno 2026** sul suo blog personale. **Narrazione**: ispirato da **Steve Ruiz**, l'autore acquista un piccolo dispositivo **M5Stack Stick 3** (~30€) e, approfittando del rilascio di **Opus 4.8**, si costruisce un **agente AI DIY** "per pura curiosità, senza alcun obiettivo". **Iterazione 1 (45 min)**: sottopone la documentazione del dispositivo a **Claude Code**, che genera script Python (~200 righe di codice, *"zero blast radius"*) che mostrano il meteo di Monaco di Baviera, poi di più città; un **backend Cloudflare Workers + Workers AI** aggiunge **sintesi vocale (TTS)**, **push-to-talk** (riconoscimento vocale) e un **piccolo LLM** centrale per rispondere alle domande. **Iterazione 2 (un vero agente)**: passaggio degli endpoint REST al trasporto **WebSocket** tramite il **Cloudflare Agents SDK** + **Dynamic Worker execution** → il pattern ***"Code Mode"*** (l'agente scrive ed esegue codice per portare a termine il suo compito). L'agente risponde quindi a domande su dati pubblici (11! = fattoriale, il vincitore della Champions League via `fetch()` su Wikipedia, il meteo di qualsiasi città). **Iterazione 3 (poteri reali)**: connessione a **Todoist** tramite un flusso **MCP OAuth** → 50 strumenti in un colpo solo, da cui due problemi: **context bloat** e **rischio reale di danni**. La soluzione si basa sul **MCP Server Portal** di Cloudflare + le impostazioni dei connettori Claude: per ogni strumento, **Always allow / Ask for approval / Disable** (gli strumenti *Disabled* non entrano mai nel contesto; un **classificatore LLM** accetta solo autorizzazioni "allow" distinte e **nega per default**). **Postura dichiarata**: ridurre il proprio ruolo a ***"generatore di idee, esecutore e giudice"*** (e raramente guida tecnica), un flusso "human-in-the-loop" che considera poco *"2026"* (copia-incolla in UIFlow). **Cosa NON ha fatto**: nessuna ottimizzazione di latenza/streaming, nessuna chiamata LLM ottimistica, nessuna valutazione (eval), ***"non ho nemmeno guardato il codice una sola volta"***. **Stupore**: 30€ + una finestra di sessione Anthropic + qualche centesimo di inferenza Cloudflare → un oggetto che ascolta e parla, pilotato in linguaggio naturale; *"il vero sblocco è quanto sia accessibile."* Contrasto netto con [[thomas-pragdave-failing-faster-code-rot-ai-velocity-2026-06-06]] (qui *"zero blast radius"* giustifica il non guardare mai il codice); illustra concretamente il *Code Mode* / *"l'agente che scrive ed esegue codice"*, il pattern **MCP** ([[claude-skills-bigger-than-mcp-willison-2025-10-16]]), la governance degli strumenti in stile *Ask for approval* (uber-engineering-agent-identity-crisis-zero-trust-spire-2026-05-21), e la dottrina dei *systems around the model* di dropbox-okumura-beyond-code-generation-engineering-productivity-ai-agents-2026-05-28.
#BYO agent#bring your own AI#svago tecnologico
**Mark Dembo** (@darkmembo / @mdembo) · **Head of Solutions – Developer Platform & AI** chez **Cloudflare** (auparavant auteur sur le blog Cloudflare). Billet personnel publié sur son blog *markpauldembo.com* le **7 juin 2026** (description : *« Thoughts about tinkering on a Sunday »*).
Articolo di blog di **Pasquale Pillitteri** (software engineer, Palermo) pubblicato il **29 maggio 2026** (versione FR), lettura di 18 minuti, sezione *Claude Code & Anthropic*. **Tesi centrale**: *« Claude Opus 4.8 è il modello SEO più potente del 2026, ma quasi tutti lo usano male »* — non un problema di modello ma un problema di **sistema**. La regola d'oro: ***« la strategia è una lavagna, la produzione è una catena di montaggio »*** — la SEO deve essere **suddivisa in due fasi distinte**, e mescolarle è *« il modo più rapido per sprecare un modello che costa cinque dollari per milione di token in input e venticinque in output »*. **Contesto del modello**: Opus 4.8 rilasciato il **28 maggio 2026** (41 giorni dopo Opus 4.7), contesto di **1M di token**, **GraphWalks Long-Context F1 a 1M: 40,3% → 68,1%**, **SWE-bench Verified 88,6%**, **USAMO 2026 96,7%** (+27,4 punti), **HLE con tool 57,9%**, prezzo invariato **5$/25$** per milione di token, **Fast Mode 2,5× a 10$/50$**, quattro **livelli di effort** (Low, High, Extra, Max). **L'anti-pattern centrale** = *« la conversazione gigante »* / **context drift**: mescolare strategia, ricerca di parole chiave, analisi competitiva e scrittura in un'unica chat produce un *« miscuglio di intenzioni contraddittorie »* → il modello scivola verso **best practice generiche** ("ottimizzazione olistica", "approccio strategico") invece di contenuti ancorati ai dati. **Fase 1 — Strategia (lavagna, UI visiva, una tantum)**: dashboard / Google Sheet / canvas Claude.ai per decidere guardando insieme i dati. **3 mosse**: (a) **ricerca di parole chiave classificata** (tabella di volume / difficoltà 0-100 / intento / potenziale business / priorità = volume÷difficoltà×peso business); (b) **analisi competitiva visiva** (matrice di copertura degli argomenti, gap); (c) **roadmap a fasi** (quick win M1-2 / medio termine M3-6 / pagine pilastro M7-12). La modalità **Extra/Max** è giustificata qui (*« una decisione strategica corretta vale mille pagine ben scritte sulle parole chiave sbagliate »*). 3 artefatti chiusi salvati su Notion/Drive. **Fase 2 — Produzione (catena di montaggio, Opus 4.8 + MCP)**: il modello passa da stratega a **macchina di esecuzione**; ogni decisione **ancorata a dati live** tramite il **Model Context Protocol**. **Stack MCP minimo**: **GSC MCP** (AminForou/mcp-gsc, 500+ stelle), **Ahrefs MCP ufficiale** (98 stelle), **GA4 MCP**; il repo `modelcontextprotocol/servers` = **86.440 stelle**, **10.000+ server attivi**, 97M download SDK/mese. Setup ~35 min, refresh mensile ~20 min. **Loop settimanale**: un singolo prompt estrae dati live, costruisce il brief (top 10 SERP + GSC + Ahrefs), deriva H2/H3, scrive, verifica la densità, suggerisce i titoli → **+45% di produttività**, bozza in **6-12 min** (riferimento esplicito a **Ryan Law / Ahrefs content engineering**, 23 skill). Cita i **Dynamic Workflows** di Anthropic (fino a 1.000 subagent). **4 errori comuni**: (1) non verificare i numeri (spot-check obbligatorio, *trust & verify*); (2) sostituire integralmente Semrush/Ahrefs (MCP è un **layer** sopra, non un sostituto); (3) ignorare il **paid-organic content gap** (caso cliente education: **2.742 termini sprecati / 351 opportunità** identificati in 90 s); (4) usare Opus 4.8 dove basta **Haiku 4.5** (meta description, alt text). **Costo**: 1-3$ per articolo di 2.500 parole. **Sonnet 4.6** basta per la produzione ricorrente, Opus 4.8 riservato alla strategia. Articolo SEO-ottimizzato e autoreferenziale (l'autore scrive di SEO in un contenuto esso stesso pensato per posizionarsi su "Opus 4.8 SEO"). Convergenza diretta con **Ryan Law/Ahrefs** (citato), **sistemi attorno al modello** (Dropbox/Okumura), **skill-over-prompt** (Lattice), model routing Haiku/Sonnet/Opus (Gupta token-to-outcome).
#Claude Opus 4.8#SEO IA#workflow a due fasi
**Pasquale Pillitteri** — Ingénieur informatique / développeur logiciel basé à **Palerme** (Italie) · certifié Innovation Manager UNI 11814:2021. Auteur d'un blog tech actif (rubrique *Claude Code & Anthropic*) · avec une newsletter hebdomadaire (~3,4k lecteurs). Article publié en version **FR** le **29 mai 2026** (lendemain de la sortie d'Opus 4.8).
Articolo in stile manifesto di **Thariq Shihipar** (Ingegnere e imprenditore seriale, team Claude Code di Anthropic) che annuncia un **cambiamento nel formato di output predefinito per gli agenti**: la sostituzione di **Markdown con HTML**. Tesi: Markdown è stato il formato dominante tra umani e agenti (semplice, portabile, modificabile, leggibile) ma è diventato **un collo di bottiglia** man mano che gli agenti producono artefatti più lunghi e ricchi (specifiche, piani, report, code review). Oltre le ~100 righe, nessuno legge più un file Markdown. HTML risolve sei limiti contemporaneamente: **densità informativa** (tabelle, CSS, SVG, script, canvas, immagini), **chiarezza visiva** (layout navigabile, responsive per mobile), **facilità di condivisione** (un link S3 apribile direttamente nel browser), **interattività bidirezionale** (slider, manopole, pulsanti "copy as JSON/prompt" per il rientro in Claude Code), **ingestione contestuale nativa** (Claude Code legge la codebase + MCP Slack/Linear + cronologia git + Chrome) e **piacere** (l'autore afferma esplicitamente *"it's joyful"*). Cinque usi canonici approfonditi: (1) **specifiche/piani/esplorazione** in una griglia comparativa, (2) **PR review** con diff annotato inline, (3) **design e prototipi** con slider di animazione, (4) **report/ricerca/apprendimento** (l'autore ha fatto generare un explainer sul prompt caching a partire dalla cronologia git), (5) **editor usa e getta personalizzati** (drag-and-drop di ticket Linear, editor di feature flag, prompt-tuner affiancati) che producono un export "copy as markdown/diff/JSON" re-iniettabile. Anti-pattern esplicito: *"I'm a little bit afraid that people will read this article and turn it into a /html skill"* — l'autore **rifiuta la skill-ificazione prematura**, raccomandando di scrivere il prompt da zero ("make a HTML file"). FAQ pragmatica: costo in token assorbito dal contesto da 1MM di **Opus 4.7**, generazione 2-4× più lunga, diff HTML rumorosi (uno svantaggio reale), stile tenuto sotto controllo tramite un design system HTML di riferimento.
#HTML#Markdown#formato di output
Thariq Shihipar (Engineer & serial entrepreneur, équipe Claude Code chez Anthropic — site : thariqs.github.io/html-effectiveness ; X : @trq212)
Whitepaper Google (primo capitolo, il "Day 1", di una serie firmata da Addy Osmani, Shubham Saboo e Sokratis Kartakis) che mappa la trasformazione del ciclo di vita dello sviluppo software (SDLC) nell'era degli agenti di coding. Tesi: il cambiamento fondamentale non è un nuovo linguaggio, bensì il passaggio dalla scrittura di codice all'**espressione dell'intento**. Il documento delinea uno spettro che va dal *vibe coding* (prompting e accettazione) all'*agentic engineering* (l'IA implementa sotto vincoli, test e cicli di feedback progettati da esseri umani), con il **context engineering** come competenza centrale, il modello della **software factory** (il deliverable dello sviluppatore = il sistema che produce il codice), l'**harness engineering** (Agent = Model + Harness) e un'analisi economica CapEx/OpEx del costo totale di possesso.
Lancio della Agentic AI Foundation - Linux Foundation - OpenAI Anthropic Block - Standard Aperti per gli Agenti AI - AGENTS.md MCP goose - Interoperabilità
Cat Wu e Boris Cherny (Anthropic) spiegano come usare Claude Code come i suoi creatori: antfooding, plan mode, subagent, hook ed estensibilità — podcast AI & I di Every
#Claude Code#Cat Wu#Boris Cherny
Rhea Purohit (interviewer: Dan Shipper) · Cat Wu · Boris Cherny
Block/Goose — MCP-UI and the Future of Agentic Interfaces: componenti web interattivi nelle conversazioni degli agenti IA tramite Model Context Protocol (block.github.io)