Vai al contenuto

root / tags / comprehension-debt

#comprehension debt

3 fiches

Qualità e Sicurezza Traduzione verificata automaticamente

Code review dans le SDLC augmenté : l'anneau de contraintes autour des agents

Episodio "Fase 5 · Review" della serie SFEIR sul SDLC aumentato, pubblicato **lo stesso giorno** del post LinkedIn di Addy Osmani che traduce in una specifica di fase. Tesi: **la qualità ha cambiato indirizzo** — non si legge più nel codice (gli agenti ne producono più di quanto chiunque possa revisionare) ma nell'**anello di vincoli che circonda l'agente**. L'anello di Osmani (sette dimensioni — correttezza, sicurezza, prestazioni, accessibilità, manutenibilità, **efficienza economica**, **comprensibilità** — collegate dalla regola del **back-pressure**: "a un loop viene concessa solo l'autonomia che può essere verificata in modo economico e affidabile, non un millimetro di più") viene ridisegnato, tradotto e ancorato alla fase 5 del ciclo a 11 fasi di SFEIR. Il corollario strutturante: **il collo di bottiglia non è mai stato la generazione, è la verifica** — "la generazione è una bocca larga, la verifica un collo stretto; accelerare la bocca ispessisce l'accumulo al collo." **La decisione di design più interessante riguarda l'architettura del ciclo**: la Review è deliberatamente **fuori dai tre gate umani** (Define, Plan, Ship), perché fare della Review il gate metterebbe l'attenzione umana — una risorsa finita — come punto di controllo di una capacità di generazione che a sua volta scala: "si sarebbe costruita una pipeline il cui throughput massimo è il numero di diff che un senior può leggere prima della fine della giornata." Da qui la separazione: **la Review istruisce, lo Ship decide** — la Review fornisce un *corpo di prove opponibile*, lo Ship decide sulla base delle prove, non sull'intero diff. Una posizione presa contro Monperrus (di cui SFEIR conserva la diagnosi — l'ispezione umana di ogni diff non può reggere alla velocità agentica — ma respinge la conclusione: l'accettazione non può essere delegata). La trappola citata è la **validazione circolare** (l'agente che scrive il codice scrive i test che lo validano: "si è costruito uno specchio, non un anello"), con cinque contromisure tratte da Anthropic (gate indipendenti in finestre di contesto separate, deterministico e agentico che non si sostituiscono mai a vicenda, shadow mode, tiering basato sul rischio, logging verso il SIEM) e l'avvertimento di Compare the Market (**grafo AST ~70% contro RAG vettoriale ~58%**, con il RAG che si comporta *peggio di nessun contesto*). L'estensione propria dell'azienda è **il cricchetto**: "ogni fuga diventa un vincolo" — un difetto che ha attraversato l'anello viene chiuso *all'interno dell'anello* (test, regola di lint, rubrica di review, guardrail dell'harness) a Compound-1, "l'unico asset della catena che si apprezza mentre i modelli si deprezzano" (una misura interna non verificata: **−30% di iterazioni di fix dopo dieci cicli**). Si chiude riformulando la domanda: "questo codice è buono?" è diventata una domanda senza risposta; ciò che resta è **"che cosa il mio sistema si rifiuta di lasciar passare?"**

#anello di vincoli#vincoli attorno agli agenti#fase Review

SFEIR (voix éditoriale du cabinet, article non signé individuellement) — construit sur Addy Osmani (Google) ; cite Martin Monperrus · Paula Hingel (Augment Code) · DORA/Google Cloud · Jason Clinton (Anthropic) · l'équipe Engineering de Compare the Market

Agenti di codifica IA e Skills Traduzione verificata automaticamente

Using Claude Code: The Unreasonable Effectiveness of HTML

Articolo in stile manifesto di **Thariq Shihipar** (Ingegnere e imprenditore seriale, team Claude Code di Anthropic) che annuncia un **cambiamento nel formato di output predefinito per gli agenti**: la sostituzione di **Markdown con HTML**. Tesi: Markdown è stato il formato dominante tra umani e agenti (semplice, portabile, modificabile, leggibile) ma è diventato **un collo di bottiglia** man mano che gli agenti producono artefatti più lunghi e ricchi (specifiche, piani, report, code review). Oltre le ~100 righe, nessuno legge più un file Markdown. HTML risolve sei limiti contemporaneamente: **densità informativa** (tabelle, CSS, SVG, script, canvas, immagini), **chiarezza visiva** (layout navigabile, responsive per mobile), **facilità di condivisione** (un link S3 apribile direttamente nel browser), **interattività bidirezionale** (slider, manopole, pulsanti "copy as JSON/prompt" per il rientro in Claude Code), **ingestione contestuale nativa** (Claude Code legge la codebase + MCP Slack/Linear + cronologia git + Chrome) e **piacere** (l'autore afferma esplicitamente *"it's joyful"*). Cinque usi canonici approfonditi: (1) **specifiche/piani/esplorazione** in una griglia comparativa, (2) **PR review** con diff annotato inline, (3) **design e prototipi** con slider di animazione, (4) **report/ricerca/apprendimento** (l'autore ha fatto generare un explainer sul prompt caching a partire dalla cronologia git), (5) **editor usa e getta personalizzati** (drag-and-drop di ticket Linear, editor di feature flag, prompt-tuner affiancati) che producono un export "copy as markdown/diff/JSON" re-iniettabile. Anti-pattern esplicito: *"I'm a little bit afraid that people will read this article and turn it into a /html skill"* — l'autore **rifiuta la skill-ificazione prematura**, raccomandando di scrivere il prompt da zero ("make a HTML file"). FAQ pragmatica: costo in token assorbito dal contesto da 1MM di **Opus 4.7**, generazione 2-4× più lunga, diff HTML rumorosi (uno svantaggio reale), stile tenuto sotto controllo tramite un design system HTML di riferimento.

#HTML#Markdown#formato di output

Thariq Shihipar (Engineer & serial entrepreneur, équipe Claude Code chez Anthropic — site : thariqs.github.io/html-effectiveness ; X : @trq212)

Filosofia e Società Traduzione verificata automaticamente

Cognitive Surrender

Articolo dottrinale di Addy Osmani (Google) che stabilisce una distinzione fondamentale per il dibattito 2026 su IA e cognizione: **Cognitive Offloading** (sano — delegare il *come* mantenendo il giudizio sui risultati) vs **Cognitive Surrender** (tossico — accettare l'output dell'IA in blocco senza formare un ragionamento parallelo, *"prendere in prestito la fiducia del modello come sostituto della comprensione personale"*). Solido fondamento scientifico: lo studio **Shaw & Nave (Wharton/UPenn)** su 1.372 partecipanti — **il 73% accetta risposte dell'IA palesemente errate**, con una fiducia crescente nonostante un tasso di errore del 50%. **MIT *Your Brain on ChatGPT*** — connettività neurale ridotta tra gli scrittori assistiti dall'IA. **Anthropic Skill-Formation** — gli ingegneri che usano l'IA per generare codice ottengono un punteggio **inferiore del 17%** in comprensione rispetto a chi la usa per l'indagine concettuale. Quattro esempi concreti di surrender (revisione di PR di 600 righe basata su segnali superficiali, debugging superficiale, decisioni architetturali prese senza ragionamento, apprendimento degradato). Cinque euristiche personali (pre-generare le aspettative, revisione allo standard di un ingegnere junior, prompting avversariale, consapevolezza della fatica, verifica della fonte della fiducia). Sei barriere strutturali (criteri di uscita per la verifica, tabelle anti-razionalizzazione, **PR di ~100 righe max**, modalità interrogativa piuttosto che generativa, attrito strutturato, **tempo regolare da soli alla tastiera**). Due nuovi concetti: ***Comprehension Debt*** (il divario crescente tra il volume totale della codebase e la comprensione umana) e ***Mutual Amplification*** (un ciclo cooperativo di affinamento dei prompt contrapposto alla delega-surrender). Tesi cardine: ***"la scelta tra pensare con l'IA e non pensare affatto rimane interamente umana"***. Un contrappeso strutturale e operativo a *"coding is solved"* (Cherny 2026-05) e un complemento analitico a Frizzo (2026-05-05).

#Addy Osmani#cognitive surrender#cognitive offloading

Addy Osmani (Software Engineer at Google, Cloud + Gemini, ex-Chrome — déjà au dossier veille avec *Agent Harness Engineering* 2026-04-19, *How to write a good spec for AI agents* 2026-01-13, *Conductors to Orchestrators* 2025-11-01).