Vai al contenuto

root / tags / cold-start

#cold start

2 fiches

Strumenti e Piattaforme Traduzione verificata automaticamente

ChatGPT Desktop & Claude Desktop vs versions web — Rapport « What ? — So What ? — Now What ? »

Rapporto di ricerca interno datato **12 agosto 2026** (in formato *What? — So What? — Now What?*, indagine condotta tra l'11 e il 12 agosto) su una domanda semplice: le applicazioni **desktop** di ChatGPT e Claude sono migliori delle rispettive versioni **web**? La risposta si articola in due parti. **(A) Esiste un consenso qualitativo solido e ben documentato.** Il punto di partenza è indiscutibile: desktop e web richiamano esattamente gli stessi modelli cloud, l'applicazione essendo solo un'interfaccia verso il servizio — il guadagno risiede quindi interamente nell'involucro applicativo (latenza d'accesso, stabilità nelle sessioni lunghe, impronta di memoria, integrazioni di sistema, fluidità del workflow). Ciò che distingue realmente il desktop, confermato: sul versante OpenAI, una scorciatoia globale (Option/Alt + Spazio), una *companion window* che resta sempre in primo piano, screenshot nativi e, da luglio 2026, la capacità agentica **Codex/Work** integrata nell'app; sul versante Anthropic, **Quick Entry** (macOS), **Desktop Extensions** (installare un server **MCP** locale diventa *"semplice quanto cliccare un pulsante"*), accesso ai file locali, **Cowork** e **Computer Use** (permessi di Accessibilità e registrazione dello schermo). Il web conserva due punti di forza confermati: schede/thread multipli e universalità senza client da installare. **(B) Quasi tutte le cifre in circolazione a sostegno di questo consenso non reggono alla verifica.** L'audit critico del rapporto (§1.5) classifica come **non confermate** sette affermazioni numeriche ampiamente ripetute: il *cold start* "2-3 s contro 8-12 s" (l'unica traccia essendo un aneddotico *"si carica in circa 3 secondi"* su Substack); l'uso di RAM "200-700 MB contro 1,2-2 GB", attribuito a un "Alibaba Product Insights" le cui pagine restituiscono **404**; una percentuale di malfunzionamenti e un dato di retention delle sessioni non rintracciabili; un "Claude +10-20% end-to-end" attribuito a **Skywork**, che in realtà aveva confrontato il proprio agente Windows piuttosto che Claude rispetto al web; una fonte "Cosmo Edge" non rintracciabile; citazioni Zenken AI non confermate; e due post X non autenticati e privi di URL. Il controsegnale è documentato con lo stesso rigore: Yuri Dvoinos descrive un'app Claude Desktop che *"mi fa venire voglia di buttare il portatile dalla finestra"* — utilizzo CPU al 68%, input lag su un MacBook Pro — e il rapporto rileva che entrambe le app sono build **Electron** con livelli nativi. Da qui la formulazione: *il vantaggio del desktop è una promessa di implementazione, non una legge di natura.* **Il "So What"**: poiché il modello è diventato il comune denominatore, l'interfaccia diventa il terreno di scontro — la fusione **Codex + ChatGPT** del 9 luglio 2026 e il tandem Cowork/Computer Use raccontano la stessa storia, *"l'app desktop non è più un client di chat, è un runtime agentico con accesso alla macchina."* Tre conseguenze: il guadagno è un guadagno di **attrito**, non di potenza; per un CIO, il desktop **sposta il confine di fiducia** — Computer Use richiede permessi di sistema sensibili e la fusione Codex colloca esecuzione del codice, browser e connettori all'interno di *"un unico confine di fiducia esteso,"* mentre il browser resta governabile tramite SSO, DLP e CASB; e per chi pubblica, la fragilità delle cifre è essa stessa la notizia. **Il "Now What"** fornisce criteri di scelta individuali, una checklist per il CIO (censire i permessi, disattivare Computer Use e Cowork per impostazione predefinita, delimitare quali estensioni MCP sono autorizzate, organizzare distribuzione e aggiornamenti — su Linux, al di fuori del repository apt, Claude Desktop non si aggiorna da solo) e una direttiva editoriale: citare solo verbatim e date confermati.

#ChatGPT Desktop#Claude Desktop#versione web

**Deep Research Veille Interne** — rapport non signé · produit par une enquête sourcée menée les **11-12 août 2026** et rendu le 12.

Strumenti e Piattaforme Traduzione verificata automaticamente

ZML/LLMD : et si le « Docker des LLM » était français ?

Analisi SFEIR (voce da società di consulenza) del lancio, l'8 luglio 2026, di **LLMD** da parte della startup parigina **ZML** (fondata da **Steeve Morin**, ex VP Engineering di Zenly): un server di inferenza che esegue LLM su **cinque famiglie di chip** (NVIDIA CUDA, AMD ROCm, Google TPU, Intel oneAPI, Apple Metal) **a partire da un'unica codebase**. Tesi strutturante: il training sta cedendo il centro della scena all'**inferenza**, dove si decidono ormai il costo per token, la latenza e soprattutto la **dipendenza dal silicio**. La scommessa di ZML — riassunta dal motto *model to metal* — consiste nel **disaccoppiare il modello dall'hardware** tramite un compilatore scritto in **Zig + MLIR** che produce un binario nativo ermetico, senza Python nel percorso di esecuzione, esposto tramite una **API compatibile con OpenAI**. Due componenti, due licenze: **ZML** (il framework, Apache-2.0, >90% Zig) è open source; **LLMD** (il server) non lo è, gratuito al lancio. L'articolo legge l'oggetto attraverso tre lenti da società di consulenza — **FinOps dei token**, **libertà architetturale** (Design to Exit), **sovranità** (chip europei emergenti, integrazione nel processore VSORA Jotunn8) — per poi emettere un verdetto senza sconti: si tratta di un'**alpha**, da mettere "sotto osservazione attiva", non da adottare oggi.

#Inferenza LLM#serving#ZML

SFEIR (voix éditoriale du cabinet)