Vai al contenuto

root / tags / skill

#skill

4 fiches

Agenti di codifica IA e Skills Traduzione verificata automaticamente

DeepSeek Harness developer preview: Everything is a plugin

Pagina prodotto ufficiale di **DeepSeek**, pubblicata il **13 agosto 2026**, **non firmata**, di circa 450 parole, che annuncia il rilascio in *developer preview* di **DeepSeek Harness** (`dsh`) — un harness per agenti di coding **open source con licenza MIT**, il cui repository è stato aperto lo stesso giorno. Una tesi in tre parole, ripetuta nel titolo e nella descrizione del repository: *« Everything is a plugin »*, affiancata da una seconda promessa, *« Every run is traceable »*. La pagina enuncia l'equazione *« AGENT = MODEL + HARNESS »* ed elenca le capacità innestabili come plugin — *« models, tools, skills, sessions, sandboxes, storage, loops, scheduling, and the UI »*. Vengono rilasciate quattro modalità: **modalità Standard** (agente di coding completo), **mode Code** (strumenti esposti tramite il *Code Mode SDK*, che permette al modello di comporre operazioni multi-step all'interno di un programma TypeScript), **mode Minimal** (*« two-tool coding agent with persistent bash and str_replace_editor »*, esplicitamente *« for benchmarking models in a minimal environment »*), e **modalità Creator** (ispezione a runtime, test di plugin in memoria). La sostanza tecnica risiede nel repository, non nella pagina: `docs/architecture.md` enuncia un invariante di logging — *« Model-visible means logged. Anything that reaches a model request must be reconstructable from the log, and a runtime invariant asserts it »* — e afferma che *« there is no privileged core to patch »*. Il nucleo tecnico non è farina del sacco di DeepSeek: DSH è costruito su **Cordis** (il progetto `cordiverse`, terza parte), **vendorizzato** in `vendor/` con un manifesto e una procedura di sincronizzazione, e la pagina colloca il *« Cordis paper »* allo stesso livello di navigazione di "GitHub" e "Developer docs". Vengono rilasciati due adapter LLM — `dsh-llm-deepseek` e `dsh-llm-pi-ai`, un adapter generico multi-provider. Il repository avverte in maiuscolo: *« THERE WILL BE COMPATIBILITY-BREAKING CHANGES »*, e `CLAUDE.md` specifica che `SESSION_FORMAT_VERSION` resta a `0` *« with no compatibility promise »*, con i backend che rifiutano i vecchi formati su disco. Cronologia: DSH viene rilasciato lo stesso giorno in cui **DeepSeek-V4-Pro raggiunge la GA**, tre giorni prima dell'entrata in vigore di un nuovo listino prezzi API il **16 agosto 2026 alle 16:00 UTC**, con tariffe di picco/fuori picco e uno sconto fuori picco del **−50%**.

#DeepSeek Harness#dsh#harness per agenti

**DeepSeek** (DeepSeek AI, laboratoire chinois) · en tant qu'institution. Page produit **non signée** : aucun auteur · aucun ingénieur mis en avant · aucun billet de blog ni papier technique associé. Le « nous » n'apparaît qu'une fois · en dernière phrase — *« We look forward to exploring the limits of intelligence with developers worldwide »*. Publiée le **13 août 2026**. La page est rendue en JavaScript : `curl` sur l'URL renvoie **HTTP 202 avec un corps vide** · le texte n'existant qu'après exécution du bundle. Deux documents de politique sont liés en pied de page — *Safe Use Policy* et *Data Processing Statement*.

Agenti di codifica IA e Skills Traduzione verificata automaticamente

graphify — « Turn any codebase, with its docs, SQL schemas, configs, and PDFs, into a queryable knowledge graph. A /graphify skill for Claude Code, Cursor, Codex, and Gemini CLI: local deterministic AST parsing, every edge explained, no vector store. »

Voce skill: **graphify** di **Safi Shamsi** (Graphify Labs, Y Combinator S26) trasforma un intero progetto — codice, documentazione, PDF, immagini, video — in un **grafo di conoscenza interrogabile**, invocato tramite `/graphify` da Claude Code, Cursor, Codex, Gemini CLI, GitHub Copilot e una quindicina di altri client. Osservato il **6 agosto 2026**: **103.187 stelle**, **10.024 fork**, repository creato il **3 aprile 2026**. Apache-2.0, Python 3.10+, branch predefinito **v8**. **Tre scelte di design**, enunciate nel README. *"Code maps for free, fully local"*: il codice viene analizzato in un **AST tree-sitter**, in modo deterministico e senza LLM, senza che nulla lasci la macchina. *"Every edge is explained"*: ogni arco è etichettato **`EXTRACTED`** (esplicito nella fonte) o **`INFERRED`** (risolto da graphify), con un terzo valore `AMBIGUOUS` che compare nel report. *"Not a vector index"*: *"no embeddings, no vector store: a real graph you traverse"*. **Tre output**: `graph.html` (grafo interattivo), `GRAPH_REPORT.md` (nodi centrali, connessioni sorprendenti, domande suggerite) e `graph.json` (grafo persistente, interrogabile settimane dopo senza rileggere i file). **Tre modalità di interrogazione** in sostituzione di grep: `query` (sottografo per una domanda in linguaggio naturale), `path A B` (percorso più breve tra due entità) e `explain` (vicinato di un concetto). **Copertura**: 36 grammatiche tree-sitter (~40 linguaggi), oltre a Terraform, Apex, configurazioni MCP, manifest di pacchetti, Office, Google Workspace, PDF, immagini e trascrizioni audio/video effettuate localmente da faster-whisper. Comunità rilevate tramite **Leiden**, etichettate senza LLM. **Benchmark**: su LOCOMO, recall@10 di **0,497** contro 0,149 per supermemory e 0,048 per mem0, ma accuratezza QA inferiore (45,3% contro 49,7%); su LongMemEval-S, **76%**, alla pari con un RAG denso; e *"Graph build — LLM credits: 0"*. **Punti da annotare**: il branch `main` porta un README dell'epoca v1 che descrive un prodotto diverso (skill esclusiva per Claude Code, l'affermazione "71,5× meno token"); il pacchetto PyPI si chiama **`graphifyy`** con due *y*, mentre il nome `graphify` è in fase di recupero; e per impostazione predefinita viene scritto un **log delle query** in `~/.cache/graphify-queries.log`, disattivabile tramite una variabile d'ambiente.

#skill#grafo di conoscenza#grafo di conoscenza

**Safi Shamsi** — créateur et mainteneur de graphify · et de **Graphify Labs** · société passée par **Y Combinator (promotion S26)** selon le badge du dépôt. Il maintient aussi le site d'annuaire `graphify.net` (cf. [[graphify-net-annuaire-ia-coding-2026-08-06]]) et publie un livre · *The Memory Layer* · sur les idées et l'architecture derrière le projet.

Agenti di codifica IA e Skills Traduzione verificata automaticamente

hyperresearch — « The Most Powerful Deep Research Harness » / « Agent-driven research knowledge base. Agents collect, search, and synthesize web research into a persistent, searchable wiki. »

Voce **Skill**: **hyperresearch** di **Jordan Gibbs** è un **harness di ricerca approfondita** che trasforma Claude Code in un agente di ricerca documentale, distribuito come pacchetto PyPI (MIT, Python 3.11-3.13) che installa **20 skill Claude Code**, una CLI, un server MCP e una UI web locale. Osservato il **3 agosto 2026**: 1.568 stelle, 170 fork, repository creato il 9 aprile 2026, ultimo push il 1° agosto. **Il nucleo è una pipeline a 16 passaggi adattiva per livelli (tier)** — `light` (~30-40 min), `full` (~1,5-2,5 h), `dissertation` (4-8 h, da 25.000 a 80.000 parole su 300-450 fonti) — che prende un prompt e restituisce un report sottoposto ad audit avversariale con provenienza completa. **La decisione architetturale centrale è documentata insieme al suo modo di fallimento**: la skill d'ingresso è un **router leggero (thin router)** senza procedura propria, ogni passaggio vive nella propria skill caricata **fresca al momento dell'invocazione**, perché la versione precedente era *« una singola skill di 1200 righe che veniva compattata via prima che il Layer 4 avesse bisogno della sua procedura di triplo abbozzo. L'orchestratore ha dimenticato la procedura, ha scritto un'unica bozza e ha prodotto un report dal punteggio piatto. »* **Due principi portanti.** *« Patch, mai rigenerare »*: dopo la sintesi, sono possibili solo ritocchi chirurgici con `Edit`, con il patcher e l'auditor di rifinitura bloccati sugli strumenti (`tool-locked`) a `[Read, Edit]` a livello di allowlist di Claude Code, in modo che *« non possano fisicamente scrivere (Write) una nuova bozza »*. *« La query di ricerca canonica è vangelo »*: il prompt testuale viene salvato una sola volta in `query.md` e riletto da ogni passaggio e da ogni subagente. **Sedici subagenti** con ruolo e modello configurabili (i fetcher e il cite-checker su Sonnet, i critici, il synthesizer e il patcher su Opus). **Il vault** è un archivio markdown persistente indicizzato in SQLite — *« Markdown è la verità, SQLite è la cache »* — con un ciclo di vita delle note (`draft → review → evergreen`, `stale → deprecated → archive`), provenienza tracciabile, un punteggio di qualità composito (tipo di fonte, autorità citazionale tramite OpenAlex e Semantic Scholar con segnalazioni di ritrattazione, PageRank interno), e un **audit di indipendenza** che raggruppa le copie sindacate — *« cinque ristampe di uno stesso comunicato stampa pesano quanto un'unica fonte »*. **Tre gate meccanici prima della pubblicazione**: l'integrità delle citazioni (ogni citazione riportata deve esistere **testualmente** in una nota del vault), una scansione delle ritrattazioni aggiornata su ogni DOI citato, e una verifica del collegamento citazione-frase da parte di un LLM scettico. **Riserva da segnalare**: l'affermazione d'apertura — *« attualmente in testa alla classifica DeepResearch-Bench RACE »* — è contraddetta dalla propria stessa nota a piè di pagina, *« proiezione prospettica da un pilota stratificato… la convalida da parte di terzi è in sospeso »*. Una proiezione non è una classifica, eppure il grafico la colloca davanti a Gemini e OpenAI Deep Research.

#skill#ricerca approfondita#harness di ricerca

**Jordan Gibbs** — auteur et mainteneur du dépôt `jordan-gibbs/hyperresearch`. Le projet est distribué sous **licence MIT** et publié sur **PyPI** (`pip install hyperresearch`). Signaux d'adoption au 3 août 2026 : **1 568 étoiles** · **170 forks** · 13 issues ouvertes · dépôt créé le **9 avril 2026** et poussé le **1er août 2026** — soit une traction rapide sur moins de quatre mois. Topics déclarés : `agents` · `agentskills` · `claude-code` · `deep-research` · `deep-research-agent`.

Agenti di codifica IA e Skills Traduzione verificata automaticamente

grill-with-docs — « Grilling session that challenges your plan against the existing domain model, sharpens terminology, and updates documentation (CONTEXT.md, ADRs) inline as decisions crystallise »

Voce di tipo **Skill** (non un articolo): `grill-with-docs` di Matt Pocock è una tecnica di intervista strutturata che "mette alla griglia" un piano di architettura confrontandolo metodicamente con il vocabolario di business del progetto (il glossario `CONTEXT.md`) e con le decisioni già documentate (gli ADR). Invece di precipitarsi nell'implementazione, mette in discussione le ipotesi una per una attraverso un dialogo domanda/risposta, ripulisce la terminologia, verifica la coerenza rispetto al codice effettivo e cattura le decisioni al volo negli artefatti giusti. Una skill di design a monte (upfront-design), ispirata al Domain-Driven Design.

#skill#grigliata#intervista avversariale

Matt Pocock