# aisi-uk-gpt55-cyber-capabilities-evaluation-2026-04-30

## Veille

Valutazione delle capacità offensive di cybersecurity di GPT-5.5 condotta dall'UK AISI — 95 task CTF, cyber range a 32 fasi, jailbreak universale — AISI Blog

## Titre Article

Our evaluation of OpenAI's GPT-5.5 cyber capabilities

## Date

2026-04-30

## URL

https://www.aisi.gov.uk/blog/our-evaluation-of-openais-gpt-5-5-cyber-capabilities

## Keywords

cybersecurity offensiva, valutazione di modelli IA, GPT-5.5, AISI UK, capture-the-flag, cyber range, jailbreak universale, Mythos Preview, Opus 4.7, GPT-5.4, red teaming, salvaguardie, sfruttamento di vulnerabilità, reverse engineering, crittografia, autonomia a lungo orizzonte, SpecterOps, Crystal Peak Security, The Last Ones

## Authors

AI Safety Institute (AISI UK)

## Ton

**Profilo**: Pubblicazione istituzionale di valutazione tecnica dell'agenzia governativa britannica per la sicurezza dell'IA, registro tecnico-neutro, livello avanzato.

**Descrizione**: Il tono è quello di un rapporto di valutazione governativo: fattuale, metodico e deliberatamente neutro. AISI presenta i propri risultati senza sensazionalismo, con rigore statistico (intervalli di confidenza, errori standard) che ancora le conclusioni alla riproducibilità scientifica. L'autorevolezza deriva dal mandato istituzionale — AISI è l'organismo ufficiale britannico incaricato di valutare la sicurezza dei modelli IA di frontiera prima del deployment. Il testo bilancia la trasparenza sulle crescenti capacità offensive con il riconoscimento degli sforzi di mitigazione di OpenAI. Il pubblico di riferimento è triplice: decisori politici, ricercatori sulla sicurezza IA e la più ampia comunità di cybersecurity.

## Pense-betes

- AISI utilizza una suite di 95 task cyber ristretti in formato CTF distribuiti su 4 livelli di difficoltà (base, intermedio, difficile, esperto) che testano reverse engineering, sfruttamento web e crittografia
- I task di livello base risultano saturati (100%) da tutti i modelli di frontiera almeno da febbraio 2026 — la differenziazione avviene ormai solo sui task di livello esperto
- Sui task esperti (pass@1): GPT-5.5 ottiene 71,4% (+-8,0%), Mythos Preview 68,6% (+-8,7%), GPT-5.4 52,4% (+-9,8%), Opus 4.7 48,6% (+-10,0%) — GPT-5.5 è statisticamente comparabile a Mythos ma nettamente superiore alla generazione precedente
- In pass@5 (il migliore su 5 tentativi), GPT-5.5 raggiunge il 90,5% (+-12,9%) sui task esperti — il punteggio più alto mai misurato da AISI
- I task avanzati sono stati sviluppati in collaborazione con Crystal Peak Security e Irregular, aziende specializzate in cybersecurity
- Limiti di token: 50M token per tentativo per i task ristretti, 100M per i cyber range — le prestazioni continuano a migliorare fino a questi limiti
- "The Last Ones" (TLO): un cyber range a 32 fasi che simula un attacco a una rete aziendale, costruito con SpecterOps, che copre 4 sottoreti e circa 20 host, stimato in 20 ore per un esperto umano
- GPT-5.5 ha completato TLO end-to-end in 2 tentativi su 10 — il secondo modello a riuscirci. Mythos Preview (il primo modello) ci era riuscito in 3/10 tentativi
- Risultato critico sulle salvaguardie: è stato identificato un jailbreak universale dopo 6 ore di red-teaming esperto, in grado di suscitare contenuti offensivi su ogni richiesta cyber malevola testata, anche in modalità agentica multi-turno
- OpenAI ha aggiornato il proprio stack di salvaguardie a seguito di questo risultato, ma un problema di configurazione ha impedito ad AISI di verificare l'efficacia della versione finale
- Conclusione strutturante: le capacità cyber offensive emergono come sottoprodotto dei miglioramenti generali nell'autonomia a lungo orizzonte, nel ragionamento e nella programmazione — il che implica che futuri incrementi siano inevitabili
- OpenAI ha rilasciato GPT-5.5 con le sue "salvaguardie più robuste fino ad oggi", e ha lanciato un prodotto ad accesso limitato, GPT-5.5-Cyber, per i professionisti della cybersecurity difensiva

## RésuméDe400mots

In questa valutazione pre-deployment, l'AI Safety Institute (AISI) del Regno Unito documenta le capacità cyberoffensive di GPT-5.5 di OpenAI, utilizzando la propria suite standardizzata di 95 task capture-the-flag (CTF) distribuiti su quattro livelli di difficoltà, insieme a simulazioni di attacco end-to-end denominate "cyber range".

Sui task di livello esperto in modalità pass@1, GPT-5.5 raggiunge un tasso di successo medio del 71,4% (+-8,0% errore standard), sostanzialmente alla pari con Mythos Preview di Anthropic (68,6% +-8,7%) ma nettamente superiore a GPT-5.4 (52,4%) e Opus 4.7 (48,6%). In pass@5, GPT-5.5 stabilisce un record con il 90,5% (+-12,9%), il punteggio più alto mai misurato da AISI. I task di livello base risultano ormai saturati al 100% da tutti i modelli di frontiera sin da febbraio 2026, lasciando solo i livelli superiori come discriminanti.

La valutazione include anche "The Last Ones" (TLO), un cyber range a 32 fasi costruito con SpecterOps che simula un'intrusione completa in una rete aziendale. Questa simulazione copre quattro sottoreti e circa venti macchine, e richiederebbe a un esperto umano una stima di 20 ore. GPT-5.5 ha completato la catena di attacco end-to-end in 2 tentativi su 10, diventando il secondo modello a riuscirci dopo Mythos Preview (3/10). Le valutazioni sono state condotte con limiti di 50 milioni di token per tentativo per i task ristretti e 100 milioni per i cyber range, con prestazioni in costante miglioramento fino a tali soglie.

Sul fronte delle salvaguardie, AISI ha identificato un jailbreak universale dopo sei ore di red-teaming esperto. Questo attacco ha suscitato contenuti offensivi su tutte le richieste cyber malevole fornite da OpenAI, inclusi scenari agentici multi-turno. OpenAI ha successivamente aggiornato il proprio stack di salvaguardie, sebbene un problema di configurazione abbia impedito ad AISI di verificare l'efficacia della versione finale distribuita.

AISI conclude che la rapida progressione delle capacità cyber si inserisce in una tendenza più ampia: le competenze offensive emergono come sottoprodotto dei miglioramenti nell'autonomia a lungo orizzonte, nel ragionamento e nella programmazione. Se questa ipotesi si conferma, sono da attendersi ulteriori aumenti delle capacità cyberoffensive nei futuri modelli di frontiera. OpenAI ha risposto distribuendo GPT-5.5 con le sue salvaguardie più robuste fino ad oggi e lanciando un prodotto ad accesso limitato, GPT-5.5-Cyber, destinato ai professionisti della cybersecurity difensiva.

## GrapheDeConnaissance

- AISI UK —publie→ evaluation des capacites cyber de GPT-5.5 (DOCUMENT, 0.99)
- GPT-5.5 —mesure→ 71,4% pass@1 sur les taches expert (MESURE, 0.97)
- GPT-5.5 —converge_avec→ Mythos Preview (TECHNOLOGIE, 0.92)
- GPT-5.5 —surpasse→ GPT-5.4 (TECHNOLOGIE, 0.97)
- GPT-5.5 —surpasse→ Opus 4.7 (TECHNOLOGIE, 0.95)
- GPT-5.5 —résout→ The Last Ones (TLO) (TECHNOLOGIE, 0.95)
- SpecterOps —a_créé→ The Last Ones (TLO) (TECHNOLOGIE, 0.9)
- Crystal Peak Security —collabore_avec→ AISI UK (ORGANISATION, 0.88)
- Irregular —collabore_avec→ AISI UK (ORGANISATION, 0.88)
- AISI UK —a_créé→ jailbreak universel (CONCEPT, 0.97)
- jailbreak universel —surpasse→ GPT-5.5 (TECHNOLOGIE, 0.95)
- OpenAI —publie→ GPT-5.5-Cyber (TECHNOLOGIE, 0.9)
- capacites cyber offensives —est_basé_sur→ ameliorations autonomie et raisonnement (CONCEPT, 0.85)
- AISI UK —affirme_que→ les capacites cyber offensives vont continuer a croitre avec les prochains modeles (AFFIRMATION, 0.88)

---
Canonical: https://www.thekb.eu/it/fiches/aisi-uk-gpt55-cyber-capabilities-evaluation-2026-04-30/
