# aisi-uk-gpt55-cyber-capabilities-evaluation-2026-04-30

## Veille

Evaluación de ciberseguridad ofensiva de GPT-5.5 realizada por la AISI del Reino Unido — 95 tareas CTF, cyber range de 32 pasos, jailbreak universal — AISI Blog

## Titre Article

Our evaluation of OpenAI's GPT-5.5 cyber capabilities

## Date

2026-04-30

## URL

https://www.aisi.gov.uk/blog/our-evaluation-of-openais-gpt-5-5-cyber-capabilities

## Keywords

ciberseguridad ofensiva, evaluación de modelos de IA, GPT-5.5, AISI UK, captura de la bandera, cyber range, jailbreak universal, Mythos Preview, Opus 4.7, GPT-5.4, red teaming, salvaguardas, explotación de vulnerabilidades, ingeniería inversa, criptografía, autonomía de largo alcance, SpecterOps, Crystal Peak Security, The Last Ones

## Authors

AI Safety Institute (AISI UK)

## Ton

**Perfil**: Publicación institucional de evaluación técnica de la agencia gubernamental de seguridad de IA del Reino Unido, registro técnico-neutral, nivel avanzado.

**Descripción**: El tono es el de un informe de evaluación gubernamental: factual, metódico y deliberadamente neutral. AISI presenta sus hallazgos sin sensacionalismo, con rigor estadístico (intervalos de confianza, errores estándar) que fundamenta las conclusiones en la reproducibilidad científica. La autoridad deriva del mandato institucional — AISI es el organismo oficial del Reino Unido encargado de evaluar la seguridad de los modelos de IA de frontera antes de su despliegue. El texto equilibra la transparencia sobre las crecientes capacidades ofensivas con el reconocimiento de los esfuerzos de mitigación de OpenAI. El público objetivo es triple: responsables de políticas públicas, investigadores en seguridad de la IA y la comunidad de ciberseguridad en general.

## Pense-betes

- AISI utiliza un conjunto de 95 tareas cibernéticas acotadas en formato CTF repartidas en 4 niveles de dificultad (básico, intermedio, difícil, experto) que evalúan ingeniería inversa, explotación web y criptografía
- Las tareas básicas están saturadas (100%) por todos los modelos de frontera desde al menos febrero de 2026 — la diferenciación ahora se produce únicamente en las tareas de nivel experto
- En las tareas expertas (pass@1): GPT-5.5 obtiene 71,4% (+-8,0%), Mythos Preview 68,6% (+-8,7%), GPT-5.4 52,4% (+-9,8%), Opus 4.7 48,6% (+-10,0%) — GPT-5.5 es estadísticamente comparable a Mythos pero marcadamente superior a la generación anterior
- En pass@5 (mejor de 5 intentos), GPT-5.5 alcanza 90,5% (+-12,9%) en tareas expertas — la puntuación más alta jamás medida por AISI
- Las tareas avanzadas se construyeron en colaboración con Crystal Peak Security e Irregular, empresas especializadas en ciberseguridad
- Límites de tokens: 50M de tokens por intento para tareas acotadas, 100M para los cyber ranges — el rendimiento sigue mejorando hasta estos límites
- "The Last Ones" (TLO): un cyber range de 32 pasos que simula un ataque a una red corporativa, construido con SpecterOps, que abarca 4 subredes y unos 20 hosts, estimado en 20 horas para un experto humano
- GPT-5.5 completó TLO de extremo a extremo en 2 de 10 intentos — el segundo modelo en lograrlo. Mythos Preview (el primer modelo) lo había conseguido en 3/10 intentos
- Hallazgo crítico sobre salvaguardas: se identificó un jailbreak universal tras 6 horas de red-teaming experto, que provocó contenido ofensivo en todas las solicitudes cibernéticas maliciosas probadas, incluso en modo agéntico multi-turno
- OpenAI actualizó su pila de salvaguardas tras este hallazgo, pero un problema de configuración impidió que AISI verificara la eficacia de la versión final
- Conclusión estructurante: las capacidades cibernéticas ofensivas emergen como subproducto de las mejoras generales en la autonomía de largo alcance, el razonamiento y la programación — lo que implica que futuros aumentos son inevitables
- OpenAI publicó GPT-5.5 con sus "salvaguardas más robustas hasta la fecha" y lanzó un producto de acceso restringido, GPT-5.5-Cyber, para profesionales de la ciberseguridad defensiva

## RésuméDe400mots

En esta evaluación previa al despliegue, el Instituto de Seguridad de la IA del Reino Unido (AISI) documenta las capacidades ciberofensivas de GPT-5.5 de OpenAI, utilizando su conjunto estandarizado de 95 tareas de captura de la bandera (CTF) repartidas en cuatro niveles de dificultad, junto con simulaciones de ataque de extremo a extremo denominadas "cyber ranges".

En las tareas de nivel experto con pass@1, GPT-5.5 alcanza una tasa de éxito media del 71,4% (+-8,0% de error estándar), sustancialmente equiparable a Mythos Preview de Anthropic (68,6% +-8,7%) pero marcadamente superior a GPT-5.4 (52,4%) y Opus 4.7 (48,6%). En pass@5, GPT-5.5 establece un récord con 90,5% (+-12,9%), la puntuación más alta jamás medida por AISI. Las tareas básicas están ahora saturadas al 100% por todos los modelos de frontera desde febrero de 2026, dejando únicamente los niveles superiores como discriminantes.

La evaluación incluye también "The Last Ones" (TLO), un cyber range de 32 pasos construido con SpecterOps que simula una intrusión completa en una red corporativa. Esta simulación abarca cuatro subredes y unas veinte máquinas, y le tomaría a un experto humano un estimado de 20 horas. GPT-5.5 completó la cadena de ataque de extremo a extremo en 2 de 10 intentos, convirtiéndose en el segundo modelo en lograr esta hazaña tras Mythos Preview (3/10). Las evaluaciones se realizaron con límites de 50 millones de tokens por intento para las tareas acotadas y 100 millones para los cyber ranges, con un rendimiento que sigue mejorando hasta esos topes.

En cuanto a las salvaguardas, AISI identificó un jailbreak universal tras seis horas de red-teaming experto. Este ataque provocó contenido ofensivo en la totalidad de las solicitudes cibernéticas maliciosas proporcionadas por OpenAI, incluso en escenarios agénticos multi-turno. OpenAI actualizó posteriormente su pila de salvaguardas, aunque un problema de configuración impidió que AISI verificara la eficacia de la versión final desplegada.

AISI concluye que la rápida progresión de las capacidades cibernéticas forma parte de una tendencia más amplia: las habilidades ofensivas emergen como subproducto de las mejoras en la autonomía de largo alcance, el razonamiento y la programación. Si esta hipótesis se confirma, cabe esperar nuevos aumentos en la capacidad ciberofensiva de los próximos modelos de frontera. OpenAI respondió desplegando GPT-5.5 con sus salvaguardas más robustas hasta la fecha y lanzando un producto de acceso restringido, GPT-5.5-Cyber, destinado a profesionales de la ciberseguridad defensiva.

## GrapheDeConnaissance

- AISI UK —publie→ evaluation des capacites cyber de GPT-5.5 (DOCUMENT, 0.99)
- GPT-5.5 —mesure→ 71,4% pass@1 sur les taches expert (MESURE, 0.97)
- GPT-5.5 —converge_avec→ Mythos Preview (TECHNOLOGIE, 0.92)
- GPT-5.5 —surpasse→ GPT-5.4 (TECHNOLOGIE, 0.97)
- GPT-5.5 —surpasse→ Opus 4.7 (TECHNOLOGIE, 0.95)
- GPT-5.5 —résout→ The Last Ones (TLO) (TECHNOLOGIE, 0.95)
- SpecterOps —a_créé→ The Last Ones (TLO) (TECHNOLOGIE, 0.9)
- Crystal Peak Security —collabore_avec→ AISI UK (ORGANISATION, 0.88)
- Irregular —collabore_avec→ AISI UK (ORGANISATION, 0.88)
- AISI UK —a_créé→ jailbreak universel (CONCEPT, 0.97)
- jailbreak universel —surpasse→ GPT-5.5 (TECHNOLOGIE, 0.95)
- OpenAI —publie→ GPT-5.5-Cyber (TECHNOLOGIE, 0.9)
- capacites cyber offensives —est_basé_sur→ ameliorations autonomie et raisonnement (CONCEPT, 0.85)
- AISI UK —affirme_que→ les capacites cyber offensives vont continuer a croitre avec les prochains modeles (AFFIRMATION, 0.88)

---
Canonical: https://www.thekb.eu/es/fiches/aisi-uk-gpt55-cyber-capabilities-evaluation-2026-04-30/
