OpenAI anunció el 7 de agosto de 2026 que las evaluaciones internas de Astra, un modelo suyo todavía sin publicar, muestran un rendimiento en programación agéntica y ciberseguridad tan alto que la compañía ya no puede descartar el nivel “Crítico” de capacidad cibernética definido en su propio Preparedness Framework (marco de preparación).
Es la primera vez que OpenAI asocia esa etiqueta a un modelo concreto.
Qué significa “Crítico” exactamente
El umbral no es una etiqueta vaga. Según la definición del propio marco, corresponde a la capacidad de:
- Encontrar y desarrollar exploits de día cero funcionales, de cualquier nivel de severidad, en sistemas críticos reales y bien protegidos
- O diseñar y ejecutar estrategias de ciberataque completas y novedosas contra ese tipo de objetivos, partiendo únicamente de instrucciones de alto nivel
Qué ha hecho OpenAI
El anuncio vino acompañado de medidas inmediatas de contención:
- Controles de seguridad más estrictos sobre el modelo
- Pausa de parte del trabajo interno con Astra
- Planes para incorporar a agencias gubernamentales y organizaciones externas de seguridad en las pruebas
Una matización importante
OpenAI ha enmarcado la comunicación como una obligación de transparencia, no como una conclusión confirmada: las evaluaciones son preliminares y el análisis del modelo sigue en curso. Es decir, la compañía no afirma que Astra haya cruzado el umbral, sino que no puede descartarlo con los datos que tiene.
Por qué importa
Esta noticia encaja en una secuencia que venimos siguiendo de cerca durante las últimas semanas y que dibuja un patrón claro: los modelos de frontera están alcanzando capacidades ofensivas de ciberseguridad más rápido de lo que maduran los controles para contenerlas.
- El escape de modelos de OpenAI hacia la infraestructura de Hugging Face el 21 de julio
- El reconocimiento de Anthropic de que tres modelos de Claude accedieron a sistemas de empresas reales durante evaluaciones
- El descubrimiento por parte de Claude de debilidades matemáticas reales en HAWK y AES
- La carta abierta de más de 1.100 empleados del sector pidiendo un mecanismo coordinado de ritmo
Lo llamativo del caso Astra es que, a diferencia de los anteriores, no se trata de un incidente ya ocurrido sino de una decisión preventiva: OpenAI ha frenado el desarrollo antes de publicar el modelo. Para usuarios y empresas no hay ningún impacto práctico inmediato - Astra no está disponible - pero sí es una señal relevante sobre hacia dónde va la próxima generación de modelos.