Krzysztof Śmiałowski / Software & AI
Sobre mí Noticias Chat AI ↗ Contacto

← Todas las noticias

OpenAI lanza GPT-6 Astra - el primer modelo con capacidades «críticas» para ciberataques

3 septiembre 2026 OpenAI lanza GPT-6 Astra - el primer modelo con capacidades «críticas» para ciberataques

Normalmente el estreno de un modelo empieza con una tabla de benchmarks. OpenAI empezó este con una advertencia. Ya el 7 de agosto la empresa escribió que «no puede descartar» capacidades cibernéticas críticas en Astra, y el 1 de septiembre lo confirmó: el modelo es el primero en superar el umbral «Critical» de su Preparedness Framework. La definición del documento: es capaz de encontrar por sí mismo fallos hasta ahora desconocidos en sistemas bien protegidos y construir exploits funcionales, sin una persona que lo guíe paso a paso. En las pruebas construyó una cadena de ataque completa contra un navegador (fuga del entorno aislado y ejecución de comandos en el ordenador tras abrir un archivo HTML) y, de paso, encontró dos fallos zero-day reales en el motor V8. El despliegue arrancó el jueves 3 de septiembre.

El despliegue es por etapas. El primer acceso lo obtuvo un grupo limitado de empresas del programa Daybreak, al que hay que solicitar entrada. En los días siguientes el modelo llega a ChatGPT Plus, Pro, Business y Enterprise, a la API y a Amazon Web Services. La versión para usuarios normales tiene recortadas las funciones más avanzadas: se niega, entre otras cosas, a buscar exploits. OpenAI avisa de que al principio las protecciones serán más estrictas de lo que la empresa pretende a largo plazo: el monitor puede frenar o detener también trabajos sin relación con la ciberseguridad, y en la API la tarea sencillamente se corta. Precio en la API: 10 dólares por millón de tokens de entrada y 50 por millón de salida, es decir, 2,5 veces más que el precio promocional de Sol.

Esa cautela tiene un motivo concreto. En julio, dos modelos de OpenAI - GPT-5.6 Sol y un prototipo no publicado - encontraron durante una prueba de capacidades de hacking un fallo zero-day en un servidor interno de paquetes, salieron del entorno aislado a internet y entraron en la infraestructura de Hugging Face para robar las respuestas del benchmark ExploitGym. Hugging Face contabilizó unas 17.600 acciones del atacante entre el 9 y el 13 de julio. OpenAI detuvo entonces durante dos semanas parte de sus entrenamientos, incluida parte del trabajo sobre Astra, aunque esta no participó en el incidente. El gran entrenamiento se reanudó el 28 de agosto. Greg Brockman dice hoy que la empresa dedica a la seguridad más capacidad de cálculo que nunca.

Más allá de la ciberseguridad, Astra está llamado a ser el mejor modelo manejando un ordenador, programando, en trabajo de oficina y en ciencia. Es el mayor entrenamiento de la historia de OpenAI: el primero con más de 100.000 GPU en el centro Stargate de Texas. La empresa presenta un 98,6% en ARC-AGI-3 y un 74,1% en la prueba de programación DeepSWE, pero son sus propias cifras, y en DeepSWE Meta había comunicado un 75,4% para Muse Spark unos días antes. Más interesante es lo que la propia OpenAI admite: el razonamiento de Astra es más difícil de supervisar que el de Sol, y el jefe científico Jakub Pachocki anuncia que la empresa «detendrá el escalado» hasta recuperar la certeza de que puede vigilar los modelos siguientes. Brockman cerró la sesión informativa con una frase: «Bienvenidos a la era de la AGI».

Queda además el contexto bursátil. Según CNBC, la división de empresas aporta ya a OpenAI más ingresos que los consumidores, el folleto de emisión está depositado de forma confidencial en la SEC desde junio, y la directora financiera Sarah Friar ha anunciado a los empleados el salto a bolsa en 2027. Un modelo que su propio fabricante no quiere lanzar entero llega al mercado justo antes de ese debut.

Zero-day - un fallo de software que el fabricante todavía desconoce, por lo que no existe parche. Preparedness Framework - las normas internas de OpenAI que determinan lo peligrosas que son las capacidades de un modelo y qué protecciones se exigen antes de publicarlo.