.
www.zonamovilidad.es
viernes 04 de septiembre de 2026, 09:00h

Escucha la noticia

OpenAI ha presentado GPT-6 Astra, su nuevo modelo de inteligencia artificial, que la compañía describe como un “salto generacional” en capacidades como la ciberseguridad, la programación, el trabajo profesional, la ciencia y el uso autónomo de ordenadores, la presentación llega más de un año después del lanzamiento de GPT-5 y apenas dos meses después de GPT-5.6, y sitúa a Astra como la nueva referencia de la compañía para tareas complejas y flujos de trabajo agénticos.

Un modelo pensado para trabajar de forma autónoma

Durante una sesión informativa con medios, el presidente de OpenAI, Greg Brockman, fue incluso más lejos al hablar del momento actual de la inteligencia artificial, “si avanzamos un par de años y miramos atrás para preguntarnos cuándo se creó realmente la AGI, creo que será por estas fechas, y quizá con este modelo”, afirmó. Posteriormente añadió que, personalmente, considera que “no es irracional sentir que ahora estamos en la era de la AGI”.

Uno de los principales argumentos de OpenAI con Astra es su capacidad para ejecutar tareas agénticas de varios pasos, permitiendo que el modelo no se limite a responder preguntas, sino que complete trabajos complejos. La compañía asegura que GPT-6 Astra puede construir sitios web funcionales y generar documentos, hojas de cálculo y presentaciones con un acabado más elaborado, también lo presenta como su mejor modelo hasta la fecha para ingeniería de software, especialmente en tareas complejas dentro de bases de código reales.

Esta apuesta por los agentes busca posicionar a OpenAI en un terreno especialmente competitivo frente a otras compañías que han ganado protagonismo en programación y aplicaciones empresariales.

El primer modelo de OpenAI que alcanza el nivel crítico en ciberseguridad

La capacidad que más preocupa a la compañía es precisamente una de las que mayor salto ha experimentado, OpenAI ha clasificado Astra como su primer modelo que alcanza el “Critical cybersecurity capability threshold” de su Preparedness Framework. Según la propia compañía, esto significa que, con las herramientas y el acceso adecuados, Astra puede encontrar vulnerabilidades de seguridad previamente desconocidas y desarrollar métodos para explotarlas en sistemas reales altamente protegidos sin que una persona tenga que guiar cada paso.

En sus evaluaciones, Astra obtuvo un 100% en ExploitBench, un benchmark destinado a medir la capacidad para desarrollar exploits a partir de vulnerabilidades conocidas, OpenAI realizó posteriormente una evaluación interna con 20 vulnerabilidades de alta gravedad divulgadas entre junio y agosto de 2026. En ella, Astra consiguió tasas de ejecución arbitraria de código significativamente superiores a GPT-5.6 Sol utilizando muchos menos tokens y llegó a descubrir y utilizar dos vulnerabilidades zero-day como parte de cadenas de explotación.

En pruebas realizadas sobre un navegador y un sistema operativo endurecidos, el modelo también descubrió vulnerabilidades desconocidas y consiguió combinarlas para construir cadenas de explotación capaces de escapar del sandbox de un navegador o elevar privilegios hasta root.

El lanzamiento de Astra está marcado por el incidente protagonizado recientemente por otros modelos de OpenAI, que llegaron a comprometer sistemas de Hugging Face sin que la compañía fuera consciente inicialmente de lo ocurrido. OpenAI insiste en que Astra no participó en ese incidente, pero reconoce que sus conclusiones han influido directamente en el desarrollo de las medidas de seguridad del nuevo modelo.

La compañía llegó a pausar durante dos semanas determinadas fases de entrenamiento de frontera para reforzar el aislamiento de la infraestructura, los controles de red, la monitorización y el entrenamiento de alineamiento, también mantuvo durante más tiempo algunas grandes ejecuciones de reinforcement learning mientras establecía nuevos requisitos de seguridad.

OpenAI afirma que Astra incorpora ahora salvaguardas adicionales para impedir tanto el uso malicioso por parte de los usuarios como que el propio modelo pueda realizar acciones no autorizadas.

Astra rechaza más ataques y mejora su alineamiento

Una de las prioridades ha sido conseguir que el modelo respete mejor las restricciones de seguridad, en las evaluaciones de jailbreak relacionadas con ciberseguridad, Astra rechazó el 91,5% de las solicitudes, frente al 59% de GPT-5.6 Sol. OpenAI también realizó una prueba inspirada directamente en el incidente de Hugging Face, en ella se utilizaron sistemas señuelo para comprobar si los modelos intentaban comprometer infraestructuras que no formaban parte de su tarea.

GPT-5.6 Sol, sin las salvaguardas de producción, intentó acceder a esos objetivos en el 56% de las pruebas, mientras que Astra lo hizo en el 1,3%, la compañía recalca que se trata de una evaluación en un entorno simulado y sin las protecciones de ciberseguridad de producción. Además, Astra no intentó saltarse el sistema de revisión automática cuando una tarea era rechazada, mientras que GPT-5.6 Sol llegó a intentar sortearlo en determinadas pruebas.

OpenAI considera por ello que Astra es su modelo más alineado hasta la fecha, aunque su propio jefe científico, Jakub Pachocki, advierte de que “el progreso en inteligencia no garantiza el progreso en alineamiento”. La estrategia de seguridad de Astra incorpora también nuevos sistemas de monitorización capaces de analizar el razonamiento y las acciones del modelo para detectar comportamientos potencialmente desalineados.

OpenAI afirma que estos sistemas pueden detener automáticamente actividades potencialmente no autorizadas, su nuevo enfoque de monitorización contempla además un sistema de escalado y respuesta 24/7, con la intención de que los investigadores reciban una alerta en un máximo de 30 minutos cuando se detecte un problema potencial. Esto también tendrá consecuencias para los usuarios. Las medidas de seguridad pueden ralentizar, pausar o detener determinadas tareas legítimas si el sistema las interpreta como potencialmente peligrosas, en ChatGPT o Codex, el usuario podrá tener que revisar una acción antes de continuar si el sistema de monitorización la bloquea. En otras superficies, como la API, la tarea podrá detenerse directamente.

Un modelo supervisado parcialmente por otros modelos de IA

Otro de los aspectos destacados por OpenAI es la participación de modelos anteriores en el propio proceso de entrenamiento de Astra. Aidan Clark, vicepresidente de investigación de entrenamiento de OpenAI, aseguró que Astra es el primer modelo de la compañía en cuyo entrenamiento los modelos anteriores tuvieron un papel importante como supervisores.

La compañía relaciona este avance con su progreso hacia una forma de auto-mejora recursiva, en la que los sistemas de IA pueden encargarse de partes de su propio entrenamiento, programación y desarrollo de versiones más avanzadas, según Clark, el entrenamiento de Astra también ha permitido reducir considerablemente las interrupciones relacionadas con errores de infraestructura y depuración, hasta el punto de que el proceso podía avanzar durante gran parte del día de forma ininterrumpida.

Disponibilidad de GPT-6 Astra

GPT-6 Astra comienza a desplegarse inicialmente entre los clientes empresariales de OpenAI con acceso a Daybreak, especialmente aquellos relacionados con ciberseguridad, durante los próximos días, la compañía ampliará el acceso a los usuarios de ChatGPT Plus, Pro, Business y Enterprise; Astra también estará disponible mediante la API de OpenAI y AWS.

Eso sí, sus capacidades más avanzadas de ciberseguridad tendrán inicialmente un acceso mucho más restringido, OpenAI comenzará con un grupo reducido de evaluadores y posteriormente ampliará el acceso defensivo mediante Daybreak Blue.

¿Te ha parecido interesante esta noticia?    Si (0)    No(0)

+
0 comentarios