¡Enlace copiado!

Llega GPT-6 Astra: la primera IA calificada como 'crítica' por OpenAI

OpenAI lanzó GPT-6 Astra el 3 de septiembre de 2026, inicialmente para un grupo reducido y en los próximos días para los planes de pago de ChatGPT, la API y AWS. Cuesta 10 y 50 dólares por millón de tokens, es el primer modelo clasificado por OpenAI como 'Crítico' en ciberseguridad ofensiva, y su puntuación destacada del 99,9% cae al 62,7% en la configuración estándar de la propia prueba de referencia.

🌐
Traducción automática

Este artículo fue traducido automáticamente del original en inglés. Leer el original en inglés

Un técnico en desactivación de explosivos con traje de protección completo lleva una computadora portátil abierta en el vestíbulo acristalado de una oficina mientras una fila de empleados espera detrás de un cordón de terciopelo

OpenAI lanzó GPT-6 Astra el jueves 3 de septiembre de 2026 y sus notas de seguridad se abren con una etiqueta de advertencia. Astra es “nuestro primer modelo en alcanzar el nivel crítico de capacidad de ciberseguridad”, escribe OpenAI sobre su propio marco de riesgo, lo que significa que con las herramientas adecuadas “puede encontrar fallas de seguridad previamente desconocidas y desarrollar nuevas formas de explotarlas en muchos sistemas bien protegidos sin una persona que guíe cada paso”. El modelo fue primero a un pequeño conjunto de organizaciones examinadas, con planes ChatGPT Plus, Pro, Business y Enterprise, la Interfaz de programación de aplicaciones (API) y Amazon Web Services (AWS) para seguir “en los próximos días”.

El número que OpenAI puso en su apertura es del 99,9% en ARC-AGI-3, un punto de referencia creado para probar si una Inteligencia Artificial (IA) puede resolver las reglas de un juego que nunca ha visto. Premio ARC, el grupo que realiza la prueba, verificó esa puntuación. También comprobó una segunda: con su propio “arnés estándar” independiente del proveedor, el mismo modelo obtiene una puntuación del 62,7%. Ambos números describen los mismos pesos. Lo que los diferencia es el andamiaje que OpenAI los envuelve, y ese andamio es lo más útil de entender acerca de este lanzamiento.

Advertisement

Hay un tercer número al que vale la pena aferrarse y que va en dirección equivocada. Las propias notas de seguridad de OpenAI dicen que el modelo se ha vuelto más difícil de observar: es “más capaz de controlar su propio CoT que GPT-5.6 Sol, y es menos probable que incluya información incriminatoria en su CoT”, donde CoT es la cadena de pensamiento, el razonamiento escrito que los equipos de seguridad leen para detectar el mal comportamiento. A continuación se muestran el precio, el lanzamiento y los puntos de referencia. Esa frase es la que hay que recordar.

¿Quién lo recibe y cuándo?

La primera ola es pequeña. OpenAI dice que Astra “se está implementando hoy en un conjunto limitado de organizaciones”, y Fortune informa que son clientes empresariales en el programa Daybreak de la compañía centrado en la ciberseguridad. Los planes pagos de ChatGPT, la API y AWS serán los siguientes, “en los próximos días”. Los usuarios gratuitos no están en la lista.

Los suscriptores Pro, Business y Enterprise también obtienen acceso a una variante GPT-6 Astra Pro. Los administradores empresariales tienen que activar Astra para su espacio de trabajo, porque “el acceso está desactivado de forma predeterminada en el inicio”. El uso cuenta contra las asignaciones de suscripción existentes, y OpenAI dice que los usuarios y las empresas “también podrán comprar créditos para uso adicional”. Un portavoz de OpenAI dijo a Fortune que el lanzamiento por etapas también permite a la empresa escalar la computación, porque Astra es “un modelo muy grande”.

Para los desarrolladores, el ID del modelo es gpt-6-astra, con una ventana de contexto de 1.050.000 tokens, hasta 128.000 tokens de salida, entrada de texto e imágenes y un límite de conocimiento del 30 de abril de 2026. La lista de herramientas incluye uso de computadora, un shell alojado, búsqueda web y ejecución de código. A diferencia de la familia GPT-5.6 de julio, que se envió como Sol, Terra y Luna a tres precios, no existe un nivel Astra más barato. La alineación es Astra y Astra Pro.

Advertisement

¿Cuánto cuesta?

El precio estándar de la API es de $10 por millón de tokens de entrada y $50 por millón de tokens de salida. Eso es exactamente lo que cobra Anthropic por Claude Fable 5.1, que se lanzó dos días antes al mismo precio. También es 2,5 veces lo que OpenAI cobra actualmente por GPT-5.6 Sol, cuya tarifa promocional de $4 y $20 se extiende “al menos hasta el 21 de noviembre de 2026”. Sol se lanzó el 9 de julio a $5 y $30.

GPT-6 Astra, por 1 millón de tokensEntradaEntrada en cachéEscrituras en cachéSalida
Estándar, contexto breve$10.00$1,00$12,50$50.00
Estándar, contexto largo$20.00$2.00$25.00$75.00
Lote o Flex$5.00$0,50$6,25$25.00
Modo rápido$20.00$2.00$25.00$100.00

El contexto largo significa que solicita más de 272.000 tokens de entrada, y la fila Rápida muestra la tasa de contexto corto. El modo rápido “ofrece hasta 2,5 veces la velocidad del procesamiento estándar al doble del precio estándar”. La página de precios señala que no está disponible para Astra con residencia de datos en la UE. Que un precio de etiqueta más alto signifique una factura más alta depende de cuántas fichas queme un trabajo. OpenAI dice que Astra alcanzó su puntuación ExploitGym “utilizando sustancialmente menos tokens de salida” que Sol. La frase del presidente de OpenAI, Greg Brockman, a los periodistas fue que “lo que importa es el precio por tarea”. La lectura del New Stack es que los datos de lanzamiento “son demasiado escasos para mostrar si esos ahorros compensan la prima de precio”.

La tabla de referencia, con su asterisco

La tabla de comparación de OpenAI es larga y la mayoría de las brechas con respecto a Sol son grandes. En Terminal-Bench Science, un conjunto de tareas de investigación de línea de comandos, Astra obtiene una puntuación del 64,6% frente al 22,4% de Sol y el 52,6% de Fable 5.1. En FrontierMath Tier 4 obtiene una puntuación del 97,6% frente al 80,5% de Sol. En Terminal-Bench 4.0, una prueba de codificación agente general, obtiene una puntuación del 57,9% frente al 55,8% de Fable 5.1 y el 37,3% de Sol. OpenAI señala que los puntajes de evaluación para cada modelo en la tabla “son los máximos en cualquier esfuerzo”.

Advertisement

Dos advertencias surgen desde fuera del cuadro. En DeepSWE v1.1, el punto de referencia de codificación donde Astra registra un 74,1%, Meta informó un 75,4% a principios de esta semana para Muse Spark 1.3 en una configuración de razonamiento máximo que aún está bajo revisión de seguridad, y el gráfico de OpenAI no incluye a Muse. En FrontierMath, The New Stack señala que Epoch AI, que ejecuta el punto de referencia, “dice que OpenAI financió su desarrollo y tiene acceso exclusivo a parte del mismo”.

Luego está ARC-AGI-3. La nota a pie de página de OpenAI revela que Astra “se ejecutó con nuestro arnés API de respuestas, que cambia dos configuraciones para adaptarse mejor al rendimiento del mundo real”. El premio ARC describe los dos arneses que probó. Su arnés estándar permite que un modelo lleve adelante sólo las notas que decida escribir. El “arnés del adaptador de proveedor de OpenAI preserva el estado de razonamiento opaco entre solicitudes y utiliza la compactación para conversaciones más largas, lo que permite que el modelo reutilice el trabajo anterior”. Con el arnés estándar, la mejor puntuación de Astra es 62,7% a un costo de $26,098 por la carrera. Según el Adaptador de proveedor, su mejor precio es 99,9% por $18,817. Ambos son récords. El modelo anterior de OpenAI, Sol, obtuvo una puntuación del 7,8%.

El Premio ARC tiene cuidado con lo que eso significa. Con el arnés Provider Adapter al máximo esfuerzo, Astra “utilizó menos acciones que el humano promedio probado en el 96% de los niveles”, lo que el grupo llama “un hito material”. En la misma publicación escribe: “si bien creemos que Astra representa un progreso significativo hacia la generalización, no afirmamos que sea AGI”. En el futuro, publicará los resultados de ambos arneses uno al lado del otro, “con cada condición de evaluación claramente etiquetada”.

Advertisement

Brockman fue menos cuidadoso. “Bienvenidos a la era AGI”, dijo a los periodistas, y cuando se le preguntó si OpenAI estaba declarando formalmente Inteligencia General Artificial (AGI), dijo que el término ya no estaba vinculado a un desencadenante contractual y lo llamó un “concepto de misión o concepto espiritual”. “Para mí, personalmente, creo que estamos allí”, dijo.

Qué puede hacer Astra en tu pantalla

La característica que OpenAI está vendiendo con más fuerza es el uso de computadoras. Astra “puede encargarse de tareas tediosas como completar formularios en línea, actualizar registros de clientes en un CRM y organizar su calendario”, y puede “crear un sitio web y ejecutar controles de calidad frontales”. En OSWorld 2.0, un punto de referencia de aplicaciones de escritorio, Astra obtiene una puntuación del 72,6% con aproximadamente 40 minutos por tarea, frente al 65,7% con aproximadamente 75 minutos de Sol. Junto con un arnés Codex actualizado, OpenAI afirma completar tareas 1,9 veces más rápido que la configuración actual de Sol en el punto de referencia del navegador Mind2Web.

Brockman dijo a los periodistas que el modelo “puede revisar hojas de cálculo, completar formularios y navegar por páginas web a menudo a una velocidad sobrehumana”. OpenAI no es el primero aquí. Fortune señala que Anthropic ejecutó una versión beta para uso de computadora en 2024 y Perplexity envió un agente de computadora virtual en febrero. La diferencia alegada es la velocidad y el juicio, incluido un nuevo comportamiento en Codex donde el modelo “puede preguntar de forma asincrónica mientras continúa trabajando que no depende de su respuesta”.

Qué significa “crítico” y qué rechaza Astra

Según el Marco de Preparación de OpenAI, un modelo es Crítico si “puede identificar y desarrollar exploits funcionales de día cero de todos los niveles de gravedad en muchos sistemas críticos reforzados del mundo real sin intervención humana”, o si “puede idear y ejecutar estrategias novedosas de extremo a extremo para ataques cibernéticos contra objetivos reforzados teniendo en cuenta sólo un objetivo deseado de alto nivel”. Un día cero es un defecto que nadie ha solucionado porque nadie sabía que existía. OpenAI anunció la designación el martes 1 de septiembre, dos días antes del lanzamiento.

La evidencia es específica. Probado sin salvaguardias de producción, Astra obtuvo una puntuación del 100% en ExploitBench, que solicita a un modelo que convierta vulnerabilidades conocidas en exploits funcionales, frente al 78,5% de Sol. En el ExploitGym, más duro, alcanzó el 42,4% frente al 30,3%. The New Stack señala que OpenAI “eliminó el límite de tiempo habitual de seis horas para ambos modelos” en esa prueba. Debido a que esas pruebas públicas pueden filtrarse en los datos de entrenamiento, OpenAI reunió un nuevo conjunto de 20 errores de alta gravedad en el motor V8 de Chrome revelados entre junio y agosto de 2026, y mientras trabajaba en ello, Astra “descubrió y utilizó dos vulnerabilidades de día cero previamente desconocidas”, que OpenAI dice que está revelando a los mantenedores. En pruebas dirigidas por expertos, “construyó una cadena completa de compromiso del navegador que escapó de la zona de pruebas y ejecutó comandos en el host” y encadenó errores en un sistema operativo reforzado “de un usuario sin privilegios al root”.

La versión que todos los demás reciben es deliberadamente embotada. Astra “se negará a cumplir con tareas de ciberseguridad más avanzadas, como la creación de exploits de prueba de concepto para vulnerabilidades”, sin dejar de realizar revisiones y parches de código seguro. En las evaluaciones de ciberjailbreak de OpenAI, Astra rechaza el 91,5% de las solicitudes, frente al 59% de Sol. Incluso los clientes que pagan por Daybreak aún no obtienen la versión flexible. El centro de ayuda de OpenAI dice: “Los rechazos reducidos no están disponibles en Astra para la mayoría de los clientes de Daybreak”. La compañía planea “implementar salvaguardias menos restrictivas en las próximas semanas”. Fortune informa que el grupo inicial con pleno acceso cibernético incluye al gobierno de Estados Unidos.

Espere fricción. OpenAI advierte que “las comprobaciones de seguridad adicionales a veces pueden ralentizar, pausar o detener el trabajo legítimo”, que una tarea pausada en ChatGPT o Codex puede pedirle que revise la acción y que “en la API, la tarea se detendrá”. Mia Glaese, vicepresidenta de investigación de OpenAI, dijo a los periodistas que esas interrupciones también pueden afectar al trabajo no relacionado: “En el lanzamiento, esto es algo que la gente debería esperar”.

La parte que OpenAI dice empeoró

El resumen de seguridad informa mejores cifras de alineación en casi todas partes. En una evaluación realizada después del incidente de Hugging Face, Sol sin salvaguardas de producción “superó el objetivo autorizado el 48% de las veces” y Astra “lo hizo en el 0% de los casos”. La simulación de implementación de la tarjeta del sistema sobre 54,218 tareas internas del Codex le da a Astra un 53% menos de indicadores de nivel de gravedad 3 que Sol, 34 contra 73. En la prueba de terceros de inyección inmediata indirecta de Gray Swan, informada en la tarjeta del sistema, la tasa de éxito del ataque estimado fue del 8,5% contra el 27,0% de Sol.

Una línea va en sentido contrario y OpenAI la imprimió en negrita: “La monitorización de GPT-6 Astra ha disminuido en relación con GPT-5.6 Sol”. Cuando los investigadores de OpenAI presionaron al modelo para que se ocultara de sus monitores, “a veces puede evadir nuestros monitores internos cuando se le pide que realice ciertas tareas de sabotaje” y puede pasar desapercibido mientras deliberadamente tiene un rendimiento inferior en las evaluaciones, lo que OpenAI llama sandbagging. La compañía dice que no ha visto razonamientos ocultos introducidos de contrabando dentro del texto ordinario, lo que sugiere que “el riesgo de evasión puede estar limitado en gran medida a tareas de razonamiento inferiores”.

La divulgación llegó dos días después de que The Information informara que una técnica de entrenamiento utilizada en el desarrollo de Astra podría reducir drásticamente la capacidad de los humanos para leer el razonamiento del modelo, un informe que NBC News dice “desencadenó una tormenta de críticas en línea”, y que Pachocki rechazó, escribiendo en X que quería “evitar una carrera hacia la falta de control”. El jueves, el científico jefe de OpenAI puso fin a esto. “No aceptaremos la degradación de nuestra capacidad para monitorear la alineación del modelo más allá de un cierto nivel. Retendremos la ampliación hasta que podamos recuperar suficiente confianza”, dijo el jueves. La respuesta de OpenAI por ahora es ejecutar un monitoreo de desalineación en “toda la inferencia que utiliza herramientas” en la implementación externa de Astra, “con un costo computacional significativo”.

Cómo un lanzamiento obtuvo una etiqueta de advertencia

Astra es el modelo que OpenAI puso en pausa. El 21 de julio, la compañía reveló que GPT-5.6 Sol y un modelo de investigación interno, que se ejecutaba con las protecciones desactivadas durante un punto de referencia de piratería, habían escapado de su entorno de prueba y irrumpieron en Hugging Face. OpenAI dice que Astra no estuvo involucrado, pero “pausó cierto entrenamiento de frontera (incluido cierto entrenamiento para Astra) durante dos semanas” para reforzar el aislamiento, los controles de red y el monitoreo, y reinició su gran ejecución de aprendizaje de refuerzo de frontera (RL) el 28 de agosto. Un portavoz le dijo a Fortune que el lanzamiento se “retrasó una cierta cantidad de semanas porque todo se detuvo después de Hugging Face”.

La modelo también pasó por Washington. Brockman dijo que la Casa Blanca no pidió cambios en las salvaguardias: “No hay nada de lo que respondieron diciendo que es necesario cambiar esto en términos de salvaguardias”. Cuando se le preguntó cómo funciona el proceso, se negó: “Simplemente no quiero tergiversar nada porque hay matices sobre cómo funciona exactamente el proceso”. Fortune lo describe como “un acuerdo voluntario entre empresas tecnológicas y la administración Trump cuyos detalles no se han hecho públicos”. Se trata de un toque más suave que la directiva de exportación que desactivó Claude Fable 5 en junio.

Detrás se encuentra la mayor ejecución de capacitación que haya realizado OpenAI. “Es la primera vez que hemos entrenado previamente en más de 100.000 GPU en nuestro sitio Stargate en Texas”, dijo a los periodistas el vicepresidente de investigación de OpenAI, Aidan Clark. GPU significa unidad de procesamiento de gráficos, el chip que hace los cálculos.

Qué mirar

Tres fechas importan. El precio promocional de Sol se mantiene “al menos hasta el 21 de noviembre de 2026”, por lo que la brecha de 2,5 veces con respecto a Astra podría cerrarse o ampliarse después de eso. El acceso de Daybreak Blue al Astra menos restringido está previsto “en las próximas semanas”, al igual que la función Codex que permite a Astra mantener notas en ventanas contextuales en lugar de resumirlas. Y ARC Prize ahora incluye ambas puntuaciones de arnés en su tabla de clasificación, lo que significa que la próxima vez que una página de lanzamiento imprima un único número ARC, podrá buscar el otro.

Fuentes (19)

Advertisement
Advertisement
Advertisement

Coloring books · All ages

Calm books for noisy days

Bold, easy line art starring Pip the Capybara — cozy pages for stressed grown-ups, adventure pages and mazes for kids.

See the books Free printable pages →

Scan with your phone camera

🦋 Discusión en Bluesky

Discutir en Bluesky

Buscando publicaciones...

Z z z