IA5 MIN

GPT-6 Astra ya es oficial: llegará a ChatGPT Plus y Pro en los próximos días

OpenAI promete grandes mejoras en programación, ciencia y uso del ordenador. Las primeras pruebas independientes confirman el avance como agente, pero no ven el mismo salto en inteligencia general.

Imagen oficial de OpenAI Developers para el modelo GPT-6 Astra
Imagen: OpenAI
01

Cuándo estará disponible en ChatGPT Plus y Pro

OpenAI ha presentado GPT-6 Astra y ya ha empezado a desplegarlo en un grupo limitado de organizaciones mediante sus programas Trusted Access y Daybreak Access. La compañía afirma que llegará durante los próximos días a ChatGPT Plus, Pro, Business y Enterprise, además de la API y Amazon Web Services. No ha dado una fecha ni una hora exactas para cada cuenta.

Los suscriptores de Plus recibirán el modelo GPT-6 Astra estándar. Pro, Business y Enterprise también tendrán acceso a GPT-6 Astra Pro, una variante que dedica más cálculo a los problemas difíciles. OpenAI asegura que ambos se incluyen dentro de los límites actuales de cada suscripción y permitirá comprar créditos cuando se agote el uso incluido. En Enterprise estará desactivado por defecto al principio y cada administrador decidirá cuándo habilitarlo.

La empresa no menciona ChatGPT Free ni Go en este lanzamiento. Tampoco ha anunciado una subida en el precio de Plus o Pro. Hasta que termine el despliegue, el selector de modelos de cada cuenta será la forma más fiable de comprobar si Astra ya está disponible.

02

Qué cambia frente a GPT-5.6 Sol

Astra no amplía la memoria máxima de Sol. Los dos admiten 1.050.000 tokens de contexto y hasta 128.000 tokens de salida. La ficha técnica oficial sí adelanta la fecha de corte del conocimiento del 16 de febrero al 30 de abril de 2026. Nuestro análisis de GPT-5.6 Sol explica de dónde venía el modelo al que sustituye. Astra también elimina el nivel de razonamiento `none`: el ajuste más bajo pasa a ser `low` y puede elevarse hasta `max`.

En la API, el nuevo modelo cuesta 10 dólares por millón de tokens de entrada y 50 dólares por millón de salida, frente a los 4 y 20 dólares de GPT-5.6 Sol. La entrada almacenada en caché sube de 0,40 a 1 dólar. Es exactamente 2,5 veces más por token. Las solicitudes que superen 272.000 tokens reciben además un multiplicador de precio. Esas tarifas corresponden a desarrolladores y no modifican por sí mismas el precio de ChatGPT.

Los resultados de OpenAI muestran mejoras claras en tareas con herramientas. Astra obtiene un 72,6% frente al 65,7% de Sol en OSWorld 2.0, un 92,7% frente al 76,9% en ScreenSpot-Pro y un 57,9% frente al 37,3% en Terminal-Bench 4.0. En investigación científica con terminal pasa del 22,4% al 64,6%, y en AutomationBench sube del 18,1% al 41,4%. Son evaluaciones publicadas por OpenAI, así que sirven para identificar dónde espera la empresa el avance, no como veredicto independiente.

ARC Prize encontró una diferencia enorme según la forma de ejecutar el modelo: Astra logró un 62,7% con su sistema estándar y un 99,9% con el adaptador proporcionado por OpenAI. El segundo resultado conserva el razonamiento interno y la compactación de contexto del producto. Publicar únicamente el 99,9% ocultaría que el entorno de ejecución cambia mucho el resultado.

Comparación independiente de GPT-6 Astra y GPT-5.6 Sol en inteligencia general y programación con agentes
Imagen: Artificial Analysis
03

Astra está diseñado para trabajar con herramientas durante más tiempo

El cambio más importante aparece cuando el modelo tiene que actuar, esperar un resultado y continuar. Astra permite llamar herramientas de forma asíncrona, recibir nuevas instrucciones en mitad de una tarea y cambiar el nivel de razonamiento sin perder la caché. OpenAI también afirma que mantiene mejor el objetivo cuando el encargo se alarga o cuando una aplicación cambia mientras el agente la utiliza.

La API admite búsqueda web y de archivos, generación de imágenes, ejecución de código, terminal alojado, edición mediante parches, control del ordenador, servidores MCP y búsqueda de herramientas. Durante el despliegue de los próximos días, ChatGPT no mostrará necesariamente todas esas funciones en todas las cuentas. La lista describe lo que soporta el modelo y lo que los desarrolladores pueden integrar.

Según OpenAI, Astra terminó las tareas de OSWorld un 47% más rápido y, dentro de su entorno de programación, completó Mind2Web 1,9 veces más deprisa que la experiencia actual con Sol. La evaluación independiente de Artificial Analysis también detectó una mejora práctica: Astra alcanzó 67 puntos en su Coding Agent Index y utilizó alrededor de un 70% menos de tokens que Sol en el nivel máximo. Esa eficiencia compensó el precio superior por token en las pruebas de programación.

Resultados de GPT-6 Astra y otros modelos en el Coding Agent Index y consumo de tokens por tarea
Imagen: Artificial Analysis
04

Las pruebas independientes no ven el mismo salto en todas las tareas

Artificial Analysis asigna a Astra 61 puntos en su Intelligence Index, la misma cifra que GPT-5.6 Sol y cinco puntos menos que Claude Fable 5.1. También registró retrocesos de dos o tres puntos en algunas pruebas de banca, programación científica y razonamiento con contextos largos. En ese conjunto general, Astra generó cerca de un 10% menos de tokens, pero el precio por tarea terminó siendo aproximadamente un 75% mayor que con Sol.

Hay una mejora destacable en fiabilidad. En AA-Omniscience, la tasa de respuestas alucinadas bajó del 92% de Sol al 51% de Astra y la precisión aumentó cuatro puntos. El porcentaje sigue siendo alto porque la prueba obliga a contestar preguntas muy difíciles y mide si el modelo reconoce lo que no sabe. Aun así, la diferencia indica que Astra se inventa menos respuestas bajo esa presión.

La seguridad condicionará parte de lo que pueda hacer. Astra es el primer modelo de OpenAI que alcanza su umbral cibernético Critical, después de encontrar dos vulnerabilidades desconocidas y completar ataques de laboratorio que Sol no resolvía. La empresa restringirá las funciones cibernéticas más avanzadas y vigilará posibles desalineamientos durante el uso. También reconoce que el razonamiento escrito de Astra es más difícil de supervisar que el de Sol, un límite relevante cuando el agente trabaja durante mucho tiempo. Explicamos las pruebas y las restricciones en nuestro análisis de la capacidad cibernética de Astra.

Para tareas breves de conversación, los datos disponibles no justifican esperar una transformación similar a la que muestran los benchmarks de agentes. Astra resulta más interesante para programar, investigar, operar aplicaciones o coordinar varias herramientas. Plus permitirá probar ese modelo estándar. Pro añadirá Astra Pro para los encargos que necesiten más cálculo. La comparación real deberá repetirse cuando ambos aparezcan en ChatGPT y conozcamos sus límites de uso.

Comparación independiente de precisión y alucinaciones entre GPT-6 Astra y GPT-5.6 Sol
Imagen: Artificial Analysis
00

La conversación empieza aquí

Accede con una cuenta de apoyo para comentar. Entrar

Todavía no ha comentado nadie. ¿Estrenas tú?

TU SIGUIENTE RUTA

Sigue tirando del hilo de Modelos y agentes de IA

Si este tema te interesa, estas tres piezas son el mejor lugar por el que seguir.

ABRIR EL TEMA COMPLETO
  1. 01OpenAI confirma que Astra llegará pronto: es su primera IA con capacidad cibernética críticaIA · 5 MIN
  2. 02Claude Fable 5.1 y Mythos 5.1 ya están aquí: Anthropic mejora sus agentes y marca todo lo que escribenIA · 5 MIN
  3. 03Google lanza Gemini Omni 1.1 Flash, el «Nano Banana» del vídeo que edita clips con una fraseIA · 4 MIN

SIGUE LEYENDO

También te puede interesar

PORTADA