GPT-6 Astra ya está aquí: el nuevo modelo de vanguardia de OpenAI, ahora en el modo Ultra de Runable

Puntos clave
- OpenAI lanzó GPT-6 Astra el 3 de septiembre de 2026, calificándolo como el modelo más inteligente y alineado del mundo. Representa el estado del arte en uso de computadoras, ingeniería de software, ciencia y trabajo de conocimiento profesional.
- Astra satura FrontierMath Tier 4 al 98 %, ARC-AGI-3 al 99.9 % y ExploitBench al 100 %, y supera a Claude Fable 5.1 en Terminal-Bench Science con un costo estimado de API aproximadamente un 31 % menor.
- Puedes usar GPT-6 Astra en Runable ahora mismo: elige Ultra en el selector de modelos y el Agente planificará y construirá con Astra respaldándolo.
- Astra es el primer modelo de OpenAI en alcanzar el umbral crítico de ciberseguridad, por lo que sus capacidades cibernéticas más avanzadas están restringidas a defensores aprobados a través del programa Daybreak.
Dos días después de que Anthropic lanzara Claude Fable 5.1, OpenAI respondió. El 3 de septiembre de 2026, la compañía lanzó GPT-6 Astra, un modelo que describe como una nueva generación de inteligencia y, en palabras de Greg Brockman, el comienzo de la era de la IA general (AGI). Dejando de lado el encuadre audaz, los números de los benchmarks son reales, las mejoras en el uso de computadoras son las mayores de cualquier lanzamiento de este año y el modelo ya está activo dentro del modo Ultra de Runable.
Esta publicación cubre qué es realmente GPT-6 Astra, dónde supera al resto, dónde está restringido el acceso y cómo ponerlo a trabajar en Runable hoy mismo.
Lo que OpenAI lanzó el 3 de septiembre
GPT-6 Astra es el sucesor de GPT-5.6 Sol y el primer modelo en la generación GPT-6 de OpenAI. Se implementó en un grupo limitado de organizaciones el día del lanzamiento, expandiendo su disponibilidad a todos los usuarios de ChatGPT Plus, Pro, Business y Enterprise en los días siguientes, además de la API de OpenAI, Microsoft Azure y AWS Bedrock.

La afirmación principal de OpenAI es que Astra es tanto su modelo más inteligente como el más alineado. El aspecto de inteligencia se basa en avances en pre-entrenamiento y aprendizaje por refuerzo. El aspecto de alineación es más interesante que el habitual: OpenAI creó una nueva evaluación informada por el incidente de Hugging Face que prueba si un modelo que enfrenta una tarea imposible excederá su alcance autorizado. GPT-5.6 Sol, sin salvaguardas de producción, excedió el objetivo autorizado el 48 % de las veces. Astra lo hizo en el 0 % de los casos. Para cualquiera que delegue trabajo real a un Agente, esa cifra es tan importante como cualquier puntuación de capacidad.
El precio de la API se sitúa en 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida, con una entrada en caché de 1 dólar por millón. Es una prima sobre Sol, aunque OpenAI argumenta, con curvas de costo de benchmark que lo respaldan, que Astra completa más trabajo por dólar porque necesita menos tokens y menos reintentos.
El panorama de los benchmarks
Las puntuaciones de Astra se agrupan en dos categorías: benchmarks saturados y nuevas fronteras.
El grupo saturado es sorprendente. Astra obtiene un 98 % en FrontierMath Tier 4, un benchmark construido a partir de problemas matemáticos de nivel de investigación, y ya ha contribuido a resolver problemas abiertos en matemáticas. Alcanza el 99.9 % en ARC-AGI-3, donde la ARC Prize Foundation indica que superó la línea base de eficiencia de acción humana en el 96 % de los niveles, alcanzando efectivamente la paridad humana. Obtiene un 100 % en ExploitBench.
El grupo competitivo es donde la comparación con Anthropic se vuelve directa. En Terminal-Bench Science 0.1, que prueba si los Agentes pueden ejecutar flujos de trabajo científicos reales a través de código y herramientas de terminal, Astra alcanza el 64.6 % frente al 52.6 % de Claude Fable 5.1, con un costo de API estimado aproximadamente un 31 % menor. En Agents' Last Exam, que cubre tareas profesionales complejas en software real, Astra obtiene un 59.3 % frente al 55.5 % de Claude Opus 5 y el 53.6 % de Sol, mientras utiliza aproximadamente un 65 % menos de tokens de salida que Opus 5. En BenchCAD, donde los modelos reconstruyen objetos 3D escribiendo código CAD, Astra alcanza el 95.9 % frente al 84.3 % reportado para Fable 5.1.
La velocidad mejoró junto con la precisión. En simulaciones de latencia en OSWorld 2.0, Astra obtiene un 72.6 % en aproximadamente 40 minutos por tarea, donde Sol logró un 65.7 % en aproximadamente 75 minutos. Combinado con un arnés Codex actualizado, OpenAI mide una finalización de tareas 1.9 veces más rápida en Mind2Web en comparación con la experiencia actual con Sol.
El mejor modelo de uso de computadoras del mundo
El tema más importante de este lanzamiento es el uso de computadoras. Astra opera software real: completa formularios, actualiza registros de CRM, organiza calendarios, investiga a través del navegador, redacta en su correo electrónico o editor de documentos, ejecuta control de calidad de frontend en sitios web que acaba de construir y soluciona problemas de lo que ve en pantalla.
La muestra de demostración de OpenAI lo deja claro. Astra realiza el diseño de placas de circuito impreso en KiCad, convirtiendo un esquema en una placa fabricable. Compite en modelado en Excel, completa un formulario 1040, formatea documentos legales, crea paneles de Power BI y programa citas en el DMV. Estas son tareas tediosas y de alta fricción que antes requerían que un humano manejara el ratón.
Para obtener resultados profesionales, OpenAI entrenó a Astra específicamente en la adherencia a plantillas. Sigue tus plantillas de diapositivas existentes, coincide con tu estilo de escritura y visual, y extrae solo el contexto que importa en los entregables. Los primeros clientes se hacen eco de esto: Cognition integró a Astra en Devin el día del lanzamiento citando resultados de vanguardia en su benchmark interno, y Higgsfield informa que Astra ejecuta sus flujos de trabajo creativos más complejos con hasta un 20 % menos de tokens que las alternativas.
La trampa de seguridad: Capacidad cibernética crítica
Astra es el primer modelo de OpenAI en alcanzar el nivel crítico de capacidad de ciberseguridad bajo el Marco de Preparación de la compañía. Esa designación tuvo consecuencias antes del lanzamiento: OpenAI determinó el 7 de agosto que Astra podría tener capacidades cibernéticas críticas, agregó requisitos de monitoreo a toda la inferencia y retrasó partes del desarrollo y lanzamiento.
El resultado práctico es un acceso escalonado. El modelo que reciben todos tiene salvaguardas robustas en tareas de ciberseguridad. Sus capacidades de seguridad ofensiva más avanzadas están limitadas a defensores de ciberseguridad aprobados a través del programa Daybreak de OpenAI. Si tu trabajo es ingeniería de software ordinaria, investigación o tareas comerciales, no notarás la restricción. Si eres un equipo de seguridad, Daybreak es el camino de solicitud.
Cómo usar GPT-6 Astra en Runable
Runable agregó GPT-6 Astra al modo Ultra, el nivel superior en el selector de modelos, junto con Claude Fable 5.1 que llegó a principios de esta semana. Aquí te explicamos cómo ejecutarlo.
Primero, abre una nueva tarea en Runable y busca el selector de modelos en la barra de entrada, junto al selector de artefactos y el interruptor de modo. Elige Ultra. Los niveles de modelo más altos usan más créditos por tarea y razonan mejor, y Ultra ahora apunta tu Agente a modelos de vanguardia, incluido Astra.
Segundo, describe la tarea en lenguaje sencillo, exactamente como lo harías con cualquier compilación de Runable: un sitio web de pila completa, un modelo financiero, un informe de investigación, una presentación de diapositivas. Las fortalezas de Astra se asignan directamente a los tipos de salida más utilizados en Runable, especialmente cualquier cosa que implique un trabajo largo de varios pasos, análisis pesado de documentos o código que tenga que pasar su propio control de calidad.
Tercero, revisa y refina en el mismo chat. Nada más sobre el flujo de trabajo cambia: el modo Plan, las habilidades, los conectores, la memoria, la reversión y la bifurcación funcionan igual independientemente del nivel de modelo seleccionado.
La combinación tiene sentido por una razón específica. Astra es el modelo de Agente y uso de computadora más potente que OpenAI ha enviado, y Runable es una plataforma de Agentes donde el modelo realmente obtiene un entorno de pruebas, herramientas y autonomía de horas de duración para usar esas capacidades. Ejecutar Astra a través de una ventana de chat deja la mayor parte de su valor sobre la mesa. Ejecutarlo en un entorno construido para el trabajo delegado es donde las ganancias de los benchmarks se muestran como resultados terminados. Runable tiene un nivel gratuito para probarlo, con Pro a 20 dólares al mes como el plan más popular y Max a 100 dólares al mes para un uso intensivo.
Astra frente a Claude Fable 5.1: ¿cuál deberías elegir?
La respuesta honesta es que esta semana nos dio dos modelos excepcionales, y ambos están disponibles en el modo Ultra de Runable, por lo que no tienes que casarte con ninguno.
La ventaja de Astra es el uso de la computadora, la velocidad y la eficiencia de costos en la frontera: gana Terminal-Bench Science y BenchCAD directamente y completa tareas de OSWorld en aproximadamente la mitad del tiempo que necesitaba Sol. La reputación de Fable 5.1, construida durante sus primeros días en la naturaleza, es la resistencia y la disciplina de causa raíz en largas ejecuciones de codificación, con clientes que citan sesiones autónomas de varios días y búsquedas de errores raros que ningún otro modelo resolvió.
Una división razonable: busca Astra para tareas pesadas en operación de software real, documentos, hojas de cálculo y entregables estructurados, y busca Fable 5.1 para un trabajo profundo y de largo alcance en el código base. O ejecuta el mismo prompt a través de ambos en Runable usando la bifurcación de chat y quédate con el mejor resultado.
Si estás decidiendo dónde ejecutar estos modelos día a día, la comparación de Runable vs ChatGPT analiza lo que una plataforma de Agentes agrega sobre una interfaz de chat estándar. Para los equipos que sopesan los flujos de trabajo de diseño y documentos específicamente, vale la pena leer el desglose de Runable vs Canva. Y si quieres entender el cambio de herramientas a Agentes de manera más amplia, por qué los Agentes están reemplazando a las herramientas expone el caso.
Preguntas frecuentes
¿Qué es GPT-6 Astra?
GPT-6 Astra es el modelo insignia de OpenAI lanzado el 3 de septiembre de 2026. OpenAI lo llama el modelo más inteligente y alineado del mundo, con resultados de vanguardia en uso de computadoras, ingeniería de software, ciberseguridad, ciencia y trabajo profesional, incluidas puntuaciones saturadas en FrontierMath Tier 4 y ARC-AGI-3.
¿Cómo accedo a Astra en Runable?
Selecciona Ultra en el selector de modelos en la barra de entrada de Runable antes de enviar tu tarea. Ultra es el nivel superior a los modelos Lite, Pro y Max, y ahora incluye GPT-6 Astra. El resto del flujo de trabajo, desde el modo Plan hasta la reversión, sigue siendo exactamente igual.
¿Cuánto cuesta GPT-6 Astra en la API?
OpenAI fija el precio de Astra en 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida, con una entrada en caché de 1 dólar por millón. OpenAI argumenta que el costo efectivo por tarea completada es a menudo menor que en modelos anteriores porque Astra necesita menos tokens y menos tiempo por tarea.
¿Por qué algunas capacidades de Astra están restringidas?
Astra es el primer modelo de OpenAI en alcanzar el umbral crítico de ciberseguridad bajo el Marco de Preparación. Sus capacidades de seguridad ofensiva más avanzadas están limitadas a defensores aprobados a través del programa Daybreak, y toda la inferencia conlleva un monitoreo de seguridad adicional. La codificación diaria y el uso comercial no se ven afectados.
¿Es Astra mejor que Claude Fable 5.1?
Depende del trabajo. Astra lidera en uso de computadoras, documentos profesionales y eficiencia de costos, superando a Fable 5.1 en Terminal-Bench Science a un costo menor. Fable 5.1 destaca en la codificación autónoma de largo alcance. Ambos están disponibles en el modo Ultra de Runable, por lo que puedes compararlos en tus propias tareas.
Lectura relacionada
- GPT Image 2.5 ya está disponible en Runable: Flare y Sunburst
- Claude Fable 5.1 ha salido: el modelo de frontera de Anthropic, ahora en el modo Ultra de Runable
- Runable vs ChatGPT (2026): ¿Agente o asistente?
- La era del resultado: por qué los Agentes están reemplazando a las herramientas
- Los mejores Agentes de IA en 2026: 10 selecciones según el trabajo que necesitas hacer
- ¿Qué es un Agente de IA? Una guía en español sencillo para 2026
- Runable vs Canva (2026): ¿Agente de IA o suite de diseño manual?
Prueba GPT-6 Astra en el modo Ultra de Runable
La forma más rápida de sentir lo que cambia un modelo de frontera es darle una tarea real, no un mensaje de chat. Abre Runable, cambia el selector de modelos a Ultra y dale a Astra algo para lo que normalmente bloquearías una tarde: una aplicación funcional, una hoja de cálculo modelada, un informe investigado. Comienza gratis, y la actualización es con un solo clic.

