O GPT-6 Astra chegou: o novo modelo de fronteira da OpenAI, agora no modo Ultra da Runable

by Eshaan Pawan
Summarize with:
O GPT-6 Astra chegou: o novo modelo de fronteira da OpenAI, agora no modo Ultra da Runable

Principais conclusões

  • A OpenAI lançou o GPT-6 Astra em 3 de setembro de 2026, descrevendo-o como o modelo mais inteligente e alinhado do mundo. Ele representa o estado da arte em uso de computador, engenharia de software, ciência e trabalho profissional de conhecimento.
  • O Astra satura o FrontierMath Tier 4 em 98%, o ARC-AGI-3 em 99,9% e o ExploitBench em 100%, superando o Claude Fable 5.1 no Terminal-Bench Science com um custo de API estimado cerca de 31% menor.
  • Você pode usar o GPT-6 Astra na Runable agora mesmo: selecione Ultra no seletor de modelos e o Agente planeja e constrói com o Astra por trás.
  • O Astra é o primeiro modelo da OpenAI a atingir o limite crítico de segurança cibernética, portanto, seus recursos cibernéticos mais avançados são restritos a defensores aprovados por meio do programa Daybreak.

Dois dias após a Anthropic lançar o Claude Fable 5.1, a OpenAI respondeu. Em 3 de setembro de 2026, a empresa lançou o GPT-6 Astra, um modelo que ela descreve como uma nova geração de inteligência e, nas palavras de Greg Brockman, o início da era da AGI. Deixando de lado a estrutura ousada, os números de benchmark são reais, os ganhos em uso de computador são os maiores de qualquer lançamento este ano, e o modelo já está disponível no modo Ultra da Runable.

Este artigo aborda o que o GPT-6 Astra realmente é, onde ele supera a concorrência, onde o acesso é restrito e como colocá-lo para trabalhar na Runable hoje.

O que a OpenAI lançou em 3 de setembro

O GPT-6 Astra é o sucessor do GPT-5.6 Sol e o primeiro modelo da geração GPT-6 da OpenAI. Ele foi disponibilizado para um grupo limitado de organizações no dia do lançamento, com a disponibilidade se expandindo para todos os usuários do ChatGPT Plus, Pro, Business e Enterprise nos dias seguintes, além da API da OpenAI, Microsoft Azure e AWS Bedrock.

Image

A principal afirmação da OpenAI é que o Astra é, ao mesmo tempo, seu modelo mais inteligente e mais alinhado. O lado da inteligência baseia-se em avanços de pré-treinamento e aprendizagem por reforço. O lado do alinhamento é mais interessante do que o jargão usual: a OpenAI criou uma nova avaliação, informada pelo incidente com a Hugging Face, que testa se um modelo, ao enfrentar uma tarefa impossível, excederá seu escopo autorizado. O GPT-5.6 Sol, sem salvaguardas de produção, ultrapassou o objetivo autorizado em 48% das vezes. O Astra fez isso em 0% dos casos. Para qualquer pessoa que delegue trabalho real a um Agente, esse número importa tanto quanto qualquer pontuação de capacidade.

O preço da API é de US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída, com entrada em cache a US$ 1 por milhão. Isso é um ágio em relação ao Sol, embora a OpenAI argumente, com curvas de custo de benchmark para comprovar, que o Astra conclui mais trabalho por dólar porque precisa de menos tokens e menos novas tentativas.

O cenário de benchmarks

As pontuações do Astra agrupam-se em duas categorias: benchmarks saturados e novas fronteiras.

O grupo saturado é impressionante. O Astra pontua 98% no FrontierMath Tier 4, um benchmark construído a partir de problemas matemáticos de nível de pesquisa, e já contribuiu para a resolução de problemas matemáticos em aberto. Ele atinge 99,9% no ARC-AGI-3, onde a ARC Prize Foundation afirma que ele superou a linha de base de eficiência de ação humana em 96% dos níveis, alcançando efetivamente a paridade humana. Ele pontua 100% no ExploitBench.

O grupo competitivo é onde a comparação com a Anthropic se torna direta. No Terminal-Bench Science 0.1, que testa se os Agentes conseguem executar fluxos de trabalho científicos reais por meio de código e ferramentas de terminal, o Astra alcança 64,6% contra 52,6% do Claude Fable 5.1, com um custo de API estimado aproximadamente 31% menor. No Agents' Last Exam, que cobre tarefas profissionais complexas em software real, o Astra pontua 59,3% contra 55,5% do Claude Opus 5 e 53,6% do Sol, usando cerca de 65% menos tokens de saída do que o Opus 5. No BenchCAD, em que os modelos reconstroem objetos 3D escrevendo código CAD, o Astra alcança 95,9% contra 84,3% relatados para o Fable 5.1.

A velocidade melhorou junto com a precisão. Em simulações de latência no OSWorld 2.0, o Astra pontua 72,6% a cerca de 40 minutos por tarefa, enquanto o Sol alcançou 65,7% a cerca de 75 minutos. Combinado com uma estrutura Codex atualizada, a OpenAI mede uma conclusão de tarefa 1,9x mais rápida no Mind2Web em comparação com a experiência atual do Sol.

O melhor modelo de uso de computador do mundo

O maior tema deste lançamento é o uso de computador. O Astra opera softwares reais: ele preenche formulários, atualiza registros de CRM, organiza calendários, pesquisa no navegador, rascunha e-mails ou documentos no seu editor, executa QA de frontend em sites que acabou de construir e soluciona problemas do que vê na tela.

A demonstração da OpenAI deixa claro o ponto de forma concreta. O Astra realiza o layout de placas de circuito impresso no KiCad, transformando um esquema em uma placa manufaturável. Ele compete em modelagem no Excel, preenche um formulário 1040, formata documentos legais, cria painéis do Power BI e marca consultas no DMV. Essas são tarefas tediosas e de alto atrito que anteriormente precisavam de um humano operando o mouse.

Para resultados profissionais, a OpenAI treinou o Astra especificamente para seguir modelos. Ele segue seus modelos de slides existentes, combina seu estilo de escrita e visual e extrai apenas o contexto importante para as entregas. Os primeiros clientes confirmam isso: a Cognition integrou o Astra ao Devin no dia do lançamento, citando resultados de ponta em seu benchmark interno, e a Higgsfield relata que o Astra executa seus fluxos de trabalho criativos mais complexos com até 20% menos tokens do que as alternativas.

O controle de segurança: capacidade cibernética crítica

O Astra é o primeiro modelo da OpenAI a atingir o nível crítico de capacidade de segurança cibernética sob a Estrutura de Preparação da empresa. Essa designação teve consequências antes do lançamento: a OpenAI determinou em 7 de agosto que o Astra poderia ter capacidades cibernéticas críticas, adicionou requisitos de monitoramento a toda inferência e atrasou partes do desenvolvimento e lançamento.

O resultado prático é o acesso em níveis. O modelo que todos recebem possui salvaguardas robustas em tarefas de segurança cibernética. Seus recursos de segurança ofensiva mais avançados são limitados a defensores de segurança cibernética aprovados por meio do programa Daybreak da OpenAI. Se o seu trabalho envolve engenharia de software comum, pesquisa ou tarefas de negócios, você não notará o bloqueio. Se você for uma equipe de segurança, o Daybreak é o caminho de aplicação.

Como usar o GPT-6 Astra na Runable

A Runable adicionou o GPT-6 Astra ao modo Ultra, o nível superior no seletor de modelos, juntamente com o Claude Fable 5.1, que chegou no início desta semana. Veja como executá-lo.

Primeiro, abra uma nova tarefa na Runable e encontre o seletor de modelos na barra de entrada, ao lado do seletor de artefatos e da alternância de modo. Escolha Ultra. Níveis de modelo mais altos usam mais créditos por tarefa e raciocinam melhor, e o Ultra agora aponta seu Agente para modelos de fronteira, incluindo o Astra.

Segundo, descreva a tarefa em linguagem simples, exatamente como faria com qualquer construção na Runable: um site full-stack, um modelo financeiro, um relatório de pesquisa, uma apresentação de slides. Os pontos fortes do Astra mapeiam diretamente os tipos de saída mais usados na Runable, especialmente qualquer coisa que envolva trabalho longo em várias etapas, análise com muitos documentos ou código que precise passar por seu próprio QA.

Terceiro, revise e refine no mesmo chat. Nada mais no fluxo de trabalho muda: o modo de planejamento, habilidades, conectores, memória, reversão e ramificação funcionam da mesma forma, independentemente de qual nível de modelo esteja selecionado.

O emparelhamento faz sentido por um motivo específico. O Astra é o modelo de Agente e de uso de computador mais forte que a OpenAI já lançou, e a Runable é uma plataforma de Agentes onde o modelo realmente obtém um ambiente seguro (sandbox), ferramentas e autonomia de horas para usar esses recursos. Executar o Astra por meio de uma janela de chat deixa a maior parte do seu valor de lado. Executá-lo em um ambiente criado para trabalho delegado é onde os ganhos de benchmark aparecem como resultados finalizados. A Runable tem um nível gratuito para experimentar, com o Pro a US$ 20/mês como o plano mais popular e o Max a US$ 100/mês para uso intenso.

Astra versus Claude Fable 5.1: qual você deve escolher?

A resposta honesta é que esta semana nos trouxe dois modelos excepcionais, e ambos estão disponíveis no modo Ultra da Runable, então você não precisa se limitar a nenhum deles.

A vantagem do Astra é o uso de computador, velocidade e eficiência de custo na fronteira: ele vence o Terminal-Bench Science e o BenchCAD de forma direta e conclui tarefas do OSWorld em cerca da metade do tempo que o Sol precisava. A reputação do Fable 5.1, construída ao longo de seus primeiros dias em campo, é de resistência e disciplina de causa raiz em longas execuções de codificação, com clientes citando sessões autônomas de vários dias e caçadas a bugs raros que nenhum outro modelo conseguiu resolver.

Uma divisão razoável: utilize o Astra em tarefas pesadas em operação de software real, documentos, planilhas e entregas estruturadas, e utilize o Fable 5.1 em trabalho de base de código profundo e de longo prazo. Ou execute o mesmo prompt em ambos na Runable usando bifurcação de chat e mantenha o melhor resultado.

Se você está decidindo onde executar esses modelos no dia a dia, a comparação Runable vs ChatGPT analisa o que uma plataforma de Agente adiciona em relação a uma interface de chat padrão. Para equipes que avaliam especificamente fluxos de trabalho de design e documentos, a análise Runable vs Canva vale a leitura. E se você quiser entender a mudança de ferramentas para Agentes de forma mais ampla, por que os Agentes estão substituindo as ferramentas apresenta o caso.

Perguntas Frequentes

O que é o GPT-6 Astra?

O GPT-6 Astra é o modelo carro-chefe da OpenAI lançado em 3 de setembro de 2026. A OpenAI o chama de o modelo mais inteligente e alinhado do mundo, com resultados de ponta em uso de computador, engenharia de software, segurança cibernética, ciência e trabalho profissional, incluindo pontuações saturadas no FrontierMath Tier 4 e ARC-AGI-3.

Como acesso o Astra na Runable?

Selecione Ultra no seletor de modelos na barra de entrada da Runable antes de enviar sua tarefa. O Ultra é o nível acima dos modelos Lite, Pro e Max, e agora inclui o GPT-6 Astra. O restante do fluxo de trabalho, desde o modo de planejamento até a reversão, permanece exatamente o mesmo.

Quanto custa o GPT-6 Astra na API?

A OpenAI precifica o Astra em US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída, com entrada em cache a US$ 1 por milhão. A OpenAI argumenta que o custo efetivo por tarefa concluída é frequentemente menor do que o de modelos mais antigos porque o Astra precisa de menos tokens e menos tempo por tarefa.

Por que alguns recursos do Astra são restritos?

O Astra é o primeiro modelo da OpenAI a atingir o limite crítico de segurança cibernética sob a Estrutura de Preparação. Seus recursos de segurança ofensiva mais avançados são limitados a defensores aprovados por meio do programa Daybreak, e toda inferência carrega monitoramento de segurança adicional. A codificação e o uso comercial diários não são afetados.

O Astra é melhor que o Claude Fable 5.1?

Depende do trabalho. O Astra lidera em uso de computador, documentos profissionais e eficiência de custo, superando o Fable 5.1 no Terminal-Bench Science a um custo menor. O Fable 5.1 se destaca na codificação autônoma de longo prazo. Ambos estão disponíveis no modo Ultra da Runable, então você pode compará-los em suas próprias tarefas.

Leituras relacionadas

Experimente o GPT-6 Astra no modo Ultra da Runable

A maneira mais rápida de sentir o que um modelo de fronteira muda é entregar a ele uma tarefa real, não uma mensagem de chat. Abra a Runable, mude o seletor de modelos para Ultra e dê ao Astra algo para o qual você normalmente reservaria uma tarde inteira: um aplicativo funcional, uma planilha modelada, um relatório pesquisado. Começa grátis e a atualização é com um clique.

Filed underLaunch
Written byEshaan Pawan

Comece com a ideia que você já tem

Uma frase é o suficiente para começar.

Comece de graça