A OpenAI lançou o GPT-6 Astra. "O melhor modelo do mundo".
Geração nova, uso de computador, quem liga e o preço. Plus nos próximos dias. Grátis, eles não colocaram na lista.

Terça a Anthropic solta o Fable 5.1. Quinta a OpenAI responde com GPT-6.
A pergunta certa não é se é o melhor do mundo. É: muda tanto assim?
A página oficial do GPT-6 Astra saiu hoje, 3 de setembro de 2026. Abaixo, o que eles escreveram. Em português. Em palavras simples.

O título da página
GPT-6 Astra: A new generation of intelligenceEm português: GPT-6 Astra, uma geração nova de inteligência. Eles não chamaram de GPT-5 ponto alguma coisa. Chamaram de 6.
A primeira frase

We're introducing GPT-6 Astra, the world's most intelligent and aligned model.Em português: estamos lançando o GPT-6 Astra, o modelo mais inteligente e alinhado do mundo. No recorte deles.
Alinhado, em palavras simples: ele tende a ficar no que você pediu. Não sai inventando uma missão extra no meio do caminho.
O parágrafo seguinte é o recado inteiro. Eles dizem que o Astra junta anos de pesquisa. E que hoje ele é o topo deles em seis frentes: usar o computador, navegar na web, programar, cibersegurança, ciência e trabalho profissional.
Três números que eles estampam logo no começo. Número deles, não meu:
- FrontierMath Tier 4: 98% no texto de abertura. Na tabela no fim da página aparece 97,6%. Teste pesado de matemática.
- ARC-AGI-3: 99,9%. Teste de raciocínio visual. O nome tem AGI. Isso não é a OpenAI cravando que a IA virou humana.
- ExploitBench: 100%. Teste de cibersegurança. A gente volta nisso mais embaixo.
Quem recebe, já neste primeiro bloco: hoje, um conjunto limitado de organizações. Nos próximos dias, ChatGPT Plus, Pro, Business e Enterprise, mais a API e a AWS. Conta grátis não está nessa frase.
Tem um gráfico logo abaixo. Terminal-Bench Science 0.1: o agente completa fluxo de pesquisa científica no terminal. Astra 64,6%. Fable 5.1, 52,6%. Eles ainda escrevem uns 31% menos custo estimado de API. Num ajuste mais barato, Astra 61,1% contra 22,4% do Sol.
The world's best computer use model
No meio da página aparece o título que importa. O Sam Altman é o CEO da OpenAI. Um dos fundadores. Quem comanda a empresa do ChatGPT. Esta frase, nesta página, é da empresa. Não tem aspas dele aqui.
The world's best computer use model
Em português: o melhor modelo do mundo pra uso de computador. Claim da OpenAI. Não é eval da Nomics.
Uso de computador, em palavras simples: o modelo olha a tela que você olha. Clica. Digita. Preenche campo. A mesma interface do formulário, do CRM, da agenda. Sem precisar de uma API de cada ferramenta.
Eles listam o dia a dia, neste parágrafo:
- Preencher formulário online, atualizar CRM, organizar agenda
- Pesquisar na web e rascunhar no e-mail ou no editor de documento
- Analisar dado científico, gerar gráfico, criar um site e rodar QA no frontend
- Instalar e testar software sozinho, e resolver o problema que aparece na tela
Dois números desta seção. Agents' Last Exam: tarefa profissional em software de verdade, de modelagem financeira a produção. Astra 59,3%. Opus 5, 55,5%. Sol, 53,6%. Neste recorte eles ainda dizem uns 65% menos token de saída que o Opus 5.
OSWorld 2.0: Astra 72,6% em cerca de 40 minutos por tarefa. Sol 65,7% em cerca de 75 minutos. Eles escrevem uns 47% menos tempo.
Mais embaixo, no Codex: a capa de ferramentas em volta do modelo, atualizada. Combinada com o Astra, 1,9 vezes mais rápido que o Sol no Mind2Web. Número deles. Um exemplo na página: busca de pediatra em 2 min 54 s.

A step change in professional work

It combines the intelligence required for complex problems with the ability to carry out multistep workflows and produce polished documents, spreadsheets, and presentations.Em português: junta a inteligência do problema difícil com a capacidade de cumprir um fluxo de vários passos e devolver documento, planilha e apresentação prontos.
Eles cravam o detalhe que muda o escritório: segue o seu template. O seu jeito de escrever. O seu visual. Puxa só o contexto que importa, em vez de repetir o que já estava no briefing.
Quando a instrução deixa folga, o Astra completa o óbvio e pergunta quando a resposta mudaria o resultado. No Codex, pergunta sem parar o que não depende da sua resposta. Se você não responde, segue com um chute razoável no que é rotina. Espera no que pesa.
Modelo antigo às vezes tratava o recado no meio como um pedido novo e perdia o fio. O Astra, segundo eles, incorpora o requisito novo e continua a tarefa.
No gráfico desta seção, BenchCAD: reconstruir objeto 3D a partir de várias vistas, gerando código CAD. Astra 95,9%. Sol 83,3%. Fable 5.1, 84,3%. Custo estimado de API, no recorte deles, uns 43% abaixo do Sol.
Coding
GPT-6 Astra is the best model for software engineering to date.Em português: o melhor modelo deles pra engenharia de software até agora. Claim da página. Jane Street e Lovable entram logo abaixo, com teste interno. Número deles.

Terminal-Bench 4.0, no texto: Astra 57,9%. Sol 37,3%. Fable 5.1, 55,8%. Na tabela no fim da página, Astra aparece 57,7%. Tarefa pesada no terminal: programar, configurar sistema, analisar dado.
Tem um recurso novo no Codex: quando a janela de contexto enche, o Astra consegue guardar nota e ainda buscar mensagem antiga. Compactar tudo num resumo único perdia o porquê de um conserto ter falhado. Isso vira o padrão nas próximas semanas, segundo eles. Hoje é experimental no config.toml.
Advancing scientific discovery

Eles chamam de avanço grande em ciência, matemática e saúde. A EpochAI entra com a frase: fim de uma era, começo de outra. É o recorte da EpochAI nesta página. A OpenAI não abre o post com AGI.
Dois resultados em números primos, com prova no link deles. Um bound de pares de primos que estava em 240 e o Astra ajudou a levar pra 186. Outro termo em gaps grandes, parado há mais de 80 anos. A prova está no rodapé da página.
GPQA Diamond: raciocínio científico de nível de pós-graduação em biologia, química e física. Astra 96,0% no gráfico. Num ajuste mais barato, 94,9% contra 94,6% do Sol, com uns 37% menos custo estimado de API.
Cybersecurity

Eles dizem: pulo grande. O Astra atinge o limiar Critical no framework de preparação da OpenAI.
Em palavras simples: sem as travas de produção, o modelo que eles testaram acha falha desconhecida e monta jeito de explorar, em eval interno e de terceiro. No ChatGPT que chega agora, a versão recusa tarefa avançada, tipo prova de conceito de exploit. Defensor usa pra review de código e patch. O resto vai abrindo no Daybreak, nas próximas semanas.
ExploitBench: Astra 100%. Sol 78,5%. ExploitGym: 42,4% contra 30,3%. SRE-Bench, engenharia reversa de binário: 88% na primeira tentativa, 99,2% em até quatro. Sol, 55,9% e 68,7%. Tudo no recorte da OpenAI, sem as travas de produção.
O Astra do Plus não é o kit de cibersegurança. São portas diferentes.
Aligning and deploying GPT-6 Astra responsibly

Em português: alinhando e colocando o GPT-6 Astra no ar com responsabilidade. De novo a palavra alinhado. Cuidado. Respeito ao limite da tarefa. Fala mais transparente.
Um teste que eles descrevem no começo da página, inspirado no incidente do Hugging Face: tarefa difícil ou impossível. O Sol, sem travas de produção, saiu do alvo autorizado em 48% dos casos. O Astra, 0%.
No gráfico desta seção, teste interno de segurança em uso de computador. Quanto menor, melhor. Astra 2,4%. Sol 22,0%. Fable 5.1, 9,5%. Opus 5, 11,5%.
Tem um efeito que você vai sentir: se o monitor achar que o agente entendeu o pedido errado, a conversa pausa. No ChatGPT e no Codex você revê. Na API, para. Eles admitem que isso às vezes interrompe trabalho legítimo. Inclusive defesa de cyber.
Availability

Em português: disponibilidade. Hoje, 3 de setembro: um conjunto limitado. Nos próximos dias: Plus, Pro, Business, Enterprise, API e AWS. O uso entra na franquia do plano. Dá pra comprar crédito extra. Pro, Business e Enterprise também ganham GPT-6 Astra Pro. No Enterprise, o admin liga. Vem desligado.
Na API o id é gpt-6-astra. Standard: US$ 10 de entrada e US$ 50 de saída, por milhão de tokens. Fast mode: até 2,5 vezes a velocidade do Standard, pelo dobro do preço. Conta grátis não está na lista.

Na mesma tabela, o Sol está US$ 4 e US$ 20. A tese da OpenAI: o token ficou mais caro, a tarefa ficou mais barata, porque o Astra gasta menos token de resposta. É o que eles escreveram.
Dois cases em páginas irmãs
A OpenAI ainda abriu duas páginas de case no mesmo dia. Número das empresas, não meu.
A Playco prototipou jogo dentro do Unity e do Godot. Três temas a partir de uma caixa cinza. A Playco diz 50% menos correção manual que no modelo anterior.

A Legora mandou o agente conferir 41 documentos num único run. A Legora diz quase 40% a mais naquele fluxo de demonstração financeira, e achou os 4 erros que ela mesma plantou.

O que fazer com isso
A página inteira cabe numa frase: o Astra chega pra operar o computador e devolver o arquivo. Plus nos próximos dias. Grátis, eles não listaram. O modelo do ChatGPT recusa o kit pesado de cyber.
Se você é Plus ou Pro, espera o seletor. Quando cair, manda uma tarefa que termine num arquivo. Planilha, slide, página. Não um texto. Se você constrói em cima da API, o id é gpt-6-astra, na Responses API. Olha o 10/50 antes de jogar volume. Se o seu fluxo é cyber pesado, o modelo do ChatGPT não é essa porta.
A evidência é a página da OpenAI, 3 de setembro de 2026.