O GPT-6 Astra é o modelo que a OpenAI apresentou no dia 3 de setembro de 2026, dois dias depois de a Anthropic lançar o Claude Fable 5.1. O presidente da OpenAI, Greg Brockman, abriu o anúncio com a frase "bem-vindos à era da AGI". É uma afirmação forte, e neste artigo separamos o que está confirmado do que ainda é marketing.
Aqui você encontra o que o modelo faz de novo, a tabela com os dados oficiais, os benchmarks contra o GPT-5.6 Sol e o Claude Fable 5.1, o preço na API e nos planos do ChatGPT, e a parte que importa para quem vive de busca: o que um modelo que navega e opera sites sozinho muda para SEO e GEO.
O que é o GPT-6 Astra?
GPT-6 Astra é o modelo de fronteira mais recente da OpenAI, sucessor da família GPT-5.6 (Sol, Terra e Luna). No anúncio oficial, a empresa o descreve como estado da arte em seis frentes: uso de computador, navegação na web, engenharia de software, cibersegurança, ciência e trabalho profissional.
O nome tem duas partes. "GPT-6" marca a nova geração, a primeira em que, segundo a OpenAI, o modelo anterior supervisionou o treinamento do seguinte. "Astra" é o nome do modelo dentro da geração, no mesmo padrão em que o GPT-5.6 tinha Sol, Terra e Luna. No ChatGPT, ele aparece com outro nome, "GPT-6 Pro", o que confunde bastante gente. É o mesmo modelo.
Vale uma desambiguação, porque "Astra" é um nome comum: existe um projeto de assistente do Google chamado Project Astra, e existem carros, satélites e empresas com esse nome. Neste artigo, GPT-6 Astra é sempre o modelo da OpenAI.
GPT-6 Astra em números: a tabela oficial
Característica | GPT-6 Astra |
|---|---|
Lançamento | 3 de setembro de 2026 |
Fabricante | OpenAI |
Janela de contexto | 1.050.000 tokens |
Saída máxima | 128.000 tokens |
Corte de conhecimento | 30 de abril de 2026 |
Entrada | texto e imagem |
Níveis de raciocínio | low, medium, high, xhigh e max |
Preço de entrada | US$ 10 por milhão de tokens |
Preço de saída | US$ 50 por milhão de tokens |
Entrada em cache | US$ 1 por milhão (gravação: US$ 12,50) |
Sobretaxa acima de 272 mil tokens | 2× na entrada, 1,5× na saída |
Modo Fast | 2× o preço, até 2,5× a velocidade |
Batch e Flex | 50% do preço padrão |
Ferramentas nativas | busca na web, uso de computador, busca em arquivos, code interpreter, geração de imagem, shell hospedado e MCP |
Disponibilidade | API ( |
Fontes: documentação do modelo na API da OpenAI e anúncio oficial.
O que há de novo no GPT-6 Astra?
A OpenAI concentrou o anúncio em cinco avanços. Cada um deles tem uma tradução prática para quem trabalha com conteúdo e marketing.
- Uso de computador como uma pessoa. A OpenAI chama o Astra de "o melhor modelo de uso de computador do mundo". Ele preenche formulários, atualiza registros num CRM, organiza agenda, pesquisa na web e escreve o resumo direto no e-mail ou no editor de documentos.
Sabe aquela auditoria de SEO em que você abre 40 páginas, confere title, H1, canonical e anota numa planilha? É exatamente o tipo de tarefa repetitiva, com telas e cliques, que esse modelo foi treinado para fazer sozinho. No benchmark OSWorld 2.0, que mede isso, o Astra marcou 72,6% gastando cerca de 40 minutos por tarefa, contra 65,7% e 75 minutos do GPT-5.6 Sol. É quase metade do tempo.
- Navegação na web mais rápida e mais segura. Junto com o modelo, a OpenAI atualizou o Codex para acelerar o uso de navegador. No benchmark Mind2Web, a conclusão de tarefas ficou 1,9× mais rápida do que com o GPT-5.6 Sol.
Na prática, isso significa que agentes de IA vão visitar seu site com mais frequência e completar mais jornadas nele: pesquisar um produto, comparar preços, preencher um cadastro. Voltamos a esse ponto na seção de SEO, porque ele muda a forma de pensar a página.
- Alinhamento e escopo. A OpenAI criou uma avaliação nova, inspirada no incidente do Hugging Face de agosto, para medir se o modelo ultrapassa o escopo autorizado quando encara uma tarefa difícil ou impossível. Sem as proteções de produção, o GPT-5.6 Sol ultrapassava o limite em 48% dos casos; o Astra, em 0%.
Traduzindo: quando você delega uma tarefa a um agente e ele não consegue cumpri-la, o comportamento antigo era "dar um jeito", às vezes fazendo coisas que ninguém pediu. O novo comportamento é parar e perguntar. Para quem vai deixar um agente mexer em conta de anúncios ou em CMS, isso importa mais do que qualquer benchmark.
- Nível "Crítico" em cibersegurança. É o primeiro modelo da OpenAI a atingir esse patamar no Preparedness Framework da empresa. No ExploitBench, marcou 100% contra 78,5% do GPT-5.6 Sol, e durante a avaliação encontrou duas vulnerabilidades desconhecidas. Por isso, as capacidades de segurança ofensiva ficam restritas a um programa de acesso controlado.
- Resistência a prompt injection. Segundo a nota de segurança, o Astra é "significativamente mais robusto a injeções de prompt" do que o Sol e faz menos ações destrutivas em ambientes reais de navegação e trabalho.
Isso encerra um atalho que alguns sites vinham testando: esconder instruções no HTML para manipular o que a IA fala sobre a marca. Com um modelo treinado para ignorar esse tipo de texto, o que resta é o caminho longo, que é ter conteúdo claro, citável e verdadeiro.
Há ainda uma novidade para quem usa o Codex: em vez de comprimir o histórico quando a janela de contexto enche, o Astra passa a manter notas entre janelas e a buscar em janelas anteriores. É um recurso experimental que, segundo a OpenAI, vira padrão nas próximas semanas.
Como o GPT-6 Astra se sai nos benchmarks?

Os números abaixo são os reportados pela OpenAI no anúncio. Nenhum deles foi reproduzido de forma independente até a publicação deste artigo.
Benchmark | GPT-6 Astra | GPT-5.6 Sol | Claude Fable 5.1 |
|---|---|---|---|
Terminal-Bench 4.0 (código agêntico) | 57,9% | 37,3% | 55,8% |
Terminal-Bench Science 0.1 (pesquisa) | 64,6% | 22,4% | 52,6% |
GPQA Diamond (ciência) | 96,0% | 94,6% | 93,7% |
AutomationBench (processos de negócio) | 41,4% | n/d | 31,4% |
FrontierMath Tier 4 v2 (matemática) | 98% | 83,0% | 87,8% |
ARC-AGI-3 | 99,9% | n/d | não publicado |
OSWorld 2.0 (uso de computador) | 72,6% | 65,7% | n/d* |
Agents' Last Exam (trabalho profissional) | 59,3% | 53,6% | n/d (Opus 5: 55,5%) |
ExploitBench (exploração de falhas) | 100% | 78,5% | não publicado |
*A Anthropic reporta 41,7% para o Fable 5.1 no OSWorld 2.0, mas em configuração diferente da simulação de latência usada pela OpenAI. Os dois números não são comparáveis diretamente.
Três leituras importam mais do que a tabela inteira:
- O salto sobre o GPT-5.6 Sol é grande. No Terminal-Bench 4.0, são 20 pontos percentuais. No Terminal-Bench Science, quase o triplo. Quem já usa a API da OpenAI tem motivo para migrar.
- A vantagem sobre o Claude Fable 5.1 é menor e depende do benchmark. Em código agêntico, são 2 pontos. Em pesquisa científica, 12. E no índice agregado da Artificial Analysis, que combina vários testes, o Fable 5.1 fica na frente: 66 contra 61. Ou seja, "o melhor modelo do mundo" é uma frase que depende de qual prova você olha.
- Os benchmarks "saturados" precisam de ressalva. A OpenAI diz que o Astra saturou o FrontierMath Tier 4 e o ARC-AGI-3. O ARC Prize verificou os dois números do ARC-AGI-3: 99,9% com o harness do provedor, que preserva o raciocínio entre requisições, e 62,7% com o harness padrão, ao custo de US$ 26.098 pela bateria inteira. Mesmo teste, dois resultados, dependendo de como se roda. Um benchmark saturado é um benchmark que parou de discriminar. Ele mostra que a régua ficou curta, não que o problema acabou.
Para uma comparação mais detalhada contra o modelo da Anthropic, veja GPT-6 Astra vs Fable 5.1: qual é melhor.
O que os testes independentes dizem?
Benchmark de fabricante mostra a prova em que o modelo vai melhor. O que resolve a dúvida é quem roda o mesmo teste nos dois modelos, no mesmo ambiente, sem participação da OpenAI nem da Anthropic. Quatro fontes fazem isso, e o placar fica dividido:
Fonte independente | GPT-6 Astra | Claude Fable 5.1 |
|---|---|---|
Artificial Analysis, Intelligence Index v4.1.1 | 61 | 66 (1º de 202 modelos) |
Artificial Analysis, Coding Agent Index | 67 | 70 (rodando no Claude Code) |
Artificial Analysis, custo para rodar o Intelligence Index | US$ 3.013 | US$ 8.523 |
Epoch AI, Epoch Capabilities Index | 169 (1º de 267) | 163 (3º) |
Epoch AI, FrontierMath Tier 4 | 98% (benchmark saturado) | não publicado |
ARC Prize, ARC-AGI-1 semiprivado | 97,5% | 97,5% (US$ 1,40 por tarefa) |
ARC Prize, ARC-AGI-2 semiprivado | 95,0% | 90,0% (US$ 4,49 por tarefa) |
ARC Prize, ARC-AGI-3 | 62,7% no harness padrão (US$ 26.098 no total); 99,9% no harness do provedor | não publicado |
LMArena, arena de texto (2 de setembro de 2026) | ainda não listado | 1504 ±11 (3º lugar, 2.906 votos) |
Fontes: Artificial Analysis, Epoch AI, ARC Prize e LMArena. Todos rodam o mesmo teste nos dois modelos, sem participação dos fabricantes.
A leitura honesta: o Astra lidera nos índices de capacidade bruta (Epoch) e em raciocínio abstrato caro (ARC-AGI-2 e 3), e custa menos para rodar a mesma bateria. O Fable 5.1 lidera no índice agregado da Artificial Analysis, no índice de agente de código e na preferência humana do LMArena. "Modelo mais inteligente do mundo" depende de qual régua se usa, e há régua séria dos dois lados.
Quanto custa o GPT-6 Astra?
Na API, o preço de lista é US$ 10 por milhão de tokens de entrada e US$ 50 por milhão na saída. É exatamente a mesma tabela do Claude Fable 5.1, e o dobro do preço padrão do GPT-5.6 Sol (US$ 5 e US$ 30).
Só que a conta real raramente é a de lista. Quatro regras mudam o que você paga:
- Cache de entrada a US$ 1 por milhão. Sabe quando você manda o mesmo briefing, o mesmo guia de estilo ou o mesmo site inteiro em toda chamada? Isso é cache. No Astra, reler custa um décimo do preço cheio. No Fable 5.1, custa US$ 0,25, ou seja, um quarto do preço do Astra nessa linha. Para quem faz muitas chamadas sobre o mesmo material, é a linha que mais pesa.
- Sobretaxa em contexto longo. Acima de 272 mil tokens de entrada, a OpenAI cobra o dobro na entrada e 1,5× na saída, sobre a requisição inteira. Uma análise de 300 páginas de conteúdo numa única chamada sai, na prática, a US$ 20 por milhão. Quebrar em blocos menores é mais barato.
- Modo Fast. Até 2,5× mais rápido pelo dobro do preço. Faz sentido em fluxo interativo, não em processamento em lote.
- Batch e Flex a 50%. Tarefas que podem esperar (reescrever 500 meta descriptions durante a madrugada, por exemplo) custam metade.
A OpenAI também apresenta o Astra como mais barato por tarefa, não por token: no Terminal-Bench 4.0, o custo estimado por tarefa foi cerca de 9% menor que o do Sol e 63% menor que o do Fable 5.1, porque o modelo gasta menos tokens de saída para chegar ao mesmo resultado. É um argumento válido, mas vem da própria OpenAI e depende da configuração de raciocínio usada. Trate como direção, não como fatura.
No ChatGPT, o modelo entra como GPT-6 Pro nos planos Pro (US$ 100 e US$ 200), Business e Enterprise. A central de ajuda da OpenAI diz que ele "não está incluído no ChatGPT Plus no Chat", o que contradiz o anúncio. Detalhamos isso a seguir.
O que está confirmado e o que é especulação
Confirmado pela OpenAI:
- Lançamento em 3 de setembro de 2026, com acesso imediato a "um conjunto limitado de organizações" do programa de acesso Daybreak, e liberação para os planos pagos e a API "nos próximos dias".
- Especificações, preços e ferramentas listados na tabela acima.
- Classificação "Crítica" em cibersegurança, com capacidades ofensivas restritas a defensores de infraestrutura crítica.
Contraditório entre fontes oficiais:
- O anúncio diz que o Astra chegará a "todos os usuários de ChatGPT Plus, Pro, Business e Enterprise". A central de ajuda diz que o GPT-6 Pro "não está incluído no ChatGPT Plus no Chat". Até a OpenAI esclarecer, nossa leitura: o Plus deve receber o modelo em algum produto (Codex, por exemplo) ou com limites, mas não no chat principal por enquanto.
Especulação ou não verificado:
- "Era da AGI". É opinião de Greg Brockman, que disse "para mim, pessoalmente, acho que chegamos lá". Não há definição operacional de AGI no anúncio, e o próprio índice da Artificial Analysis coloca o Fable 5.1 acima do Astra. Trate como posicionamento.
- Os números com uma casa decimal para FrontierMath (97,6%) e ARC-AGI-3 (98,6%) circulam numa tabela vazada junto com o lançamento; a página oficial arredonda para 98% e 99,9%. Duas fontes independentes fecham a questão: a Epoch AI, que roda o FrontierMath, registra 98% no Tier 4; o ARC Prize verificou 99,9% no ARC-AGI-3 com o harness do provedor e 62,7% com o harness padrão. Usamos os verificados.
- O GDPval, benchmark da própria OpenAI para trabalho econômico real, ficou fora dos materiais de lançamento. Não se sabe por quê.
- Houve uma instabilidade no ChatGPT horas antes do anúncio, e parte da imprensa reportou um "falso começo" na divulgação. Não afeta o produto.
O que o GPT-6 Astra muda para SEO e GEO?
Esta é a parte que interessa a quem trabalha com busca. O GPT-6 Astra não é só um gerador de texto melhor. É um modelo que navega, clica e conclui tarefas em sites. Isso muda quatro coisas.
1. Seu site vai receber visitantes que não são pessoas nem crawlers. Um agente que pesquisa "melhor ferramenta de heatmap para e-commerce", abre cinco sites, compara preços e volta com uma recomendação está fazendo uma jornada de compra completa. Ele não vê seu banner, não se impressiona com animação e não tem paciência com pop-up. Ele lê o HTML, procura a informação e segue. Páginas com resposta clara na primeira dobra, tabelas de preço legíveis em HTML e schema completo ganham. Páginas que escondem o preço atrás de "fale com um consultor" perdem a comparação antes de começar. Veja como as IAs escolhem o que citar.
2. Formulário virou interface para máquina. Se o Astra preenche um Form 1040 do imposto de renda americano, ele preenche o seu formulário de orçamento. Campos com nomes claros, validação que explica o erro e confirmação em texto são o que permitem a um agente completar a conversão. Um captcha na etapa final derruba a taxa de conversão desse novo visitante a zero. Ninguém está dizendo para tirar toda proteção, mas vale saber que a fricção agora tem um custo novo.
3. Manipular a IA ficou mais difícil; merecer a citação, não. A resistência a prompt injection fecha a porta de texto escondido e instruções camufladas. O que sobra é o trabalho de GEO: lede que responde a pergunta em duas frases, headings em forma de pergunta, dados com fonte, dateModified real, llms.txt publicado. É o mesmo checklist de sempre, com um adversário a menos.
4. O custo de produzir conteúdo mediano caiu de novo. Com Batch a 50% e menos tokens por tarefa, qualquer concorrente consegue gerar 200 artigos razoáveis por mês. O que não dá para gerar em lote é dado proprietário, experiência de quem fez e opinião com assinatura. É onde a diferença vai aparecer nos rankings e nas citações. Se você ainda não leu, O que é SEO explica por que E-E-A-T pesa tanto nesse cenário.
Há também um uso interno óbvio: o Astra como agente de operação de marketing. Auditoria técnica com o Googlebot em mente, verificação de noindex em massa, conferência de heading tags em centenas de URLs, relatórios de share of search montados direto no Trends. Tarefas de tela e clique, que antes precisavam de estagiário ou de script frágil.
Como acessar o GPT-6 Astra?
- API. O modelo se chama
gpt-6-astra. Está disponível também via Amazon Bedrock e Microsoft Azure. Os limites por minuto começam em 500 requisições e 500 mil tokens no Tier 1 e chegam a 15 mil requisições e 40 milhões de tokens no Tier 5. - ChatGPT. Aparece como "GPT-6 Pro" no seletor de modelos dos planos Pro, Business e Enterprise, à medida que a liberação avança. No Plus, a situação está indefinida (veja a seção anterior).
- Codex. Incluído no plano Pro, com o novo recurso de notas entre janelas de contexto habilitável no
config.toml. - Capacidades de cibersegurança. Restritas ao programa Daybreak Blue, para defensores de infraestrutura crítica, mediante inscrição.
Se você está decidindo entre ele e o modelo da Anthropic para um fluxo de conteúdo, o guia prático de Fable 5.1 para SEO e GEO mostra o fluxo que usamos, e ele se aplica ao Astra com poucas adaptações.
Conclusão
O GPT-6 Astra é um lançamento real, com avanços mensuráveis em uso de computador, código e pesquisa, e um preço que iguala o do concorrente direto. A parte de "AGI" é discurso. A parte que importa para quem trabalha com busca é concreta: o visitante que navega, compara e preenche formulário agora pode ser um agente, e o site precisa funcionar para ele. O próximo passo é ler o comparativo direto com o Fable 5.1 e decidir qual modelo entra no seu fluxo.




