O GPT-6 Astra é o modelo principal da OpenAI para trabalhos difíceis de ponta a ponta. Na prática, porém, a conclusão é mais específica do que o discurso de lançamento sugere: ele justifica o preço premium em tarefas longas e carregadas de ferramentas, não em prompts rotineiros nem para uso ilimitado no ChatGPT.
O que o GPT-6 Astra entrega
O GPT-6 Astra foi pensado para raciocínio, programação, pesquisa, criação de documentos e uso de computador. Na API, ele oferece janela de contexto de 1.050.000 tokens, saída máxima de 128.000 tokens e cinco níveis de raciocínio, de low a max.
É importante separar o modelo da API do nome usado no produto ChatGPT. A Central de Ajuda da OpenAI informa que o GPT-6 Pro no ChatGPT é alimentado pelo GPT-6 Astra. O mesmo Astra pode estar disponível no Work e no Codex sem aparecer no Chat comum para a mesma conta.
Astra é o modelo; GPT-6 Pro é o nome no ChatGPT
A página do modelo na API da OpenAI lista gpt-6-astra como identificador. Ele aceita streaming, function calling, saídas estruturadas, entrada de imagem e ferramentas da Responses API, como busca na web, busca em arquivos, interpretador de código, shell hospedado, uso de computador, MCP e Apply Patch.
O Astra não aceita entrada de áudio ou vídeo, e a página da API informa que o fine-tuning não está disponível. O corte de conhecimento é listado como 30 de abril de 2026; portanto, informações atuais ainda exigem acesso à web ou contexto fornecido pelo usuário.
Estar disponível não significa estar em todo lugar
A OpenAI anunciou o GPT-6 Astra em 3 de setembro de 2026. O lançamento é real, mas o acesso é dividido por plano e produto, em vez de chegar como uma única chave universal no ChatGPT.
| Onde você quer usar o Astra | Acesso atual descrito pela OpenAI | Observação prática |
|---|---|---|
| OpenAI API | gpt-6-astra aparece como disponível | Valem a cobrança da API e os níveis de uso |
| Chat comum no ChatGPT | GPT-6 Pro nos planos Pro $100, Pro $200, Business e Enterprise | O acesso no Enterprise pode depender das permissões do workspace |
| ChatGPT Work | Astra em rollout para planos Plus ou superiores | As regras de uso no Work são separadas das do Chat |
| Codex | Astra em rollout para planos pagos elegíveis | É necessário usar o Codex CLI 0.153.0 ou mais recente para acesso relacionado ao Astra |
As orientações atuais da Central de Ajuda da OpenAI alertam explicitamente que a disponibilidade pode variar entre Chat, Work e Codex. Ter Astra no Work ou no Codex com o plano Plus não deve ser interpretado como acesso garantido ao GPT-6 Pro no Chat comum.
Essa divisão já gerou confusão entre usuários. Antes de trocar de assinatura ou mexer em um fluxo de produção, confira o seletor de modelos exatamente no produto que você pretende usar.
O diferencial está no uso do computador, não no troféu de benchmark
O caso de uso mais forte do GPT-6 Astra é o trabalho de longo horizonte que mistura raciocínio e ferramentas. Pense em um agente de programação que precisa inspecionar um repositório, alterar arquivos, rodar verificações e se recuperar de erros; em um fluxo de pesquisa que coleta e concilia documentos; ou em uma tarefa de uso de computador que precisa navegar por softwares, em vez de apenas explicar como fazer algo.
Onde ele encaixa melhor: tarefas longas e cheias de ferramentas
A documentação da API confirma suporte a uso de computador, acesso a shell, execução de código, busca em arquivos, busca na web, MCP e aplicação de patches na Responses API. Esses recursos fazem do Astra algo além de um gerador de texto, mas também ampliam o custo e a superfície de falhas em comparação com uma completion de chat normal.
As primeiras análises práticas apontam na mesma direção. A review do GPT-6 Astra de Matt Shumer relata correções autônomas em um serviço quebrado, trabalho no navegador dentro de interfaces de e-mail e publicidade e coordenação de múltiplos agentes pelo Codex. A avaliação do autor é positiva para engenharia e trabalho geral no computador, mas ele considera o Astra mais lento do que gostaria e ainda prefere o Claude Fable para senso estético visual e algumas tarefas 3D.
Usuários independentes também relataram resultados fortes em trabalhos especializados. @anshuc afirmou que o Astra criou um jogo 3D em cerca de 45 minutos, enquanto @tomkrcha descreveu a reconstrução de uma locomotiva a vapor no Blender como milhares de objetos editáveis. São sinais úteis sobre o que as pessoas estão tentando fazer, não benchmarks controlados: os prompts, ativos, versões de software e nível de condução humana variam.
Afirmações sobre softwares criativos exigem um limite mais claro. Um teste inicial monitorado executou Illustrator, After Effects, Figma e Photoshop, mas a análise observou que esses aplicativos não estavam entre os exemplos oficialmente documentados naquele momento. Encare esses fluxos como experiências a validar no seu ambiente, não como integrações garantidas. (review da Promptslove)
Quando fica difícil justificar o upgrade
O Astra é uma escolha ruim como padrão para reescrita em alto volume, extração simples, suporte ao cliente comum ou pequenas edições de código que um modelo mais barato já resolve com confiabilidade. O preço premium só pode se pagar quando menos intervenções humanas, melhor uso de ferramentas ou uma taxa maior de conclusão compensam a conta de tokens.
O atrito das cotas também surge rápido no uso real. @datmicahfr relatou:
“Então, aparentemente o GPT 6 Astra (low) consumiu todo o meu limite de 5 horas em apenas 2 minutos com um prompt simples. Uau, isso é muito ruim.” — @datmicahfr, X
É um relato isolado, não um limite de serviço da OpenAI. Ainda assim, serve de alerta para medir execuções completas de agentes: uma instrução curta pode disparar muitas chamadas de ferramentas, tokens de raciocínio e saídas longas.
Como ler a tabela de benchmarks com olhar de comprador
O material de lançamento da OpenAI informou cerca de 98% no FrontierMath Tier 4, 99,9% no ARC-AGI 3 e 100% no ExploitBench. Esses números sustentam a tese de que o Astra é um modelo de fronteira para raciocínio e cibersegurança. Eles não provam que seja a melhor escolha para todo repositório de código ou fluxo de negócio.
Sinais fortes no material de lançamento
| Resultado informado | O que ele indica para quem compra | O que ele não informa |
|---|---|---|
| ~98% FrontierMath Tier 4 | Desempenho forte em raciocínio matemático difícil | Se respostas do dia a dia justificam o preço premium |
| 99,9% ARC-AGI 3 | Desempenho muito alto na avaliação de abstração reportada | Se o harness é comparável a toda execução independente |
| 100% ExploitBench | Explica a classificação “Critical” do modelo em cibersegurança | Que automação ofensiva de segurança sem restrições esteja disponível |
| 72,6% OSWorld 2.0 em tabelas de lançamento reproduzidas | Um sinal concreto de uso de computador | Como o Astra atua no seu navegador, desktop ou CRM |
| 74,1% DeepSWE v1.1 em tabelas de lançamento reproduzidas | Evidência para engenharia de software agêntica | Um ranking direto no SWE-bench contra outros modelos |
As publicações oficiais de lançamento da OpenAI e de Sam Altman são as fontes primárias desses dados. Os números de OSWorld e DeepSWE acima aparecem em cobertura inicial de reviews, incluindo a análise de benchmarks da CodingFleet, e não foram medidos de forma independente aqui.
Três comparações que exigem contexto
- ARC-AGI 3: o número de 99,9% depende da configuração; trate-o como um resultado reportado de provider-adapter, não como uma pontuação universal.
- OSWorld: não compare percentuais do Astra e do Fable em versões diferentes do OSWorld ou em harnesses de avaliação distintos.
- DeepSWE: os 74,1% são evidência de programação agêntica, não um ranking direto no SWE-bench Verified ou no SWE-bench Pro.
Use a tabela de lançamento como um mapa de capacidades para definir onde fazer testes A/B, não como garantia de produção. Ao comparar o Astra com o Sol ou outro modelo de fronteira, mantenha as mesmas tarefas, ferramentas, permissões e limite de tempo.
Orce o GPT-6 Astra como dois produtos diferentes
O GPT-6 Astra tem um preço de API e uma franquia no ChatGPT. São decisões de compra diferentes, e confundir uma com a outra é a forma mais rápida de subestimar o custo.
Economia da API
A tabela oficial de preços da API lista as seguintes tarifas padrão:
| Uso na API | Preço do GPT-6 Astra |
|---|---|
| Entrada | $10 por 1M de tokens |
| Entrada em cache | $1 por 1M de tokens |
| Gravação de cache | $12.50 por 1M de tokens |
| Saída | $50 por 1M de tokens |
| Batch ou Flex | 50% das tarifas Standard |
| Modo Fast | 2× as tarifas aplicáveis |
Em solicitações com mais de 272.000 tokens de entrada, a OpenAI aplica preço de 2× para entrada e de 1,5× para saída sobre toda a solicitação. Isso torna a gestão de contexto importante mesmo com uma janela de 1,05 milhão de tokens.
Um exemplo simples mostra o formato da conta. Uma solicitação com 100.000 tokens de entrada e 10.000 tokens de saída custa cerca de $1.50 antes de ferramentas e cache: $1.00 pela entrada e $0.50 pela saída. Repetir a mesma combinação de tokens 20 vezes custa cerca de $30. Se a entrada puder ser armazenada em cache, a parte de entrada em cache pode reduzir esse valor; se um agente gerar saídas longas ou ultrapassar o limite de 272.000 tokens, o custo sobe rapidamente.
Os limites do ChatGPT são uma decisão de produto
A Central de Ajuda da OpenAI atualmente descreve as seguintes franquias incluídas de GPT-6 Pro:
| Plano do ChatGPT | Franquia de GPT-6 Pro | Relação com GPT-5.6 Sol Pro |
|---|---|---|
| Pro $200 | 200 mensagens por semana | O Sol Pro também tem sua própria franquia, com um teto diário combinado descrito pela OpenAI |
| Pro $100 | 50 mensagens por semana | Compartilhada com GPT-5.6 Sol Pro |
| Business Standard | 15 mensagens por mês | Compartilhada com GPT-5.6 Sol Pro |
| Business Premium | 50 mensagens por semana | Compartilhada com GPT-5.6 Sol Pro |
São franquias de mensagens, não uma medida de consumo equivalente de tokens. Uma execução longa de uso de computador pode realizar muito mais trabalho do que uma pergunta curta, e os créditos do Work ou Codex são separados do uso no Chat comum. A OpenAI também informa que o suporte não redefine limites esgotados; o usuário precisa esperar a renovação ou mudar para outro modelo disponível.
Veredito do GPT-6 Astra por tipo de carga de trabalho
Vale adotar o GPT-6 Astra como uma camada premium de escalonamento, não como substituto indiscriminado para todos os modelos mais baratos. As evidências são mais fortes quando o trabalho é longo, depende muito de ferramentas e custa caro para uma pessoa supervisionar manualmente.
Use o Astra agora se...
- Você está criando agentes de uso de computador ou navegador e consegue medir conclusão de tarefas, tempo de intervenção e custo por execução bem-sucedida.
- Seu fluxo de programação envolve repositórios grandes, sessões longas de depuração, várias ferramentas ou delegação entre agentes.
- Você executa fluxos de pesquisa ou documentos nos quais um contexto de um milhão de tokens e uso forte de recuperação/ferramentas podem evitar resumos repetidos.
- Você precisa de um modelo de raciocínio de alto nível para uma quantidade relativamente pequena de tarefas importantes, em vez de um modelo barato para milhões de chamadas.
Fique com o GPT-5.6 Sol ou uma opção mais barata se...
- Seu tráfego é composto principalmente por respostas curtas, classificação, extração, reescrita ou complementação rotineira de código.
- A aplicação não tolera o preço de tabela de $50 por milhão de tokens de saída nem loops longos e imprevisíveis de agentes.
- Você precisa de áudio, vídeo ou fine-tuning: a página do Astra lista esses recursos como não compatíveis.
- Sua equipe não conta com revisão humana ou um caminho de reversão para ações no computador.
O modelo GPT-5.6 Sol na API, mais barato, é listado a $4 por 1M de tokens de entrada e $20 por 1M de tokens de saída. Isso não representa uma comparação direta de qualidade, mas é suficiente para fazer do Sol a linha de base racional em um teste de migração.
Um teste de migração seguro
- Selecione 25–50 tarefas representativas, incluindo falhas e casos de contexto longo, não apenas prompts de demonstração.
- Execute as mesmas tarefas no GPT-5.6 Sol e no GPT-6 Astra com credenciais de teste isoladas, permissões de ferramentas limitadas, etapas de aprovação para ações relevantes e regras fixas de repetição.
- Registre taxa de conclusão bem-sucedida, minutos de intervenção humana, tempo decorrido, tokens de entrada/saída e custo total.
- Promova o Astra somente quando o tempo de intervenção economizado ou a maior taxa de conclusão cobrir a diferença de preço.
- Mantenha um modelo alternativo para tráfego rotineiro e uma interrupção obrigatória para ações irreversíveis no computador.
Esse teste permite decidir com base na sua carga de trabalho, sem fingir que um benchmark de fornecedor é garantia de produção.
Perguntas frequentes: disponibilidade, limites e uso do GPT-6 Astra
O GPT-6 Astra foi lançado oficialmente?
Sim. A OpenAI anunciou o GPT-6 Astra em 3 de setembro de 2026, e a documentação da API lista o modelo gpt-6-astra. Ele foi lançado, mas a disponibilidade no ChatGPT continua em rollout gradual e depende do plano.
O GPT-6 Astra está no ChatGPT Plus?
Usuários Plus podem receber o Astra no ChatGPT Work e no Codex à medida que o rollout avança. A Central de Ajuda não trata isso como equivalente ao GPT-6 Pro no Chat comum; o GPT-6 Pro é listado para os planos Pro $100, Pro $200, Business e Enterprise.
O GPT-6 Astra tem janela de contexto de 1M de tokens?
Sim. A OpenAI lista uma janela de contexto de 1.050.000 tokens e saída máxima de 128.000 tokens. Solicitações acima de 272.000 tokens de entrada recebem preço mais alto para toda a solicitação, portanto o contexto máximo não é um recurso de custo fixo.
O GPT-6 Astra é melhor que o GPT-5.6 Sol para programação?
O Astra tem um sinal publicado mais forte para programação agêntica de longo horizonte e uso de ferramentas, mas isso não prova superioridade universal em repositórios comuns. Teste os dois modelos no seu código, incluindo tarefas de revisão, depuração, correção de testes e reversão.
Por que o GPT-6 Astra atinge os limites tão rapidamente?
Sessões agênticas podem gerar muitas chamadas de ferramentas, tokens de raciocínio e saídas longas mesmo quando o usuário envia uma única instrução curta. As franquias do ChatGPT da OpenAI também variam por plano e produto, enquanto o uso da API é cobrado por tokens; prompt curto não significa execução curta.
A decisão: compre mais autonomia apenas onde ela se paga
Comece com uma faixa restrita de escalonamento, mantenha o GPT-5.6 Sol para o tráfego rotineiro e meça trabalho concluído, não a empolgação com benchmarks. O GPT-6 Astra só justifica seu preço premium quando a maior taxa de conclusão ou o tempo humano economizado cobre $10 de entrada e $50 de saída por milhão de tokens na API, ou a franquia limitada de GPT-6 Pro no ChatGPT.