O GPT-6.1 Sol chegou à API, ao Codex e ao ChatGPT Work, mas sua principal vantagem é mais específica do que o slogan de lançamento sugere. O preço padrão da API é de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída. A mudança realmente relevante em relação ao GPT-6 Sol está na entrada em cache, que caiu para US$ 0,10 por milhão de tokens. Os benchmarks divulgados pela OpenAI tornam o Sol 6.1 uma opção interessante para testes de programação e uso de computadores, mas as evidências ainda são controladas demais pelo próprio fornecedor para justificar uma migração automática em produção.
O que o GPT-6.1 Sol realmente muda
O GPT-6.1 Sol é o lançamento da OpenAI de 29 de setembro de 2026, com o identificador de API gpt-6.1-sol. A OpenAI posiciona o modelo para programação com agentes, uso de computadores, trabalho com documentos e outras tarefas profissionais de várias etapas. A documentação oficial do modelo informa uma janela de contexto de 1,05 milhão de tokens, raciocínio, ferramentas e entrada de imagens.
O limite de disponibilidade é importante. O modelo está listado para a API, o Codex e o ChatGPT Work, mas não para o chat comum do ChatGPT no lançamento. Na prática, trata-se principalmente de um lançamento para desenvolvedores e agentes de trabalho, não de uma atualização geral do ChatGPT.
Os primeiros relatos de usuários são mistos e não devem substituir testes com tarefas fixas. Em uma discussão no r/OpenAI, u/Foreign_Helicopter24 descreveu um resultado bem-sucedido e barato, enquanto u/shuwatto relatou uma tarefa de PCB em que o Opus 5.5 superou o Astra. São experiências individuais, não testes controlados.
Preços da API GPT-6.1 Sol: a mudança que importa
As tarifas padrão abaixo estão listadas na documentação de preços da OpenAI e foram reportadas de forma consistente pela cobertura do lançamento. Elas valem para solicitações dentro da faixa de preços para contextos curtos.
| Item de cobrança | GPT-6.1 Sol | GPT-6 Sol | GPT-6 Astra |
|---|---|---|---|
| Entrada / 1 milhão de tokens | US$ 2,00 | US$ 2,00 | US$ 10,00 |
| Entrada em cache / 1 milhão de tokens | US$ 0,10 | US$ 0,20 | US$ 1,00 |
| Gravação de cache / 1 milhão de tokens | US$ 2,50 | US$ 2,50 | US$ 12,50 |
| Saída / 1 milhão de tokens | US$ 10,00 | US$ 10,00 | US$ 50,00 |
A comparação importante não é dizer que o “Sol 6.1 é mais barato que o Sol 6” em toda a fatura. Os preços normais de entrada e saída não mudaram. A exceção é a entrada em cache: o GPT-6.1 Sol reduz pela metade a tarifa de US$ 0,20 do GPT-6 Sol e fica 95% abaixo do próprio preço padrão de entrada.
Por exemplo, uma solicitação com 100.000 tokens de entrada em cache, 10.000 tokens de entrada normal e 5.000 tokens de saída custa cerca de US$ 0,08, antes de considerar gravações de cache, ferramentas, novas tentativas ou revisão humana:
- Entrada em cache: 100.000 × US$ 0,10 / 1.000.000 = US$ 0,01.
- Entrada normal: 10.000 × US$ 2 / 1.000.000 = US$ 0,02.
- Saída: 5.000 × US$ 10 / 1.000.000 = US$ 0,05.
A mesma combinação ilustrativa custa cerca de US$ 0,09 no GPT-6 Sol e US$ 0,45 no GPT-6 Astra. É um exemplo baseado na tabela de preços, não uma execução de produção medida.
Prompts longos mudam a conta. A página de preços da OpenAI aplica tarifas maiores acima de 272.000 tokens de entrada: US$ 4 por milhão de tokens de entrada, US$ 0,20 por milhão de tokens de entrada em cache e US$ 15 por milhão de tokens de saída. A tarifa maior vale para a solicitação inteira. Por isso, um prompt de 300.000 tokens não deve ser orçado usando os valores de destaque de US$ 2/US$ 10.
O cache só ajuda quando o prefixo reutilizável realmente atende às regras de cache do provedor. Instruções de sistema estáveis, definições de ferramentas e textos de políticas repetidos são bons candidatos. Se o começo de cada prompt for reescrito, a economia esperada pode desaparecer.
O que as evidências publicadas mostram — e o que não mostram
Use os benchmarks divulgados pelo fornecedor para escolher um projeto-piloto, não para afirmar uma superioridade universal.
| Avaliação | Resultado do GPT-6.1 Sol | Comparação relevante |
|---|---|---|
| DeepSWE v1.1 | 75,2% no esforço alto | Praticamente no mesmo nível do GPT-6 Astra; 6,4 pontos acima do GPT-6 Sol na tabela divulgada |
| OSWorld 2.0 offline | 71,4% no esforço máximo | Cerca de 2,1 pontos abaixo do Astra, com um custo por tarefa divulgado muito menor |
| AutomationBench | 36,1% no máximo; 35,4% no médio | Abaixo do pico de 41,4% do Astra e de alguns resultados do Claude com maior esforço |
| Terminal-Bench Science 0.1 | 57,0% no máximo | Atrás dos 68,1% do Astra; ainda mais que o dobro do resultado divulgado para o GPT-6 Sol |
O caso mais forte é a programação. A BitsMinds informou um custo de US$ 0,65 por tarefa no DeepSWE para o GPT-6.1 Sol, contra US$ 4,43 para o Astra, além dos números de 75,2% contra 74,1% na comparação selecionada. É um sinal convincente de custo-benefício, mas tanto a pontuação quanto o custo vieram do material de lançamento, e não de uma repetição independente do teste.
O uso de computadores conta uma história parecida de valor, mas não de vitória incontestável: os números de lançamento colocam o GPT-6.1 Sol em 71,4% no OSWorld 2.0, contra 73,5% do Astra, com custos por tarefa divulgados de US$ 1,27 e US$ 9,44. A automação empresarial é o alerta. O modelo pode superar um concorrente em uma configuração de esforço e perder em outra. Portanto, “próximo do Astra” não deve ser interpretado como “melhor para todo fluxo de trabalho”.
A OpenAI informou que a taxa de erros factuais em baixo esforço caiu de 11,4% no GPT-6 Sol para 7,7% no GPT-6.1 Sol. É uma redução de 3,7 pontos percentuais, mas essa fonte, sozinha, não estabelece como o modelo se comportará com seus documentos, ferramentas ou regras de aprovação.
O que a integração com a API exige
Trocar o nome do modelo pode dar errado mesmo quando o endpoint aceita o novo identificador.
- ID do modelo:
gpt-6.1-sol. - Nível de raciocínio: a documentação do modelo da OpenAI lista
low,medium,high,xhighemax;noneeminimalnão são compatíveis. - Chamadas de ferramentas: a documentação do modelo da OpenAI indica que o uso de ferramentas exige a Responses API. A Chat Completions continua adequada para solicitações sem ferramentas.
- Preço por contexto: o limite de 272 mil tokens altera a tabela de preços.
- Limite de saída: a documentação para desenvolvedores informa até 128.000 tokens de saída.
- Modalidades: a mesma especificação lista entrada de texto e imagem; ela não lista entrada nativa de áudio ou vídeo.
Antes de alterar o modelo padrão em produção, execute novamente um conjunto fixo de tarefas usando as mesmas ferramentas, permissões, critérios de aceitação e nível de esforço. Registre a taxa de resultados aceitos, novas tentativas, custo total de tokens, tempo de execução e minutos gastos por revisores. Um modelo 80% mais barato por token ainda pode custar mais por resultado aceito se gerar trabalho adicional de correção.
Quem deve migrar primeiro
Equipes que usam o GPT-6 Sol devem rodar um teste controlado. Os preços básicos de entrada e saída não aumentam, a entrada em cache fica mais barata e os resultados divulgados em programação e uso de computadores melhoram. O caso para migrar é mais forte quando a aplicação reutiliza prefixos longos e já oferece suporte à Responses API.
Equipes que pagam pelo Astra devem direcionar o trabalho rotineiro para o Sol 6.1, não abandonar o Astra. Tickets de programação com testes, extração de documentos com validação clara e tarefas repetíveis no navegador são bons primeiros candidatos. Mantenha o Astra para pesquisa científica, fluxos com muitas exceções ou decisões difíceis de verificar.
Equipes sem um teste de aceitação confiável devem esperar. A proximidade nos benchmarks não substitui um controle de qualidade. Se ninguém consegue dizer se o agente concluiu a tarefa corretamente, o preço menor dos tokens não é motivo seguro para trocar de modelo.
FAQ do GPT-6.1 Sol
O GPT-6.1 Sol é mais barato que o GPT-6 Sol?
Apenas em parte. A entrada e a saída padrão continuam custando US$ 2 e US$ 10 por milhão de tokens. A entrada em cache cai de US$ 0,20 para US$ 0,10, então agentes que usam muito cache obtêm a economia direta mais clara.
O GPT-6.1 Sol é tão capaz quanto o GPT-6 Astra?
Nos benchmarks de lançamento divulgados, ele fica próximo em programação e uso de computadores, mas aparece atrás em alguns resultados de automação empresarial e ciência. Trate “próximo do Astra” como uma hipótese sobre a carga de trabalho a ser testada, não como uma afirmação de substituição geral.
Qual é o nome exato do modelo GPT-6.1 Sol na API?
Use gpt-6.1-sol na solicitação à API.
Usuários do ChatGPT comum podem selecionar o GPT-6.1 Sol?
A disponibilidade analisada no lançamento abrange a API, o Codex e o ChatGPT Work. O modelo não estava listado para o chat comum do ChatGPT no lançamento.
O GPT-6.1 Sol oferece suporte a chamadas de ferramentas?
A documentação do lançamento indica que as chamadas de ferramentas exigem a Responses API. Teste o endpoint e o esquema de ferramentas em staging antes de trocar uma integração existente.
A regra prática de roteamento é simples: use primeiro o GPT-6.1 Sol quando a tarefa for repetível, usar muito cache e puder ser verificada; mantenha o Astra quando o custo de deixar passar um caso extremo for maior que o custo da chamada ao modelo.