GPT-6 Sol e Claude Opus 5.5 disponíveisGPT-6 Sol pela metade do preço do 5.6 Sol
Blogue
Guia

GPT-6.1 Sol: análise

Decida pela qualidade da entrega e pelo custo total.

10 min de leituraOmniaKey
GPT-6.1 SolGPT-6 AstraProgramaçãoPreços da APIAnálise de modelos

Se você já usa o GPT-6 Sol para programação complexa e revisões frequentes, vale colocar o GPT-6.1 Sol no início da sua lista de testes. Os preços padrão de entrada e saída continuam iguais, a leitura de cache cai pela metade e a OpenAI relata melhorias em várias avaliações. Mantenha o Astra na comparação quando investigar o problema ou corrigir uma solução errada custar caro.

Preço por token e custo para concluir um trabalho são medidas diferentes. O próprio gráfico de programação da OpenAI mostra um caso em que o novo Sol melhora bastante a pontuação, mas custa um pouco mais por tarefa que o antigo. Essa diferença ajuda mais a escolher do que prometer substituir o Astra por um quinto do custo em qualquer situação.

Fontes verificadas em 30 de setembro de 2026, UTC. Esta análise usa documentação oficial e resultados atribuídos ao responsável pela avaliação. Não executamos um comparativo independente dos modelos. Os exemplos de custo usam quantidades hipotéticas de tokens. A OmniaKey publica o artigo e oferece um gateway de API; suas tarifas são separadas das cobradas pela API direta da OpenAI.

O que muda no GPT-6.1 Sol

O histórico da API registra o lançamento em 29 de setembro de 2026. O identificador é gpt-6.1-sol. A proposta é atender programação complexa, uso do computador e trabalho profissional com custo menor que o Astra.

EspecificaçãoGPT-6.1 Sol
Janela de contexto1.050.000 tokens
Saída máxima128.000 tokens
Entrada / saída nativaTexto e imagens / texto
Esforço de raciocínio na APIlow, medium (padrão), high, xhigh, max
API para ferramentasResponses

As páginas do novo Sol, do Sol anterior e do Astra informam os mesmos limites de contexto e saída. A janela não aumentou. Saída e raciocínio também ocupam contexto; capacidade igual não garante a mesma precisão ao recuperar informações. Este modelo não oferece suporte nativo a áudio ou vídeo.

Programação: compare o mesmo nível de raciocínio

O gráfico interativo de DeepSWE v1.1 no anúncio da OpenAI avalia tarefas complexas em bases de código reais. Todas as linhas abaixo usam medium. O custo é a média medida pelo autor da avaliação, não uma fatura da OmniaKey nem um dos nossos exemplos hipotéticos.

Modelo em mediumPontuação DeepSWE v1.1Custo médio por tarefa
GPT-6.1 Sol73,0%US$ 0,42
GPT-6 Sol56,6%US$ 0,38
GPT-6 Astra72,8%US$ 3,08

Nesse teste, o novo Sol chega perto da pontuação do Astra por um custo bem menor. A diferença de 0,2 ponto percentual não comprova superioridade geral nem significância estatística. Em relação ao Sol anterior, o custo por tarefa sobe de US$ 0,38 para US$ 0,42 apesar das tarifas padrão iguais. É preciso olhar o consumo efetivo.

Mais raciocínio também não garante um resultado melhor. O Sol 6.1 atinge 75,2% em high, por US$ 0,65, e 71,9% em max, por US$ 1,57. A melhoria anunciada de 6,4 pontos compara o novo Sol em high com o melhor resultado do antigo, 68,8% em max. Não é a diferença entre os dois em medium.

No AutomationBench 1.0.6, o resultado em medium aumenta 4,8 pontos percentuais sobre o Sol anterior. No conjunto offline v2026.08.08 do OSWorld 2.0, a recompensa parcial em max sobe 7 pontos e fica 2,1 pontos atrás do Astra no mesmo nível. Recompensa parcial não equivale à taxa de conclusão de qualquer tarefa no computador.

O anúncio em inglês também mostra queda de 11,4% para 7,7% nas respostas com pelo menos um erro factual, em low, usando conversas difíceis selecionadas de propósito. Isso não representa a taxa de erro do uso cotidiano. No Terminal-Bench Science 0.1 apresentado pelo fornecedor, o Astra mantém a maior pontuação: 68,1% em max. Há motivo para testar o novo Sol, sem tirar o Astra de todos os fluxos.

Preço da API: onde está a economia

A tabela segue os preços oficiais da API direta da OpenAI em Standard, em dólares americanos por milhão de tokens, para entradas de até 272K tokens. Franquias de assinatura, gateways, ferramentas e impostos ficam à parte.

CategoriaGPT-6.1 SolGPT-6 SolGPT-6 Astra
Entrada sem cacheUS$ 2,00US$ 2,00US$ 10,00
Leitura de cacheUS$ 0,10US$ 0,20US$ 1,00
Gravação de cacheUS$ 2,50US$ 2,50US$ 12,50
SaídaUS$ 10,00US$ 10,00US$ 50,00

Entre essas quatro tarifas, só a leitura cai em relação ao Sol anterior. Comparadas ao Astra, entrada e saída padrão custam um quinto; leituras, um décimo. Essas proporções não definem a conta de uma tarefa completa.

Quatro exemplos para refazer a conta

K significa 1.000 tokens. A saída inclui raciocínio faturado. Fixamos quantidades iguais para os três modelos, embora execuções reais possam consumir valores diferentes. Somente a linha de leitura presume um acerto em cache válido, cuja gravação anterior é cobrada separadamente. Excluímos ferramentas, infraestrutura, impostos e taxas de gateway.

Uso hipotéticoGPT-6.1 SolGPT-6 SolGPT-6 Astra
Entrada sem cache de 100K + saída de 10KUS$ 0,30US$ 0,30US$ 1,50
Gravação inicial de 200K + entrada sem cache de 20K + saída de 10KUS$ 0,64US$ 0,64US$ 3,20
Leitura de 200K + entrada sem cache de 20K + saída de 10KUS$ 0,16US$ 0,18US$ 0,90
Entrada sem cache de 300K + saída de 10K, tarifa de contexto longoUS$ 1,35US$ 1,35US$ 6,75

Na linha de leitura, o novo Sol custa, em notação decimal de código, 0.20 × $0.10 + 0.02 × $2 + 0.01 × $10 = $0.16. O Sol anterior custa US$ 0,18. Uma leitura 50% mais barata reduz esta requisição inteira em apenas 11,1%. Uma gravação inicial e dez leituras válidas idênticas somam US$ 2,24 contra US$ 2,44, economia de aproximadamente 8,2%. O prefixo precisa continuar válido e todas as leituras devem acertar o cache.

A documentação de cache esclarece que a gravação não é uma taxa adicional à entrada comum. Separe os tokens entre entrada sem cache, leitura e gravação, sem contar a mesma quantidade duas vezes.

Acima de 272K, a requisição inteira muda de tarifa

Quando a entrada supera 272K tokens, os preços de entrada e cache dobram e a saída passa a custar 1,5 vez a tarifa para toda a requisição. A entrada em cache também conta no tamanho. Por isso, o exemplo de 300K do novo Sol resulta em 0.30 × $4 + 0.01 × $15 = $1.35.

Tokens de raciocínio são cobrados como saída. Fast custa o dobro de Standard; Batch e Flex, a metade. Multiplicadores de preço não medem a velocidade até concluir o trabalho. Registre também novas tentativas e espera por ferramentas.

Três verificações antes de migrar

O guia do GPT-6 descreve diferenças que podem afetar um agente já em uso.

  1. Raciocínio: o Sol anterior aceita none; o novo não aceita none nem minimal. Escolha um nível compatível e meça consumo e latência novamente. A API usa medium por padrão, mas o cliente pode ter outra configuração.
  2. Ferramentas: o Sol anterior permite chamadas de função por Chat Completions apenas com reasoning_effort: "none". O novo Sol exige Responses para ferramentas. Chat Completions continua disponível sem ferramentas.
  3. Amostragem: remova parâmetros incompatíveis como temperature e top_p quando o raciocínio estiver ativo. Confira o que o SDK ou o gateway acrescenta automaticamente.

A seleção documentada no Codex CLI é:

bash
codex --model gpt-6.1-sol

Em uma sessão interativa, use /model. É uma orientação baseada na documentação; não testamos uma chamada com conta para produzir este artigo.

Onde o modelo está disponível

O guia de modelos do Codex inclui no lançamento os ambientes correspondentes de Work e Codex para Plus, Pro, Business, Enterprise e Edu. Enterprise e Edu exigem ativação pelo administrador; Free e Go não entram no lançamento inicial. No ChatGPT, ele chega ao Work e ao Codex, não ao Chat comum nessa etapa. Confira os modos de velocidade na conta, no cliente e no workspace.

O consumo de assinaturas e créditos é separado da cobrança por API. Os créditos do Codex não têm uma cobrança independente de gravação de cache. Os exemplos anteriores não garantem uma quantidade de tarefas incluídas em uma assinatura.

Vale torná-lo o modelo padrão?

Para quem usa o Sol anterior, as tarifas padrão mantidas e os melhores resultados publicados justificam um teste controlado. Se você usa Astra, comece por trabalhos frequentes com critérios de aprovação claros. Mantenha uma alternativa quando falhas e correções humanas custarem mais que os tokens.

Um piloto útil reúne seis tarefas: dois bugs reproduzidos, duas alterações entre arquivos e duas perguntas sobre documentos que exijam evidências. Execute cada tarefa três vezes por modelo, com ambiente novo, entradas, ferramentas, permissões e limite de tentativas iguais. Comece com medium explícito e registre testes com ajustes de esforço separadamente. É um protocolo proposto, não executado aqui.

Anote aprovação, omissões, tempo total, tokens cobrados, tentativas malsucedidas e correções manuais. Divida o gasto de todas as tentativas pelos resultados aprovados; se nenhum passar, registre isso. Esse piloto pequeno não estabelece uma taxa universal de sucesso.

O contexto da versão anterior está na análise do GPT-6 Sol e na comparação anterior entre Sol e Astra. Consulte o catálogo de modelos para ver as rotas e tarifas exibidas pela OmniaKey. O lançamento oficial não comprova disponibilidade em qualquer gateway. As fontes da OpenAI citadas estão em inglês.