O que é o GPT-6.1 Sol, e onde mora o desconto de 95%

O que é o GPT-6.1 Sol?
GPT-6.1 Sol é o modelo de trabalho do dia a dia da OpenAI, anunciado em 29 de setembro de 2026. Cobra US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de saída, um quinto do preço do GPT-6 Astra, o modelo topo de linha. A OpenAI diz que ele chega perto do Astra em código e em uso de computador.
Token é o pedaço de texto que o modelo cobra, mais ou menos uma sílaba. Um milhão de tokens, escrito Mtok nas tabelas de preço, dá um livro grosso. Entrada é o que você manda, saída é o que ele responde.
Por que o nome apareceu em toda conversa depois do DevDay de 29 de setembro?
O DevDay 2026 aconteceu em 29 de setembro em San Francisco, com mais de 20 anúncios. O Sol foi o que mexe na fatura de quem já usa a API. No dia anterior, 28 de setembro, a OpenAI cancelou o GPT-6.1 Astra por falhas de segurança nas avaliações internas. O Sol ficou como a novidade utilizável.
No mesmo dia, a Agents API ganhou uso de computador, e a Decisions API entrou em preview limitado para classificar e rotear pedidos, trabalho que hoje muitas orgs fazem com tópicos do Agentforce ou ramos de Flow.
Onde mora o desconto de 95% e como não perder ele?
Entrada cacheada custa US$ 0,10 por Mtok, 95% abaixo da entrada normal e metade do que o GPT-6 Sol cobrava. Cache é o desconto por mandar de novo um texto que o fornecedor já viu: instrução do agente, regras de negócio, descrição dos objetos. A parte repetida sai barata.
A regra prática é a ordem do prompt. Bloco fixo no começo, o que varia no fim. Se você embaralha essa ordem entre chamadas, o cache não bate e você paga cheio. Um agente que repete 8 mil tokens de instrução em 50 mil chamadas no mês manda 400 Mtok: US$ 800 sem cache, US$ 40 com cache.
Vale olhar a coluna do meio da tabela também. Sonnet 5.5 (28/09), GPT-6.1 Sol (29/09) e Gemini 4 Argon (30/09) estão os três em US$ 2 / US$ 10. O preço de tabela parou de separar os fornecedores, e sobraram latência, onde o dado fica e em qual fornecedor a org já confia.
Como isso aparece num chamado de suporte?
Um analista abre um chamado no Service Cloud e pede o resumo do histórico da conta. O agente manda as mesmas 6 mil tokens de instrução que manda em todo chamado, mais o histórico daquele cliente. Com o bloco fixo na frente, só o histórico entra no preço cheio.
Isso é mensurável antes de trocar de modelo: conte quantos tokens do seu prompt são texto fixo. Se a maior parte for, a conta cai pelo cache, não pela mudança de fornecedor.

What is GPT-6.1 Sol?
GPT-6.1 Sol is OpenAI's everyday workhorse model, announced on 2026-09-29. It charges US$2 per million input tokens and US$10 per million output tokens, one fifth of GPT-6 Astra, the top model. OpenAI positions it as close to Astra on agentic coding and computer use.
A token is the chunk of text a model bills you for, roughly a syllable. One million tokens, written Mtok in price tables, is a thick book. Input is what you send, output is what comes back.
Why did the name show up in every conversation after DevDay on September 29?
DevDay 2026 ran on 2026-09-29 in San Francisco with more than 20 announcements. Sol is the one that moves the bill for anyone already on the API. The day before, on 2026-09-28, OpenAI cancelled GPT-6.1 Astra after internal safety evaluations. Sol was left as the usable news.
The same day, the Agents API gained computer use, and the Decisions API entered limited preview for classification and request routing, work many orgs do today with Agentforce topics or Flow branches.
Where does the 95% discount live, and how do you keep it?
Cached input costs US$0.10 per Mtok, 95% below standard input and half of what GPT-6 Sol charged for cached tokens. Caching is the discount for resending text the provider has already seen: agent instructions, business rules, object descriptions. The repeated part gets cheap.
The practical rule is prompt order. Fixed block first, variable part last. Shuffle that order between calls and the cache misses, so you pay full price. An agent repeating 8,000 instruction tokens across 50,000 calls a month sends 400 Mtok: US$800 without caching, US$40 with it.
The middle column of the price table matters too. Sonnet 5.5 (09-28), GPT-6.1 Sol (09-29) and Gemini 4 Argon (09-30) all list US$2 / US$10. List price stopped separating vendors, which leaves latency, data residency and the trust boundary your org already has.
How does this show up in one support case?
A support analyst opens a case in Service Cloud and asks for a summary of the account history. The agent sends the same 6,000 instruction tokens it sends on every case, plus that customer's history. With the fixed block up front, only the history bills at full price.
This is measurable before any model switch: count how many tokens of your prompt are fixed text. If most of it is, caching cuts the bill, not the change of vendor.
GPT-6.1 Sol
Modelo de uso diário da OpenAI, anunciado em 29 de setembro de 2026. É o modelo barato da linha, feito pra rodar muita chamada em volume.
Neste post: É o termo do post: o nome que apareceu em toda conversa depois do DevDay.
GPT-6 Astra
Modelo topo de linha da OpenAI, cinco vezes mais caro que o Sol na entrada. A versão 6.1 dele foi cancelada em 28 de setembro de 2026 por falhas nas avaliações de segurança.
Neste post: É a referência de preço que faz o Sol parecer barato, e o cancelamento explica por que o Sol ficou sendo a notícia.
Token
Pedaço de texto que o modelo lê ou escreve, mais ou menos do tamanho de uma sílaba. É a unidade que o fornecedor cobra.
Neste post: Todos os preços do post estão em tokens, e quem não sabe o que é não entende a conta.
Mtok
Abreviação de um milhão de tokens. É como as tabelas de preço mostram o valor: US$ 2 por Mtok, por exemplo.
Neste post: Aparece em toda comparação de preço citada aqui.
Entrada e saída (input e output)
Entrada é o texto que você manda pro modelo. Saída é o que ele responde. A saída custa mais caro que a entrada.
Neste post: O par US$ 2 / US$ 10 é exatamente entrada e saída.
Entrada cacheada (prompt caching)
Quando você manda de novo um texto que o fornecedor já processou, ele cobra bem menos por essa parte. Parecido com passar o mesmo crachá numa portaria que já te conhece.
Neste post: É o desconto de 95% que dá o título do post, e o que faz a conta cair de US$ 800 pra US$ 40 no exemplo.
Prompt
O texto de instrução que você manda pro modelo antes da pergunta em si. Costuma ter regras, contexto e exemplos.
Neste post: A ordem do prompt é o que faz o cache bater ou não.
DevDay
Evento anual da OpenAI pra quem programa. A edição de 2026 rolou em 29 de setembro, em San Francisco, com mais de 20 anúncios.
Neste post: É a data que colocou o Sol na roda.
Agents API
Interface da OpenAI pra montar agentes que executam tarefas em vários passos, não só respondem texto.
Neste post: Ganhou uso de computador no mesmo DevDay, o que amplia o que um agente de fora consegue fazer.
Computer use (uso de computador)
Capacidade do modelo de operar uma tela: clicar, digitar e navegar como uma pessoa faria. Não precisa de API do sistema alvo.
Neste post: Permite que um agente de fora da Salesforce mexa numa tela da org sem contrato de integração.
Decisions API
Serviço da OpenAI que responde perguntas com um conjunto fechado de respostas possíveis, pra classificar ou rotear pedidos. Entrou em preview limitado em 29 de setembro de 2026.
Neste post: Faz o mesmo trabalho que muita org já resolve com tópico de Agentforce ou ramo de Flow, então entra na comparação de comprar ou construir.
Agentforce
Plataforma de agentes de IA da Salesforce, que roda dentro da org e usa os dados dela.
Neste post: É onde a lógica de classificação e roteamento normalmente mora hoje, no lugar da Decisions API.
Tópico (Agentforce topic)
Agrupamento de instruções e ações no Agentforce que define o que o agente faz num assunto específico.
Neste post: É o concorrente interno da Decisions API na hora de rotear pedido.
Flow
Ferramenta de automação da Salesforce que monta processos em passos, sem escrever código.
Neste post: Ramos de Flow são a outra forma clássica de fazer classificação e roteamento dentro da org.
Service Cloud
Produto da Salesforce pra atendimento ao cliente, onde ficam os chamados (cases).
Neste post: É o cenário concreto do post: o analista pedindo resumo do histórico da conta.
Sonnet 5.5
Modelo da Anthropic lançado em 28 de setembro de 2026, na faixa de preço de uso diário.
Neste post: Está no mesmo US$ 2 / US$ 10 do Sol, o que mostra que preço deixou de separar fornecedor.
Gemini 4 Argon
Modelo do Google que entrou na mesma faixa de preço em 30 de setembro de 2026.
Neste post: Terceiro fornecedor no mesmo preço de tabela na mesma semana.
Latência
Tempo que o modelo leva pra começar e terminar de responder. Medida em segundos ou em tokens por segundo.
Neste post: Com preço igual entre três fornecedores, é um dos critérios que sobram pra escolher.
Ultrafast (tier)
Modo mais rápido anunciado pela OpenAI no DevDay, com até 300 tokens por segundo.
Neste post: Exemplo de como velocidade virou argumento de venda agora que o preço empatou.
