No dia 22 de setembro de 2026, a Anthropic lançou o Claude Opus 5.5. Cerca de uma hora depois, a OpenAI lançou o GPT-6 Sol e o GPT-6 Luna. Os três modelos vieram com preço mais baixo que suas versões anteriores, reacendendo a guerra de preço entre os grandes laboratórios de IA. Quem cria produtos com Claude Code, Cursor ou qualquer outra ferramenta agentic sente isso direto no custo de rodar um agente o dia inteiro.

O desenvolvedor Simon Willison, que testa modelo por modelo desde 2023, chamou o momento de “a new price war” no ar do lançamento simultâneo.

Quanto cada modelo custa agora?

Os preços caem de forma parecida nos dois laboratórios: entre 20% e 50% mais barato que a geração anterior, dependendo do modelo. A tabela abaixo, compilada por Willison, mostra o valor por milhão de tokens de cada um:

ModeloEntradaEntrada em cacheSaída
GPT-6 LunaUS$ 0,10US$ 0,01US$ 0,50
GPT-5.6 LunaUS$ 0,20US$ 0,02US$ 1,20
Grok 4.7US$ 2US$ 0,50US$ 6
GPT-6 SolUS$ 2US$ 0,20US$ 10
GPT-5.6 TerraUS$ 2US$ 0,20US$ 12
Claude Opus 5.5US$ 4US$ 0,20US$ 20
GPT-5.6 SolUS$ 4US$ 0,40US$ 20
Claude Fable 5.1US$ 10US$ 0,25US$ 50
GPT-6 AstraUS$ 10US$ 1US$ 50

O GPT-6 Luna saiu pela metade do preço do GPT-5.6 Luna, que já era o modelo favorito de Willison pra construir aplicações por ser barato e competente. A US$ 0,10 de entrada e US$ 0,50 de saída por milhão de tokens, o GPT-6 Luna fica atrás só de dois modelos historicamente fracos: o GPT-4.1 Nano (US$ 0,10/US$ 0,40, abril de 2025) e o GPT-5 Nano (US$ 0,05/US$ 0,40, agosto de 2025).

O GPT-6 Sol repete a proporção: metade do preço do GPT-5.6 Sol, que custava exatamente o mesmo que o Opus 5.5 custa hoje (US$ 4 de entrada, US$ 20 de saída). Ou seja: o Opus 5.5 saiu com o preço que era do GPT-5.6 Sol antes do corte, e agora tem um concorrente direto custando metade disso.

Por que a Anthropic cortou o preço do topo de linha?

O Opus 5.5 ficou 20% mais barato que a geração anterior: caiu de US$ 5 de entrada e US$ 25 de saída (preço que se manteve estável do Opus 4.5 até o Opus 5) para US$ 4 e US$ 20 por milhão de tokens. O corte mais relevante, porém, foi em outro número: o preço de leitura em cache caiu 60%.

Isso importa mais do que parece pra quem roda agente. Em conversas agentic longas, como as que Claude Code mantém enquanto lê arquivos, roda comandos e itera sobre erros, mais de 90% dos tokens de entrada são processados a preço de cache, não a preço de entrada cheio. Um corte de 60% nesse número pesa mais na conta final do que um corte de 20% no preço de entrada padrão.

Segundo o engenheiro da Anthropic Thariq Shihipar, em post reproduzido por Willison, “o Opus 5.5 é o resultado do feedback de vocês: ele comunica com clareza, é mais barato por token que o Opus 5.0, tem a inteligência do Fable 5.1, é muito eficiente em token e funciona bem em todo nível de esforço.”

O que muda pra quem cria com Claude Code e Cursor?

Na prática, o criador ganha uma escolha mais barata pra rodar tarefa pesada de agente sem trocar de qualidade. Willison relatou que já trocou o modelo default do próprio Codex e do Claude Code para GPT-6 Sol e Claude Opus 5.5, e migrou o assistente de dados que mantém, o Datasette Agent, para rodar em GPT-6 Luna, “rápido e competente tanto em consultas SQL quanto na construção de HTML e JavaScript.”

Isso é o retrato de como o público de ferramentas agentic está reagindo à guerra de preço: escolher o modelo pela tarefa, não fixar um modelo só pra tudo. Tarefa simples e repetitiva (gerar SQL, escrever HTML de rotina) vai pro modelo mais barato. Tarefa que exige raciocínio mais profundo continua no topo de linha, agora também mais barato que há uma semana.

Opus 5.5 no modo “max” trava: o que aconteceu no teste do pelicano?

No teste que Willison roda desde 2024 com todo modelo novo (pedir um SVG de “um pelicano andando de bicicleta”), o Opus 5.5 no nível de esforço “max” simplesmente não terminou a resposta. O modelo começou a planejar a ilustração com um nível de detalhe crescente, chegando a verificar “se o comprimento da canela bate em aproximadamente 95,2” antes de estourar o limite de 128 mil tokens de saída ainda no meio do raciocínio.

Willison repetiu o teste e teve o mesmo resultado na segunda tentativa. Cada uma das duas falhas custou US$ 2,56 e levou quase 20 minutos, segundo o próprio cálculo dele. A conclusão prática: “isso me faz suspeitar que ‘max’ é, na prática, inútil. Se ele passa do ponto de quebra num prompt bobo de SVG, eu não confio que ele não faça o mesmo em trabalho mais importante.”

É um lembrete de que preço mais baixo não é sinônimo de esforço mais alto sempre valer a pena. Rodar um agente no nível máximo de raciocínio sem necessidade pode custar mais e travar mais, mesmo num modelo mais barato que o anterior.

O que vem a seguir

A Anthropic já avisou que o Sonnet 5.5 e o Haiku 5.5 estão a caminho. O ponto de atenção é o Haiku: hoje ele custa US$ 1 de entrada e US$ 5 de saída por milhão de tokens, dez vezes o preço do GPT-6 Luna. Pra recuperar competitividade na ponta mais barata, a Anthropic precisa fazer no Haiku o mesmo corte que fez no Opus.

Essa guerra de preço não é sobre qual modelo é “melhor” de forma abstrata. É sobre quanto custa manter um agente rodando o dia inteiro, revisando código, escrevendo testes e conversando com você sobre o problema. Quem cria produto com IA ganha, nas próximas semanas, mais opção de custo pra cada parte do trabalho, e isso é o tipo de coisa que decide se um projeto de agente é viável em escala ou só um experimento caro.

A Formação em Vibe Coding do ibe.IA mostra como sair da ideia e publicar o primeiro app na mesma semana, escolhendo o modelo certo pra cada parte do trabalho em vez de pagar caro por poder que a tarefa não precisa.

Conheça a Formação em Vibe Coding

E se essa leitura te ajudou a entender o que está acontecendo, segue a ibe.IA no Instagram (@ibe.ia) que toda semana sai conteúdo desse jeito.

Fonte

Simon Willison: Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price war