A guerra de preços que chegou à IA de produção

Em 30 de julho de 2026, a OpenAI anunciou cortes de preço significativos nos modelos da família GPT-5.6: o modelo Luna — o mais rápido e compacto da linha — teve seu GPT-5.6 Luna preço reduzido em 80%, saindo de US$ 1 por milhão de tokens de entrada para apenas US$ 0,20. Na saída, o preço caiu de US$ 6 para US$ 1,20 — um total combinado de US$ 1,40 por milhão de tokens, ante US$ 7,00 anteriores.

O modelo Terra, voltado para produção geral, recebeu um corte mais moderado de 20%: novo preço de US$ 2,00 entrada e US$ 12,00 saída (antes: US$ 2,50/US$ 15,00). Já o Sol, o flagship para raciocínio complexo, foi mantido em US$ 5,00/US$ 30,00.

"Cortes de preço importantes hoje", anunciou Sam Altman ao divulgar as mudanças.

Por que a OpenAI cortou os preços tão rápido?

A resposta está no mapa competitivo. Uma investigação da CNBC publicada em julho de 2026 revelou que modelos chineses já representavam 46% do consumo enterprise de tokens nos Estados Unidos medido pelo OpenRouter — superando em picos os modelos de origem americana. O GPT-5.6 Luna preço anterior de US$ 1/US$ 6 tornava o modelo pouco competitivo diante de alternativas como:

  • DeepSeek V4 Flash: US$ 0,42 por milhão de tokens combinados
  • Xiaomi MiMo-V2.5 Flash: US$ 0,40 por milhão de tokens
  • Google Gemini 3.5 Flash-Lite: US$ 2,80 por milhão de tokens

Após o corte, o Luna compete diretamente nessa faixa, oferecendo o que a Artificial Analysis aponta como melhor relação custo-inteligência que o Gemini 3.6 Flash — e superando modelos antigos do Google Gemini 3.1 Pro.

Há uma exceção: Claude Opus 5, da Anthropic, mantém seu preço de US$ 30,00 combinado — e o Claude Fable 5.1 e Mythos 5 ficam em US$ 60,00. São modelos posicionados para raciocínio avançado, fora da guerra de preços de alto volume.

Por que isso importa para o seu negócio

A queda no GPT-5.6 Luna preço muda o cálculo de viabilidade de projetos de IA em vários cenários:

Sumarização em escala. Para empresas que processam milhares de documentos por mês, a diferença de US$ 7 para US$ 1,40 por milhão de tokens representa economia de mais de 80% no custo de processamento.

Classificação e roteamento. Sistemas que usam IA para triagem de e-mails, tickets de suporte ou categorização de dados se tornam economicamente viáveis mesmo para pequenas operações.

Chatbots de atendimento. O GPT-5.6 Luna é suficientemente capaz para conversas de suporte simples — e agora cabe no orçamento de PMEs.

A mudança também sinaliza que a competição em IA migrou definitivamente da corrida por capacidades para a corrida por eficiência de custo. Para empreendedores, isso é uma janela de oportunidade: a IA de produção está mais barata do que nunca, e quem automatizar processos agora sai na frente.

Para comparar preços em tempo real entre modelos, a Artificial Analysis mantém um ranking atualizado de custo-desempenho entre os principais modelos disponíveis no mercado.


Conteúdo reescrito e traduzido para PT pela redação luiscortex, revisado por humano.

Fonte: Meta AI — cobertura (EN)