A guerra de preços que chegou à IA de produção
Em 30 de julho de 2026, a OpenAI anunciou cortes de preço significativos nos modelos da família GPT-5.6: o modelo Luna — o mais rápido e compacto da linha — teve seu GPT-5.6 Luna preço reduzido em 80%, saindo de US$ 1 por milhão de tokens de entrada para apenas US$ 0,20. Na saída, o preço caiu de US$ 6 para US$ 1,20 — um total combinado de US$ 1,40 por milhão de tokens, ante US$ 7,00 anteriores.
O modelo Terra, voltado para produção geral, recebeu um corte mais moderado de 20%: novo preço de US$ 2,00 entrada e US$ 12,00 saída (antes: US$ 2,50/US$ 15,00). Já o Sol, o flagship para raciocínio complexo, foi mantido em US$ 5,00/US$ 30,00.
"Cortes de preço importantes hoje", anunciou Sam Altman ao divulgar as mudanças.
Por que a OpenAI cortou os preços tão rápido?
A resposta está no mapa competitivo. Uma investigação da CNBC publicada em julho de 2026 revelou que modelos chineses já representavam 46% do consumo enterprise de tokens nos Estados Unidos medido pelo OpenRouter — superando em picos os modelos de origem americana. O GPT-5.6 Luna preço anterior de US$ 1/US$ 6 tornava o modelo pouco competitivo diante de alternativas como:
- DeepSeek V4 Flash: US$ 0,42 por milhão de tokens combinados
- Xiaomi MiMo-V2.5 Flash: US$ 0,40 por milhão de tokens
- Google Gemini 3.5 Flash-Lite: US$ 2,80 por milhão de tokens
Após o corte, o Luna compete diretamente nessa faixa, oferecendo o que a Artificial Analysis aponta como melhor relação custo-inteligência que o Gemini 3.6 Flash — e superando modelos antigos do Google Gemini 3.1 Pro.
Há uma exceção: Claude Opus 5, da Anthropic, mantém seu preço de US$ 30,00 combinado — e o Claude Fable 5.1 e Mythos 5 ficam em US$ 60,00. São modelos posicionados para raciocínio avançado, fora da guerra de preços de alto volume.
Por que isso importa para o seu negócio
A queda no GPT-5.6 Luna preço muda o cálculo de viabilidade de projetos de IA em vários cenários:
Sumarização em escala. Para empresas que processam milhares de documentos por mês, a diferença de US$ 7 para US$ 1,40 por milhão de tokens representa economia de mais de 80% no custo de processamento.
Classificação e roteamento. Sistemas que usam IA para triagem de e-mails, tickets de suporte ou categorização de dados se tornam economicamente viáveis mesmo para pequenas operações.
Chatbots de atendimento. O GPT-5.6 Luna é suficientemente capaz para conversas de suporte simples — e agora cabe no orçamento de PMEs.
A mudança também sinaliza que a competição em IA migrou definitivamente da corrida por capacidades para a corrida por eficiência de custo. Para empreendedores, isso é uma janela de oportunidade: a IA de produção está mais barata do que nunca, e quem automatizar processos agora sai na frente.
Para comparar preços em tempo real entre modelos, a Artificial Analysis mantém um ranking atualizado de custo-desempenho entre os principais modelos disponíveis no mercado.
Conteúdo reescrito e traduzido para PT pela redação luiscortex, revisado por humano.
Fonte: Meta AI — cobertura (EN)





