GPT-5.6 Luna cai 80% em 3 semanas - ainda cobra por token
Back to the blog
Artigo

GPT-5.6 Luna cai 80% em 3 semanas - ainda cobra por token

Mafra
21/08/2026
5 min read

Nove de julho: a OpenAI lança o GPT-5.6 com preço de tabela cheio. Trinta de julho: corta o preço do modelo mais barato da família, o Luna, em 80%. Três semanas de vida e o número do lançamento já não vale mais nada. O motivo não está no comunicado oficial, está num relatório da semana anterior: modelos chineses já respondem por 46% do uso corporativo de tokens nos Estados Unidos, segundo levantamento citado pela CNBC.

Quanto caiu o preço, exatamente?

O GPT-5.6 chegou em três tamanhos, e cada um teve um destino diferente no corte de 30 de julho:

ModeloAntes (entrada/saída por milhão)DepoisVariação
SolUS$ 5 / US$ 30US$ 5 / US$ 300%
TerraUS$ 2,50 / US$ 15US$ 2 / US$ 12-20%
LunaUS$ 1 / US$ 6US$ 0,20 / US$ 1,20-80%

Repara no padrão: o modelo de topo não perdeu um centavo. Sol segue com preço de frontier porque ninguém troca o modelo principal de produção por causa de desconto. Luna e Terra são os que competem direto com modelo aberto e barato, e foi exatamente aí que a OpenAI abriu mão de margem.

Por que cortar preço de um modelo que ainda nem completou um mês?

A resposta curta é concorrência chinesa, mas o número importa. Modelos chineses já capturam 46% do uso corporativo de tokens americanos no OpenRouter, às vezes superando modelo de origem americana no mesmo agregador. O DeepSeek V4 Pro cobra US$ 0,435 de entrada e US$ 0,87 de saída (com desconto aplicado). O Kimi K3, que subiu de preço 5x na troca de geração, ainda assim cobra US$ 3 de entrada e US$ 15 de saída, bem abaixo do Luna original de US$ 1 e US$ 6.

Modelos chineses já respondem por 46% do uso corporativo de tokens dos EUA no OpenRouter. Cortar 80% do preço do Luna não é presente de aniversário, é resposta de mercado.

Mesmo com 80% de desconto, o Luna ainda perde no que mais importa pra coding

Aqui mora o detalhe que o anúncio não destaca: mesmo depois do corte, o Luna não vence a concorrência chinesa nas duas pontas.

ModeloEntrada (US$/milhão)Saída (US$/milhão)
Luna (pós-corte)US$ 0,20US$ 1,20
DeepSeek V4 ProUS$ 0,435US$ 0,87

Luna ganha na entrada (menos da metade do preço do DeepSeek), mas perde na saída (38% mais caro). Um agente de programação gera muito mais token de saída do que de entrada: código, explicação, diffs, log de execução de ferramenta. É exatamente a métrica errada pra vencer. Cortar 80% e ainda perder na conta que mais pesa pro caso de uso de coding é o tipo de detalhe que só aparece quando alguém faz a matemática linha por linha, não olhando só a manchete do desconto.

Como isso muda a decisão de qual modelo usar?

Preço por token só vira decisão relevante quando alguém multiplica pelo volume real de uma sessão. Um agente de programação numa tarefa de refatoração com contexto de repositório grande, iteração de teste e chamada de ferramenta processa a faixa de milhões de tokens numa tarde de trabalho, não numa semana. Antes de escolher modelo pela tabela de preço, três perguntas valem mais que o desconto anunciado:

  • Qual é a proporção real de entrada vs saída da sua sessão típica? (coding pesa pra saída)
  • O corte veio junto de mudança no limite de uso, ou só no valor por token?
  • Quantas vezes esse modelo já mudou de preço nos últimos 3 meses? Se a resposta é mais de uma, a tabela que você está lendo hoje pode estar desatualizada quando você ler de novo.

O Luna já teve dois preços em 21 dias. Não é caso isolado: o Claude Code subiu limite de uso três vezes em cinco semanas antes disso, o Kimi K3 aumentou preço em 5x na troca de geração. Modelo cobrado por token é planilha viva, não número fixo.

O que fica fora dessa conta

No Verboo Code essa pergunta nem chega a existir. Assinatura fixa, tokens ilimitados, sem medidor de entrada e saída pra somar no fim do mês. Os números de julho, via listamrr:

  • MRR de R$ 32.202,90/mês, alta de 50% no mês
  • 165 assinantes ativos, alta de 31%
  • 7 modelos open source rodando em GPU dedicada, incluindo deepseek-v4-flash e kimi-k2.7
  • Planos de R$ 75 a R$ 900/mês, sem contar token
Trial de 1 dia no plano Pro, sem cartão. Sem tabela de preço por milhão de tokens pra recalcular a cada 3 semanas.

O corte de preço resolve o problema errado

A OpenAI resolveu o problema dela: parar de perder participação pra modelo chinês mais barato. Não resolveu o problema de quem paga a conta: o medidor de token continua ligado, só o número mudou. Quem comemorou o desconto essa semana devia lembrar que nada garante o preço daqui a mais 3 semanas, pra cima ou pra baixo. Já vimos os dois lados esse ano.

Enquanto o mercado segue reajustando centavo por centavo, o Verboo Code nem entra nessa conta: tokens ilimitados numa assinatura fixa, sem depender de quantas vezes a OpenAI decide recalcular a tabela.

Fontes: CNBC, VentureBeat, OpenAI.

Enjoyed this article?
Share knowledge with your network.
Read also

Related articles