Em 30 de junho, a Anthropic lançou o Claude Sonnet 5 com uma manchete atraente: o modelo de agente mais barato da família Claude. Preço de lançamento: $2 por milhão de tokens de entrada, $10 por milhão de saída. Mas tem uma linha no rodapé que muda bastante a análise: esse preço vale só até 31 de agosto de 2026.
A partir de 1 de setembro, a tabela muda para $3/M de entrada e $15/M de saída. Aumento de 50% na saída, sem qualquer mudança no modelo. Para quem está construindo algo com Sonnet 5 agora, o custo da operação vai subir em dois meses sem aviso nenhum além dessa nota de rodapé.
O que o Sonnet 5 entrega de verdade?
Antes de chegar na conta, vale entender o que mudou tecnicamente. O Claude Sonnet 5 marcou 63,2% no SWE-bench Verified, o benchmark mais citado para coding agents. É um salto real em relação ao Sonnet 4.6, que marcava 58,1%. Em raciocínio e uso de ferramentas, o Sonnet 5 supera ligeiramente o próprio Claude Opus 4.8, com contexto de até 1 milhão de tokens.
A Anthropic posicionou o modelo explicitamente para agentes autônomos: "pode fazer planos, usar ferramentas como navegadores e terminais, e rodar autonomamente em nível que antes exigia modelos maiores e mais caros." O caso de uso citado no lançamento foi automação de CRM - atualizar contas no Salesforce com envio automático de anúncios. Para pipelines de negócio com volume controlado, a proposta faz sentido.
Mas 63,2% no SWE-bench não é o topo do mercado, nem dentro da própria Anthropic. O Claude Opus 4.8 marca 69,2%. O Sonnet 5 ocupa o meio do campo: melhor que o antigo Sonnet, mas não o melhor modelo de coding disponível. Quem precisa do teto de performance ainda vai pagar mais.
Quanto custa de verdade por mês de uso intenso?
| Modelo | Entrada (/M tokens) | Saída (/M tokens) | SWE-bench | Contexto |
|---|---|---|---|---|
| Claude Sonnet 5 (até 31/ago) | $2 | $10 | 63,2% | 1M |
| Claude Sonnet 5 (de set/2026) | $3 | $15 | 63,2% | 1M |
| Claude Opus 4.8 | $5 | $25 | 69,2% | 200K |
| Claude Sonnet 4.6 | $3 | $15 | 58,1% | 200K |
| Verboo Code Pro (tokens ilimitados) | R$ 174/mês fixo | múltiplos modelos open source | até 1M | |
O que a tabela não mostra é o volume de uso. Em workflows de agente de programação, a saída domina o custo: o modelo processa contexto grande e gera código, análises e raciocínio. Uma sessão de refactor de 3 horas pode facilmente gerar 30 a 50 mil tokens de saída. Para um dev que usa agente como ferramenta principal de trabalho, 4 a 6 horas por dia em 20 dias úteis coloca a saída mensal facilmente na faixa de 20 a 50 milhões de tokens.
Com Sonnet 5 promo a $10/M: 20M tokens de saída = $200 por mês. Com 50M tokens: $500. Ao câmbio atual, isso significa entre R$ 1.100 e R$ 2.800 por mês. E ainda é o preço promocional. A partir de setembro, a mesma conta fica entre R$ 1.650 e R$ 4.275. Sem nenhuma mudança no seu uso.
Para comparação, a matemática do Claude Code usado 8h por dia chega a R$ 3.400/mês. O padrão de consumo de um agente de programação intensivo é consistente, independente de qual modelo está por baixo.
Para quem o Sonnet 5 faz sentido?
Sendo honesta: o Sonnet 5 é um bom lançamento. Para casos de uso com volume de tokens controlado, como automação de processos de negócio (CRM, análise de documentos, chatbot de suporte), $2/M de entrada é competitivo. O modelo tem qualidade real no SWE-bench e capacidade agentic genuína, com contexto de 1M tokens que abre possibilidades para análise de codebases grandes.
Também faz sentido para times que já estão no ecossistema Anthropic e precisam de uma alternativa mais barata que o Opus para tarefas de complexidade média. Para esses casos, o Sonnet 5 preenche o gap com competência - e está disponível como modelo padrão nos planos gratuito e Pro do Claude.ai.
Onde a equação não fecha?
Para o dev que usa agente de programação como ambiente de trabalho principal, o custo por token escala rápido demais. Sessões longas de exploração de codebase, refatoração de monolito, code review contínuo. Nesses cenários, a diferença entre $10/M e $15/M de saída já impacta, e a diferença entre "por token" e "tokens ilimitados" impacta mais ainda.
Outro ponto: o preço promocional cria um risco de lock-in que vale mapear. Se você constrói hoje um produto ou pipeline que depende de Sonnet 5, está implicitamente aceitando que o custo base vai subir 50% na saída em setembro. Isso precisa entrar no planejamento de precificação de qualquer produto que usa o modelo por baixo, antes de setembro chegar.
O que o Verboo Code faz diferente?
O Verboo Code não cobra por token. Roda modelos open source em GPU dedicada: glm-5.2, mimo-v2.5-pro, qwen3.6-35b, deepseek-v4-flash, gpt-oss-120b e outros, com contexto de até 1 milhão de tokens em alguns modelos. O preço é fixo em real: R$ 75/mês no plano Junior, R$ 174/mês no Pro.
Tokens ilimitados elimina o principal problema de custo do agente de programação intensivo: a imprevisibilidade. Você pode rodar 5 milhões ou 50 milhões de tokens de saída no mês. A conta não muda. Para devs que usam agente como ferramenta principal, a previsibilidade do custo mensal em real fixo é parte do produto, não um detalhe de plano. Veja os benchmarks comparados com Cursor e Claude Code.
128 devs pagam R$ 75 a 174/mês no Verboo Code hoje. MRR chegou a R$ 18.824, crescimento de 8% mês a mês. Nenhum deles vai abrir uma fatura diferente em setembro.
O prazo de 31 de agosto muda o cálculo
O Sonnet 5 é um bom modelo. A Anthropic está movendo o mercado e o salto de 5 pontos percentuais no SWE-bench Verified é real, não marketing. O 1M de contexto é genuinamente útil para análise de codebases grandes. Mérito onde tem mérito.
Mas a decisão de adotar o modelo agora deveria incluir o preço de setembro na planilha, não apenas o de junho. Se o volume do seu uso cabe confortavelmente no custo pós-promoção e o ecossistema Anthropic faz sentido para o seu stack, o Sonnet 5 é uma escolha válida. Se você usa agente de programação como ambiente de trabalho full-time, a conta de tokens ilimitados fecha melhor.
A Anthropic está praticando um preço de entrada para ganhar adoção. É uma estratégia legítima e bem executada. O dev que entende o prazo toma uma decisão mais informada do que o dev que só leu a manchete.
Enquanto o mercado discute qual foi o melhor modelo de julho, a Verboo Code já entrega tokens ilimitados em agente de programação, com modelos open source rodando em GPU dedicada. Conheça.
Fontes: Anthropic lança Claude Sonnet 5 (TechCrunch) | Benchmarks atuais de coding agents (Artificial Analysis)



