Google Antigravity bateu o Claude Code no Terminal-Bench 2.1: 76,2% contra 74,6%, segundo levantamento da Firecrawl. E é gratuito para uso individual. Só que "gratuito" no mundo dos agentes de programação sempre vem com letra miúda, e aqui a letra miúda é rate limit agressivo.
O que é o Google Antigravity?
Lançado em 20 de novembro de 2025, o Antigravity é um fork do VS Code construído em torno de um "Agent Manager", segundo o review do OpenAI Tools Hub: uma tela que orquestra até 5 agentes autônomos trabalhando em paralelo, cada um numa tarefa diferente do mesmo projeto. Roda por padrão o Gemini 3.5 Flash, mas também oferece Gemini 3.1 Pro, Claude Sonnet, Claude Opus 4.6 e gpt-oss-120b. Tem navegador Chromium embutido pra verificação visual de frontend e gera "Trust Artifacts": listas de tarefas, prints e planos de implementação pra você revisar antes de aceitar o que o agente fez.
No Terminal-Bench 2.1, que mede a capacidade de um agente de resolver tarefas reais de linha de comando, o Antigravity tirou 76,2% contra 74,6% do Claude Code e 61,7% do Cursor. É uma vitória real, mas específica. No SWE-bench, o benchmark que mede resolução de issues reais de GitHub (refactor, bugs complexos, mudanças multi-arquivo), o Google não publicou número. A recomendação da própria análise da Firecrawl é direta: "não assuma uma pontuação".
| Agente | Terminal-Bench 2.1 | Preço de entrada | Modelo de cobrança |
|---|---|---|---|
| Google Antigravity | 76,2% | Grátis (individual) | Rate limit agressivo reportado |
| Claude Code | 74,6% | US$ 20 a 100/mês | Cap de uso por janela de 5h |
| Cursor | 61,7% | US$ 20 a 200/mês | Créditos por request |
| Verboo Code | não publicado | R$ 75/mês | Tokens ilimitados |
O "gratuito" do Antigravity é mesmo grátis?
A CLI do Antigravity foi lançada no Google I/O 2026 junto com um SDK, e o material de demonstração mostrou um projeto chamado "Doom OS" rodando com 93 subagentes em paralelo, consumindo 339 milhões de tokens de entrada numa única sessão. É a prova de conceito perfeita de por que orquestrar múltiplos agentes impressiona. É também a prova de por que qualquer sistema com cap de uso quebra rápido quando alguém tenta fazer isso de verdade.
Segundo a mesma análise, assinantes pagos relatam que "limites de taxa são um tapa na cara". Isso bate com o padrão que qualquer dev que já rodou Claude Code, Cursor ou Copilot em produção conhece: o plano de entrada resolve pra sessão curta, mas trava exatamente na hora em que o projeto fica sério, quando você abre 3, 4, 5 agentes ao mesmo tempo pra acelerar um refactor grande.
Como avaliar um agente de programação além do benchmark de marketing?
Benchmark de lançamento mede um cenário controlado. O que decide se um agente aguenta seu dia a dia é outra conta. Antes de trocar de ferramenta, valem 3 checagens:
- Teste a sessão longa, não a demo curta. Rode uma tarefa real de 2 a 3 horas (refactor de módulo, migração de schema) e veja se o agente trava, perde contexto ou pede pra você esperar o rate limit resetar.
- Multiplique pelo número de agentes que você realmente usa em paralelo. Se a demo consumiu 339 milhões de tokens pra construir um sistema operacional de brinquedo, calcule quanto seu time gastaria fazendo isso em produção, todo dia, com vários devs.
- Procure o SWE-bench, não só o Terminal-Bench. Terminal-Bench mede comandos e scripts. SWE-bench mede resolução de issues reais, o trabalho que mais se parece com o seu backlog.
O que o Verboo Code faz diferente?
O Verboo Code não tenta vencer o Antigravity no número de agentes em paralelo. Resolve o problema de origem: tokens ilimitados de verdade, sem rate limit escondido atrás do "grátis" e sem cap de janela de 5 horas. Os planos vão de R$ 75/mês (Junior) a R$ 900/mês (Ultra), com 7 modelos open source rodando em GPU dedicada: deepseek-v4-flash e mimo-v2.5 (1M de contexto cada), glm-5.2 (524k), kimi-k2.7 (259k), qwen3.6-27b (262k) e glm-4.7-flash. O plano Pro (R$ 174/mês) tem 1 dia de teste grátis, sem pedir cartão.
MRR de R$ 30.409,90/mês (+43%), 167 assinantes ativos (+33%). Crescimento 100% orgânico, sem verba de mídia paga desde abril de 2026.
Não é sobre ter mais agentes rodando ao mesmo tempo. É sobre nenhum deles parar no meio de uma tarefa longa porque bateu num limite que ninguém avisou que existia.
Quer comparar na prática? O comparativo entre Cursor, Claude Code e Verboo Code tem os números lado a lado.
Cansou de calcular se o rate limit vai travar no meio do refactor? Conheça o Verboo Code, agente de programação com tokens ilimitados de verdade.



