Google Antigravity: 76% no Terminal-Bench, trava de graça
Back to the blog
Artigo

Google Antigravity: 76% no Terminal-Bench, trava de graça

Mafra
14/08/2026
4 min read

Google Antigravity bateu o Claude Code no Terminal-Bench 2.1: 76,2% contra 74,6%, segundo levantamento da Firecrawl. E é gratuito para uso individual. Só que "gratuito" no mundo dos agentes de programação sempre vem com letra miúda, e aqui a letra miúda é rate limit agressivo.

O que é o Google Antigravity?

Lançado em 20 de novembro de 2025, o Antigravity é um fork do VS Code construído em torno de um "Agent Manager", segundo o review do OpenAI Tools Hub: uma tela que orquestra até 5 agentes autônomos trabalhando em paralelo, cada um numa tarefa diferente do mesmo projeto. Roda por padrão o Gemini 3.5 Flash, mas também oferece Gemini 3.1 Pro, Claude Sonnet, Claude Opus 4.6 e gpt-oss-120b. Tem navegador Chromium embutido pra verificação visual de frontend e gera "Trust Artifacts": listas de tarefas, prints e planos de implementação pra você revisar antes de aceitar o que o agente fez.

No Terminal-Bench 2.1, que mede a capacidade de um agente de resolver tarefas reais de linha de comando, o Antigravity tirou 76,2% contra 74,6% do Claude Code e 61,7% do Cursor. É uma vitória real, mas específica. No SWE-bench, o benchmark que mede resolução de issues reais de GitHub (refactor, bugs complexos, mudanças multi-arquivo), o Google não publicou número. A recomendação da própria análise da Firecrawl é direta: "não assuma uma pontuação".

AgenteTerminal-Bench 2.1Preço de entradaModelo de cobrança
Google Antigravity76,2%Grátis (individual)Rate limit agressivo reportado
Claude Code74,6%US$ 20 a 100/mêsCap de uso por janela de 5h
Cursor61,7%US$ 20 a 200/mêsCréditos por request
Verboo Codenão publicadoR$ 75/mêsTokens ilimitados

O "gratuito" do Antigravity é mesmo grátis?

A CLI do Antigravity foi lançada no Google I/O 2026 junto com um SDK, e o material de demonstração mostrou um projeto chamado "Doom OS" rodando com 93 subagentes em paralelo, consumindo 339 milhões de tokens de entrada numa única sessão. É a prova de conceito perfeita de por que orquestrar múltiplos agentes impressiona. É também a prova de por que qualquer sistema com cap de uso quebra rápido quando alguém tenta fazer isso de verdade.

Segundo a mesma análise, assinantes pagos relatam que "limites de taxa são um tapa na cara". Isso bate com o padrão que qualquer dev que já rodou Claude Code, Cursor ou Copilot em produção conhece: o plano de entrada resolve pra sessão curta, mas trava exatamente na hora em que o projeto fica sério, quando você abre 3, 4, 5 agentes ao mesmo tempo pra acelerar um refactor grande.

Como avaliar um agente de programação além do benchmark de marketing?

Benchmark de lançamento mede um cenário controlado. O que decide se um agente aguenta seu dia a dia é outra conta. Antes de trocar de ferramenta, valem 3 checagens:

  • Teste a sessão longa, não a demo curta. Rode uma tarefa real de 2 a 3 horas (refactor de módulo, migração de schema) e veja se o agente trava, perde contexto ou pede pra você esperar o rate limit resetar.
  • Multiplique pelo número de agentes que você realmente usa em paralelo. Se a demo consumiu 339 milhões de tokens pra construir um sistema operacional de brinquedo, calcule quanto seu time gastaria fazendo isso em produção, todo dia, com vários devs.
  • Procure o SWE-bench, não só o Terminal-Bench. Terminal-Bench mede comandos e scripts. SWE-bench mede resolução de issues reais, o trabalho que mais se parece com o seu backlog.

O que o Verboo Code faz diferente?

O Verboo Code não tenta vencer o Antigravity no número de agentes em paralelo. Resolve o problema de origem: tokens ilimitados de verdade, sem rate limit escondido atrás do "grátis" e sem cap de janela de 5 horas. Os planos vão de R$ 75/mês (Junior) a R$ 900/mês (Ultra), com 7 modelos open source rodando em GPU dedicada: deepseek-v4-flash e mimo-v2.5 (1M de contexto cada), glm-5.2 (524k), kimi-k2.7 (259k), qwen3.6-27b (262k) e glm-4.7-flash. O plano Pro (R$ 174/mês) tem 1 dia de teste grátis, sem pedir cartão.

MRR de R$ 30.409,90/mês (+43%), 167 assinantes ativos (+33%). Crescimento 100% orgânico, sem verba de mídia paga desde abril de 2026.

Não é sobre ter mais agentes rodando ao mesmo tempo. É sobre nenhum deles parar no meio de uma tarefa longa porque bateu num limite que ninguém avisou que existia.

Quer comparar na prática? O comparativo entre Cursor, Claude Code e Verboo Code tem os números lado a lado.

Cansou de calcular se o rate limit vai travar no meio do refactor? Conheça o Verboo Code, agente de programação com tokens ilimitados de verdade.

Enjoyed this article?
Share knowledge with your network.
Read also

Related articles