Um único comando de texto. Três ferramentas de IA. Um Google Pixel no outro lado da mesa. Esse foi o cenário do teste do MakeUseOf em outubro de 2026: pedir ao Claude Code, ao Codex e ao Antigravity que construíssem e instalassem o mesmo app Android — sem ajuda humana.

Claude Code vs Codex vs Antigravity: os três chegaram ao fim, mas os caminhos foram bem diferentes.

Como foi o teste

O desafio era objetivo: um único prompt pedindo a construção de um app Android para instalação em um Google Pixel. Sem instrução extra, sem intervenção humana. Cada ferramenta escreveu o código, resolveu dependências e entregou o app pronto para instalar.

Esse tipo de prova interessa diretamente a qualquer empresário ou gestor que cogita usar IA para automatizar tarefas de desenvolvimento — em uma startup ou numa equipe de tecnologia.

Claude Code: o mais rápido

Claude Code, rodando com o modelo Anthropic Opus 5.5, concluiu a tarefa em menos de 9 minutos — o melhor tempo entre os três. Pediu permissão cerca de 3 vezes durante o processo: solicitações simples de sim ou não sobre permissões de arquivo e pasta.

Tempo curto e baixo número de interrupções fazem diferença no dia a dia: um agente que para a cada dois minutos para pedir autorização dobra o tempo real de execução — e o custo de atenção do desenvolvedor que acompanha.

Por que isso importa para o seu negócio

A diferença entre Claude Code vs Codex vs Antigravity neste teste não estava na qualidade do produto final — os apps foram, nas palavras do autor do MakeUseOf, "quase intercambiáveis". O que variou foi a velocidade e o número de vezes que o agente parou para pedir confirmação.

Para quem paga por tokens ou gerencia uma equipe de desenvolvimento com tempo escasso, essa diferença tem impacto financeiro direto. O Claude Code foi 1,5x mais rápido que o Codex e pediu permissão 3x menos vezes — para o mesmo resultado. Isso se traduz em menos interrupção e menos custo de contexto por tarefa entregue.

Veja também: Claude Code vs Cursor vs Copilot: qual ferramenta de IA para programar usar em 2026

Codex: mais lento, mais interrupções

O Codex, da OpenAI, completou o app em cerca de 14 minutos. Durante o processo, fez aproximadamente 10 pedidos de permissão — mais de três vezes o número do Claude Code. O app final ficou no mesmo nível de qualidade.

O padrão de comportamento é diferente: o Codex solicita mais confirmações antes de agir. Para equipes que preferem controle granular sobre cada passo do desenvolvimento, essa característica pode ser uma vantagem.

Antigravity: também chegou lá

O Antigravity, ferramenta de codificação por IA do Google, também concluiu o app dentro do prazo de 30 minutos. O artigo do MakeUseOf não detalha o tempo exato do Antigravity, mas confirma que os três entregaram apps funcionais e instaláveis.

O Antigravity trabalha com subagentes paralelos e tem integração nativa com Firebase e Android — o que pode se traduzir em vantagem em projetos mais complexos dentro do ecossistema Google.

O que o teste não mede

Velocidade em tarefa simples não é o único critério. Em projetos com múltiplos arquivos, regras de negócio específicas e arquitetura elaborada, o comportamento dos agentes muda. O próprio MakeUseOf faz essa série com diferentes tipos de projeto — eletrônica, desenvolvimento web, apps mobile — e os resultados variam por contexto.

Relacionado: Sandbox escape em agentes de IA: Cursor, Codex e Gemini CLI foram atingidos pela mesma falha

Fonte: MakeUseOf — Claude Code vs Codex vs Antigravity: teste completo


Conteúdo reescrito e traduzido para PT pela redação luiscortex, revisado por humano.

Fonte: MakeUseOf