Um único comando de texto. Três ferramentas de IA. Um Google Pixel no outro lado da mesa. Esse foi o cenário do teste do MakeUseOf em outubro de 2026: pedir ao Claude Code, ao Codex e ao Antigravity que construíssem e instalassem o mesmo app Android — sem ajuda humana.
Claude Code vs Codex vs Antigravity: os três chegaram ao fim, mas os caminhos foram bem diferentes.
Como foi o teste
O desafio era objetivo: um único prompt pedindo a construção de um app Android para instalação em um Google Pixel. Sem instrução extra, sem intervenção humana. Cada ferramenta escreveu o código, resolveu dependências e entregou o app pronto para instalar.
Esse tipo de prova interessa diretamente a qualquer empresário ou gestor que cogita usar IA para automatizar tarefas de desenvolvimento — em uma startup ou numa equipe de tecnologia.
Claude Code: o mais rápido
Claude Code, rodando com o modelo Anthropic Opus 5.5, concluiu a tarefa em menos de 9 minutos — o melhor tempo entre os três. Pediu permissão cerca de 3 vezes durante o processo: solicitações simples de sim ou não sobre permissões de arquivo e pasta.
Tempo curto e baixo número de interrupções fazem diferença no dia a dia: um agente que para a cada dois minutos para pedir autorização dobra o tempo real de execução — e o custo de atenção do desenvolvedor que acompanha.
Por que isso importa para o seu negócio
A diferença entre Claude Code vs Codex vs Antigravity neste teste não estava na qualidade do produto final — os apps foram, nas palavras do autor do MakeUseOf, "quase intercambiáveis". O que variou foi a velocidade e o número de vezes que o agente parou para pedir confirmação.
Para quem paga por tokens ou gerencia uma equipe de desenvolvimento com tempo escasso, essa diferença tem impacto financeiro direto. O Claude Code foi 1,5x mais rápido que o Codex e pediu permissão 3x menos vezes — para o mesmo resultado. Isso se traduz em menos interrupção e menos custo de contexto por tarefa entregue.
Veja também: Claude Code vs Cursor vs Copilot: qual ferramenta de IA para programar usar em 2026
Codex: mais lento, mais interrupções
O Codex, da OpenAI, completou o app em cerca de 14 minutos. Durante o processo, fez aproximadamente 10 pedidos de permissão — mais de três vezes o número do Claude Code. O app final ficou no mesmo nível de qualidade.
O padrão de comportamento é diferente: o Codex solicita mais confirmações antes de agir. Para equipes que preferem controle granular sobre cada passo do desenvolvimento, essa característica pode ser uma vantagem.
Antigravity: também chegou lá
O Antigravity, ferramenta de codificação por IA do Google, também concluiu o app dentro do prazo de 30 minutos. O artigo do MakeUseOf não detalha o tempo exato do Antigravity, mas confirma que os três entregaram apps funcionais e instaláveis.
O Antigravity trabalha com subagentes paralelos e tem integração nativa com Firebase e Android — o que pode se traduzir em vantagem em projetos mais complexos dentro do ecossistema Google.
O que o teste não mede
Velocidade em tarefa simples não é o único critério. Em projetos com múltiplos arquivos, regras de negócio específicas e arquitetura elaborada, o comportamento dos agentes muda. O próprio MakeUseOf faz essa série com diferentes tipos de projeto — eletrônica, desenvolvimento web, apps mobile — e os resultados variam por contexto.
Relacionado: Sandbox escape em agentes de IA: Cursor, Codex e Gemini CLI foram atingidos pela mesma falha
Fonte: MakeUseOf — Claude Code vs Codex vs Antigravity: teste completo
Conteúdo reescrito e traduzido para PT pela redação luiscortex, revisado por humano.
Fonte: MakeUseOf





