CLIs de Agentes de Código Comparados
Você já escolheu um modelo. Mas o programa que envolve o modelo — o loop que lê arquivos, planeja, executa comandos, verifica o próprio trabalho e tenta de novo — é uma escolha separada, e importa pelo menos tanto quanto o modelo. O nome que a comunidade dá a esse invólucro é harness (ou agente), e o mesmo modelo pode parecer brilhante em um e medíocre em outro. Esta página mapeia os agentes de código de terminal de 2026, o que realmente os separa e como manter sua configuração portável para que os custos de troca permaneçam baixos.
- Separar duas escolhas que as pessoas confundem: o modelo vs o harness que o conduz
- Conhecer o formato duradouro de cada grande agente CLI — Claude Code, Codex CLI, Gemini CLI e o pacote open-source
- Escolher pelos eixos que realmente decidem: autonomia, abertura, agnosticismo de modelo, sandboxing e ecossistema
- Tornar sua configuração portável com AGENTS.md para poder trocar de agente sem reescrever o contexto do seu projeto
O modelo não é o agente
Um modelo de fronteira é um preditor de texto. Um agente de código é o harness em torno dele: o system prompt, o conjunto de ferramentas (ler, editar, executar shell, buscar), o loop de planejamento, a estratégia de gerenciamento de contexto, o modelo de permissão e sandbox, e a lógica de retry. Mude o harness e você muda os resultados — relatos de praticantes ao longo de 2026 descrevem o mesmo modelo oscilando dezenas de pontos em tarefas reais de repositório, dependendo de qual agente o conduz.
Isso tem duas consequências práticas:
- Um número de benchmark é um par, não a pontuação de um modelo. "83% no Terminal-Bench" é um resultado de modelo + harness + scaffold. Troque qualquer parte e ele muda.
- Seu loop é a verdadeira unidade de comparação. O melhor agente é aquele que funciona melhor na sua stack, no seu terminal, a um preço com o qual você consegue conviver — exatamente a mesma lógica de escolher um modelo de código. Veja Claude vs GPT vs Gemini para Código para a metade da decisão referente ao modelo; esta página é a metade referente ao harness.
O campo em 2026
O espaço de agentes de terminal se dividiu em dois campos: agentes first-party ajustados aos modelos de um laboratório, e agentes agnósticos de modelo que você aponta para qualquer modelo (ou pesos locais) que quiser.
| Agente | Quem | Abertura | Modelos | Formato |
|---|---|---|---|---|
| Claude Code | Anthropic | Código fechado | Claude (first-party) | Trabalho autônomo e agêntico em múltiplos arquivos; sandbox imposta pelo SO; ecossistema profundo de skills/MCP/subagentes |
| Codex CLI | OpenAI | Aberto (Apache-2.0, Rust) | GPT (first-party) | Agente de terminal autônomo; sandbox nativa no Windows; ampla cobertura de plataformas |
| Gemini CLI | Open-source | Gemini (first-party) | Agente de contexto amplo, integrações com o ecossistema Google (veja a nota de atualização abaixo) | |
| opencode | Comunidade (anomalyco) | Aberto (MIT, TypeScript) | Qualquer (agnóstico de modelo) | Agente aberto com mais estrelas; CLI + desktop; traga seu próprio modelo |
| Aider | Comunidade | Aberto (Apache-2.0) | Qualquer, incl. local | Programador em par git-native, não um orquestrador autônomo completo |
| Cline / Goose / outros | Comunidade | Aberto | Qualquer | Embutido no editor (Cline) ou agentes abertos gerais (Goose); agnósticos de modelo |
Os eixos que realmente decidem
Ignore o leaderboard por um minuto. Estas são as perguntas duradouras:
- Agentes first-party (Claude Code, Codex CLI, Gemini CLI) são ajustados para o próprio modelo e geralmente entregam a experiência de pico mais suave. Agentes agnósticos de modelo (opencode, Aider, Cline) permitem trocar de modelo — de fronteira hoje, barato ou local amanhã — sem mudar de ferramenta. Escolha agnóstico se evitar lock-in ou rodar pesos locais importa para você.
- O Aider é um programador em par: edições focadas, em nível de arquivo, git-native, com você no loop a cada commit. Claude Code e Codex CLI são orquestradores: dê um objetivo, e eles planejam e executam em muitos arquivos e comandos de shell. Mais autonomia significa mais alavancagem e mais necessidade de proteções.
- Um agente que executa comandos de shell pode apagar arquivos, enviar código ou gastar dinheiro. Prefira uma sandbox imposta pelo SO e um modelo de permissão explícito em vez de 'confie em mim'. Claude Code e Codex CLI ambos oferecem sandboxing em 2026; verifique o que qualquer agente pode tocar antes de deixá-lo rodar sem supervisão.
- Além do loop central: servidores MCP para ferramentas, skills reutilizáveis, subagentes, hooks, integração com IDE, ações de CI. Um agente mais enxuto sobre um modelo ótimo pode perder para um agente mais robusto sobre um modelo suficientemente bom, porque o ecossistema faz mais do trabalho.
- Assinatura vs medição por API, janela de contexto, caching e quão verboso é o harness — tudo isso move a conta real. Um modelo mais barato em um harness faminto por tokens pode custar mais do que um modelo mais caro em um harness enxuto.
- Não compre um harness por um benchmark de manchete. Compre-o por um teste de 30 minutos contra uma tarefa real no seu próprio repositório — o mesmo movimento de 'avaliar no seu próprio código' que vence qualquer leaderboard de modelos.
- Abertura é um seguro, não um recurso que você usará diariamente. Seu valor aparece no dia em que um preço muda ou um tier gratuito desaparece e você quer migrar.
Portabilidade: escreva seu contexto uma vez
O maior custo de troca oculto é o contexto do seu projeto — comandos de build, convenções, regras de teste, coisas que o agente não consegue inferir. Em 2026 isso tem um padrão de fato: o AGENTS.md, um arquivo em Markdown puro na raiz do seu repositório, mantido pela Agentic AI Foundation sob a Linux Foundation e lido nativamente por Codex, Gemini CLI, Cursor, Aider, o agente de código do Copilot, opencode, Goose e mais de 20 outras ferramentas (mais de 60 mil repositórios o adotaram).
AGENTS.md= contexto de projeto entre ferramentas. Escreva uma vez; a maioria dos agentes o lê.CLAUDE.md= o próprio arquivo de memória de projeto do Claude Code (veja CLAUDE.md). Você pode manter umCLAUDE.mdpequeno que aponta para oAGENTS.md, ou manter ambos.SKILL.md= a especificação separada da Anthropic para empacotar skills reutilizáveis com frontmatter e scripts agrupados. É complementar aoAGENTS.md, não um concorrente — um descreve o projeto, o outro empacota um procedimento reutilizável.
Manter o contexto no AGENTS.md significa que, no dia em que você experimentar um agente diferente, as regras do seu projeto vêm junto de graça.
AGENTS.md mínimo — escreva apenas o que um agente não consegue inferir
# AGENTS.md ## Setup - Install: `pnpm install` - Dev server: `pnpm dev` (port 3000) ## Build & test (run before every commit) - Typecheck: `pnpm typecheck` - Lint: `pnpm lint` - Tests: `pnpm test` — all must pass ## Conventions - TypeScript strict; no `any`. - Components in `src/components`, one per file. - Never edit files under `generated/` by hand. ## Constraints - Do NOT run `git push` or open PRs without being asked. - Secrets live in `.env.local`; never commit them.
- Coloque no AGENTS.md apenas o que o agente não consegue descobrir sozinho. Repetir o óbvio custa tokens a cada execução e enterra as regras que importam. Cure-o à mão — arquivos de contexto gerados automaticamente tendem a ser ruído.
Uma decisão, em um fôlego
- Trabalho profundo e autônomo com Claude e o ecossistema de ferramentas mais rico → Claude Code.
- Agente first-party open-source ligado ao GPT, com forte cobertura de plataforma/Windows → Codex CLI.
- Você quer trocar de modelo livremente ou rodar pesos locais → opencode ou Cline.
- Edições cuidadosas, git-native, com humano no loop → Aider.
- Grande aposta em contexto do ecossistema Google → Gemini CLI (confirme o acesso atual primeiro).
Seja qual for sua escolha, mantenha o contexto do seu projeto no AGENTS.md e comprove a escolha com uma tarefa real no seu próprio repositório antes de se comprometer.
Check yourself
0/4Flashcards
Fontes e leitura adicional
- AGENTS.md — site oficial e especificação (Agentic AI Foundation / Linux Foundation)
- openai/codex — repositório do Codex CLI (Apache-2.0, Rust)
- sst/opencode — repositório do opencode (MIT, TypeScript)
- Aider-AI/aider — repositório do Aider (Apache-2.0)
- google-gemini/gemini-cli — repositório do Gemini CLI
- Anthropic — documentação do Claude Code
- Relacionado neste site: Claude vs GPT vs Gemini para Código · Agentes de código locais · CLAUDE.md · Skills