Pular para o conteúdo principal

CLIs de Agentes de Código Comparados

Intermediário

Você já escolheu um modelo. Mas o programa que envolve o modelo — o loop que lê arquivos, planeja, executa comandos, verifica o próprio trabalho e tenta de novo — é uma escolha separada, e importa pelo menos tanto quanto o modelo. O nome que a comunidade dá a esse invólucro é harness (ou agente), e o mesmo modelo pode parecer brilhante em um e medíocre em outro. Esta página mapeia os agentes de código de terminal de 2026, o que realmente os separa e como manter sua configuração portável para que os custos de troca permaneçam baixos.

What you'll learn
  • Separar duas escolhas que as pessoas confundem: o modelo vs o harness que o conduz
  • Conhecer o formato duradouro de cada grande agente CLI — Claude Code, Codex CLI, Gemini CLI e o pacote open-source
  • Escolher pelos eixos que realmente decidem: autonomia, abertura, agnosticismo de modelo, sandboxing e ecossistema
  • Tornar sua configuração portável com AGENTS.md para poder trocar de agente sem reescrever o contexto do seu projeto

O modelo não é o agente

Um modelo de fronteira é um preditor de texto. Um agente de código é o harness em torno dele: o system prompt, o conjunto de ferramentas (ler, editar, executar shell, buscar), o loop de planejamento, a estratégia de gerenciamento de contexto, o modelo de permissão e sandbox, e a lógica de retry. Mude o harness e você muda os resultados — relatos de praticantes ao longo de 2026 descrevem o mesmo modelo oscilando dezenas de pontos em tarefas reais de repositório, dependendo de qual agente o conduz.

Isso tem duas consequências práticas:

  • Um número de benchmark é um par, não a pontuação de um modelo. "83% no Terminal-Bench" é um resultado de modelo + harness + scaffold. Troque qualquer parte e ele muda.
  • Seu loop é a verdadeira unidade de comparação. O melhor agente é aquele que funciona melhor na sua stack, no seu terminal, a um preço com o qual você consegue conviver — exatamente a mesma lógica de escolher um modelo de código. Veja Claude vs GPT vs Gemini para Código para a metade da decisão referente ao modelo; esta página é a metade referente ao harness.

O campo em 2026

O espaço de agentes de terminal se dividiu em dois campos: agentes first-party ajustados aos modelos de um laboratório, e agentes agnósticos de modelo que você aponta para qualquer modelo (ou pesos locais) que quiser.

AgenteQuemAberturaModelosFormato
Claude CodeAnthropicCódigo fechadoClaude (first-party)Trabalho autônomo e agêntico em múltiplos arquivos; sandbox imposta pelo SO; ecossistema profundo de skills/MCP/subagentes
Codex CLIOpenAIAberto (Apache-2.0, Rust)GPT (first-party)Agente de terminal autônomo; sandbox nativa no Windows; ampla cobertura de plataformas
Gemini CLIGoogleOpen-sourceGemini (first-party)Agente de contexto amplo, integrações com o ecossistema Google (veja a nota de atualização abaixo)
opencodeComunidade (anomalyco)Aberto (MIT, TypeScript)Qualquer (agnóstico de modelo)Agente aberto com mais estrelas; CLI + desktop; traga seu próprio modelo
AiderComunidadeAberto (Apache-2.0)Qualquer, incl. localProgramador em par git-native, não um orquestrador autônomo completo
Cline / Goose / outrosComunidadeAbertoQualquerEmbutido no editor (Cline) ou agentes abertos gerais (Goose); agnósticos de modelo

Os eixos que realmente decidem

Ignore o leaderboard por um minuto. Estas são as perguntas duradouras:

Guided walkthrough1 of 5
  1. Agentes first-party (Claude Code, Codex CLI, Gemini CLI) são ajustados para o próprio modelo e geralmente entregam a experiência de pico mais suave. Agentes agnósticos de modelo (opencode, Aider, Cline) permitem trocar de modelo — de fronteira hoje, barato ou local amanhã — sem mudar de ferramenta. Escolha agnóstico se evitar lock-in ou rodar pesos locais importa para você.
Pro tip
  • Não compre um harness por um benchmark de manchete. Compre-o por um teste de 30 minutos contra uma tarefa real no seu próprio repositório — o mesmo movimento de 'avaliar no seu próprio código' que vence qualquer leaderboard de modelos.
  • Abertura é um seguro, não um recurso que você usará diariamente. Seu valor aparece no dia em que um preço muda ou um tier gratuito desaparece e você quer migrar.

Portabilidade: escreva seu contexto uma vez

O maior custo de troca oculto é o contexto do seu projeto — comandos de build, convenções, regras de teste, coisas que o agente não consegue inferir. Em 2026 isso tem um padrão de fato: o AGENTS.md, um arquivo em Markdown puro na raiz do seu repositório, mantido pela Agentic AI Foundation sob a Linux Foundation e lido nativamente por Codex, Gemini CLI, Cursor, Aider, o agente de código do Copilot, opencode, Goose e mais de 20 outras ferramentas (mais de 60 mil repositórios o adotaram).

  • AGENTS.md = contexto de projeto entre ferramentas. Escreva uma vez; a maioria dos agentes o lê.
  • CLAUDE.md = o próprio arquivo de memória de projeto do Claude Code (veja CLAUDE.md). Você pode manter um CLAUDE.md pequeno que aponta para o AGENTS.md, ou manter ambos.
  • SKILL.md = a especificação separada da Anthropic para empacotar skills reutilizáveis com frontmatter e scripts agrupados. É complementar ao AGENTS.md, não um concorrente — um descreve o projeto, o outro empacota um procedimento reutilizável.

Manter o contexto no AGENTS.md significa que, no dia em que você experimentar um agente diferente, as regras do seu projeto vêm junto de graça.

AGENTS.md mínimo — escreva apenas o que um agente não consegue inferir

# AGENTS.md

## Setup
- Install: `pnpm install`
- Dev server: `pnpm dev` (port 3000)

## Build & test (run before every commit)
- Typecheck: `pnpm typecheck`
- Lint: `pnpm lint`
- Tests: `pnpm test` — all must pass

## Conventions
- TypeScript strict; no `any`.
- Components in `src/components`, one per file.
- Never edit files under `generated/` by hand.

## Constraints
- Do NOT run `git push` or open PRs without being asked.
- Secrets live in `.env.local`; never commit them.
Watch out
  • Coloque no AGENTS.md apenas o que o agente não consegue descobrir sozinho. Repetir o óbvio custa tokens a cada execução e enterra as regras que importam. Cure-o à mão — arquivos de contexto gerados automaticamente tendem a ser ruído.

Uma decisão, em um fôlego

  • Trabalho profundo e autônomo com Claude e o ecossistema de ferramentas mais ricoClaude Code.
  • Agente first-party open-source ligado ao GPT, com forte cobertura de plataforma/WindowsCodex CLI.
  • Você quer trocar de modelo livremente ou rodar pesos locaisopencode ou Cline.
  • Edições cuidadosas, git-native, com humano no loopAider.
  • Grande aposta em contexto do ecossistema GoogleGemini CLI (confirme o acesso atual primeiro).

Seja qual for sua escolha, mantenha o contexto do seu projeto no AGENTS.md e comprove a escolha com uma tarefa real no seu próprio repositório antes de se comprometer.

Check yourself

0/4
  1. O que as pessoas querem dizer com o 'harness' de um agente de código?
  2. Um blog relata '83% em um benchmark de código' para um agente. O que esse número realmente mede?
  3. Por que escolher um agente agnóstico de modelo como o opencode ou o Aider?
  4. Para que serve o AGENTS.md?

Flashcards

Vocabulário de CLIs de agentes de código
Pressione Enter ou Espaço para virar o cartão. Use as setas esquerda e direita para navegar entre os cartões.Termo exibido.
1 / 8

Fontes e leitura adicional