코딩 에이전트 CLI 비교
당신은 이미 모델을 골랐다. 하지만 그 모델을 감싸는 프로그램 — 파일을 읽고, 계획을 세우고, 명령을 실행하고, 자기 결과물을 점검하고 재시도하는 루프 — 는 별개의 선택이며, 최소한 그만큼 중요하다. 커뮤니티에서는 이 래퍼를 하네스(harness) (또는 에이전트)라고 부르며, 같은 모델이라도 어떤 하네스에서는 탁월해 보이고 다른 하네스에서는 평범해 보인다. 이 페이지는 2026년의 터미널 코딩 에이전트들을 정리하고, 무엇이 실제로 그들을 갈라놓는지, 그리고 전환 비용을 낮게 유지하도록 설정을 이식 가능하게 만드는 법을 다룬다.
- 사람들이 혼동하는 두 가지 선택을 분리한다: 모델 vs 그것을 구동하는 하네스
- 주요 CLI 에이전트 각각의 지속되는 형태를 파악한다 — Claude Code, Codex CLI, Gemini CLI, 그리고 오픈소스 진영
- 실제로 결정을 좌우하는 축으로 고른다: 자율성, 개방성, 모델 비종속성, 샌드박싱, 생태계
- AGENTS.md로 설정을 이식 가능하게 만들어, 프로젝트 컨텍스트를 다시 쓰지 않고도 에이전트를 바꿀 수 있게 한다
모델은 에이전트가 아니다
프론티어 모델은 텍스트 예측기다. 코딩 에이전트는 그것을 둘러싼 하네스다: 시스템 프롬프트, 도구 집합(읽기, 편집, 셸 실행, 검색), 계획 루프, 컨텍스트 관리 전략, 권한 및 샌드박스 모델, 그리고 재시도 로직. 하네스를 바꾸면 결과가 바뀐다 — 2026년까지의 실무자 보고에 따르면, 같은 모델이라도 어떤 에이전트가 구동하느냐에 따라 실제 저장소 작업에서 수십 점씩 오르내린다.
여기에는 두 가지 실질적 결과가 따른다:
- 벤치마크 숫자는 모델 점수가 아니라 조합이다. "Terminal-Bench에서 83%"는 모델 + 하네스 + 스캐폴드 결과다. 어느 부분을 바꾸든 숫자는 움직인다.
- 당신의 루프가 진짜 비교 단위다. 최고의 에이전트는 당신의 스택에서, 당신의 터미널에서, 감당할 수 있는 가격으로 가장 잘 작동하는 것이다 — 코딩 모델을 고르는 것과 정확히 같은 논리다. 결정의 모델 쪽 절반은 코딩을 위한 Claude vs GPT vs Gemini를 참고하라. 이 페이지는 하네스 쪽 절반이다.
2026년의 지형
터미널 에이전트 영역은 두 진영으로 갈라졌다: 한 연구소의 모델에 맞춰 튜닝된 퍼스트파티 에이전트, 그리고 원하는 어떤 모델(또는 로컬 가중치)이든 겨눌 수 있는 모델 비종속 에이전트.
| 에이전트 | 주체 | 개방성 | 모델 | 형태 |
|---|---|---|---|---|
| Claude Code | Anthropic | 클로즈드소스 | Claude (퍼스트파티) | 자율적, 에이전트형 멀티파일 작업; OS 강제 샌드박스; 깊은 skills/MCP/서브에이전트 생태계 |
| Codex CLI | OpenAI | 오픈(Apache-2.0, Rust) | GPT (퍼스트파티) | 자율 터미널 에이전트; 네이티브 Windows 샌드박스; 넓은 플랫폼 지원 |
| Gemini CLI | 오픈소스 | Gemini (퍼스트파티) | 대용량 컨텍스트 에이전트, Google 생태계 연동(아래 최신성 노트 참고) | |
| opencode | 커뮤니티 (anomalyco) | 오픈(MIT, TypeScript) | 임의(모델 비종속) | 가장 많은 스타를 받은 오픈 에이전트; CLI + 데스크톱; 원하는 모델 사용 |
| Aider | 커뮤니티 | 오픈(Apache-2.0) | 로컬 포함 임의 | Git 네이티브 페어 프로그래머, 완전 자율 오케스트레이터는 아님 |
| Cline / Goose / 기타 | 커뮤니티 | 오픈 | 임의 | 에디터 내장형(Cline) 또는 범용 오픈 에이전트(Goose); 모델 비종속 |
실제로 결정을 좌우하는 축
잠시 리더보드는 무시하라. 지속되는 질문은 다음과 같다:
- 퍼스트파티 에이전트(Claude Code, Codex CLI, Gemini CLI)는 자체 모델에 맞춰 튜닝되어 있어 대개 가장 매끄러운 최고 경험을 준다. 모델 비종속 에이전트(opencode, Aider, Cline)는 도구를 바꾸지 않고도 모델을 교체할 수 있게 해준다 — 오늘은 프론티어, 내일은 저렴하거나 로컬로. 종속을 피하거나 로컬 가중치를 돌리는 것이 중요하다면 비종속을 골라라.
- Aider는 페어 프로그래머다: 집중적이고, 파일 단위이며, git 네이티브 편집으로 매 커밋마다 당신이 루프 안에 있다. Claude Code와 Codex CLI는 오케스트레이터다: 목표를 주면 여러 파일과 셸 명령에 걸쳐 계획하고 실행한다. 자율성이 클수록 레버리지도 크지만 가드레일도 더 필요하다.
- 셸 명령을 실행하는 에이전트는 파일을 삭제하거나, 코드를 푸시하거나, 돈을 쓸 수 있다. '믿어달라'보다 OS 강제 샌드박스와 명시적 권한 모델을 선호하라. Claude Code와 Codex CLI는 둘 다 2026년에 샌드박싱을 제공한다; 무인으로 돌리기 전에 어떤 에이전트든 무엇을 건드릴 수 있는지 확인하라.
- 핵심 루프를 넘어서: 도구를 위한 MCP 서버, 재사용 가능한 skills, 서브에이전트, 훅, IDE 통합, CI 액션. 훌륭한 모델 위의 얇은 에이전트가, 충분히 좋은 모델 위의 두꺼운 에이전트에 질 수 있다 — 생태계가 더 많은 일을 대신 해주기 때문이다.
- 구독 vs API 계량 과금, 컨텍스트 창, 캐싱, 그리고 하네스가 얼마나 수다스러운지가 모두 실제 청구서를 움직인다. 토큰을 많이 먹는 하네스 위의 저렴한 모델이, 군더더기 없는 하네스 위의 비싼 모델보다 더 비쌀 수 있다.
- 헤드라인 벤치마크로 하네스를 사지 마라. 당신 자신의 저장소에서 실제 작업을 상대로 한 30분 시험으로 사라 — 모든 모델 리더보드를 이기는 '당신 자신의 코드로 평가하기'와 똑같은 수다.
- 개방성은 매일 쓰는 기능이 아니라 헤지다. 그 가치는 가격이 바뀌거나 무료 등급이 사라져서 옮기고 싶은 날에 드러난다.
이식성: 컨텍스트를 한 번만 써라
가장 큰 숨은 전환 비용은 당신의 프로젝트 컨텍스트 — 빌드 명령, 관례, 테스트 규칙, 에이전트가 추론할 수 없는 것들 — 이다. 2026년에는 이에 대한 사실상의 표준이 있다: AGENTS.md, 저장소 루트에 두는 순수 Markdown 파일로, Linux Foundation 산하 Agentic AI Foundation이 관리하며 Codex, Gemini CLI, Cursor, Aider, Copilot의 코딩 에이전트, opencode, Goose 그리고 20개 이상의 다른 도구가 네이티브로 읽는다(6만 개 이상의 저장소가 채택함).
AGENTS.md= 도구 간 공용 프로젝트 컨텍스트. 한 번 쓰면 대부분의 에이전트가 읽는다.CLAUDE.md= Claude Code 자체의 프로젝트 메모리 파일(CLAUDE.md 참고).AGENTS.md를 가리키는 작은CLAUDE.md를 둘 수도 있고, 둘 다 유지할 수도 있다.SKILL.md= 재사용 가능한 skills를 프론트매터와 번들 스크립트로 패키징하기 위한 Anthropic의 별도 스펙. 이는AGENTS.md와 경쟁 관계가 아니라 보완적이다 — 하나는 프로젝트를 설명하고, 다른 하나는 재사용 가능한 절차를 패키징한다.
컨텍스트를 AGENTS.md에 담아두면, 다른 에이전트를 시도하는 날에 프로젝트 규칙이 공짜로 따라온다.
최소한의 AGENTS.md — 에이전트가 추론할 수 없는 것만 써라
# AGENTS.md ## Setup - Install: `pnpm install` - Dev server: `pnpm dev` (port 3000) ## Build & test (run before every commit) - Typecheck: `pnpm typecheck` - Lint: `pnpm lint` - Tests: `pnpm test` — all must pass ## Conventions - TypeScript strict; no `any`. - Components in `src/components`, one per file. - Never edit files under `generated/` by hand. ## Constraints - Do NOT run `git push` or open PRs without being asked. - Secrets live in `.env.local`; never commit them.
- 에이전트가 스스로 발견할 수 없는 것만 AGENTS.md에 넣어라. 뻔한 것을 다시 말하면 매 실행마다 토큰을 쓰고 정작 중요한 규칙을 묻어버린다. 손으로 큐레이션하라 — 자동 생성된 컨텍스트 파일은 잡음이 되기 쉽다.
한 호흡으로 내리는 결정
- 가장 풍부한 도구 생태계와 함께하는 깊고 자율적인 Claude 작업 → Claude Code.
- GPT에 묶여 있으면서 강력한 플랫폼/Windows 지원을 갖춘 오픈소스 퍼스트파티 에이전트 → Codex CLI.
- 모델을 자유롭게 바꾸거나 로컬 가중치를 돌리고 싶다 → opencode 또는 Cline.
- 신중하고, git 네이티브하며, 사람이 루프에 있는 편집 → Aider.
- 큰 Google 생태계 컨텍스트 전략 → Gemini CLI(먼저 현재 접근 방식을 확인하라).
무엇을 고르든, 프로젝트 컨텍스트를 AGENTS.md에 유지하고, 확정하기 전에 당신 자신의 저장소에서 실제 작업으로 그 선택을 입증하라.
Check yourself
0/4플래시카드
출처 및 더 읽을거리
- AGENTS.md — 공식 사이트 & 스펙 (Agentic AI Foundation / Linux Foundation)
- openai/codex — Codex CLI 저장소 (Apache-2.0, Rust)
- sst/opencode — opencode 저장소 (MIT, TypeScript)
- Aider-AI/aider — Aider 저장소 (Apache-2.0)
- google-gemini/gemini-cli — Gemini CLI 저장소
- Anthropic — Claude Code 문서
- 이 사이트의 관련 글: 코딩을 위한 Claude vs GPT vs Gemini · 로컬 코딩 에이전트 · CLAUDE.md · Skills