본문으로 건너뛰기

코딩 에이전트 CLI 비교

중급

당신은 이미 모델을 골랐다. 하지만 그 모델을 감싸는 프로그램 — 파일을 읽고, 계획을 세우고, 명령을 실행하고, 자기 결과물을 점검하고 재시도하는 루프 — 는 별개의 선택이며, 최소한 그만큼 중요하다. 커뮤니티에서는 이 래퍼를 하네스(harness) (또는 에이전트)라고 부르며, 같은 모델이라도 어떤 하네스에서는 탁월해 보이고 다른 하네스에서는 평범해 보인다. 이 페이지는 2026년의 터미널 코딩 에이전트들을 정리하고, 무엇이 실제로 그들을 갈라놓는지, 그리고 전환 비용을 낮게 유지하도록 설정을 이식 가능하게 만드는 법을 다룬다.

What you'll learn
  • 사람들이 혼동하는 두 가지 선택을 분리한다: 모델 vs 그것을 구동하는 하네스
  • 주요 CLI 에이전트 각각의 지속되는 형태를 파악한다 — Claude Code, Codex CLI, Gemini CLI, 그리고 오픈소스 진영
  • 실제로 결정을 좌우하는 축으로 고른다: 자율성, 개방성, 모델 비종속성, 샌드박싱, 생태계
  • AGENTS.md로 설정을 이식 가능하게 만들어, 프로젝트 컨텍스트를 다시 쓰지 않고도 에이전트를 바꿀 수 있게 한다

모델은 에이전트가 아니다

프론티어 모델은 텍스트 예측기다. 코딩 에이전트는 그것을 둘러싼 하네스다: 시스템 프롬프트, 도구 집합(읽기, 편집, 셸 실행, 검색), 계획 루프, 컨텍스트 관리 전략, 권한 및 샌드박스 모델, 그리고 재시도 로직. 하네스를 바꾸면 결과가 바뀐다 — 2026년까지의 실무자 보고에 따르면, 같은 모델이라도 어떤 에이전트가 구동하느냐에 따라 실제 저장소 작업에서 수십 점씩 오르내린다.

여기에는 두 가지 실질적 결과가 따른다:

  • 벤치마크 숫자는 모델 점수가 아니라 조합이다. "Terminal-Bench에서 83%"는 모델 + 하네스 + 스캐폴드 결과다. 어느 부분을 바꾸든 숫자는 움직인다.
  • 당신의 루프가 진짜 비교 단위다. 최고의 에이전트는 당신의 스택에서, 당신의 터미널에서, 감당할 수 있는 가격으로 가장 잘 작동하는 것이다 — 코딩 모델을 고르는 것과 정확히 같은 논리다. 결정의 모델 쪽 절반은 코딩을 위한 Claude vs GPT vs Gemini를 참고하라. 이 페이지는 하네스 쪽 절반이다.

2026년의 지형

터미널 에이전트 영역은 두 진영으로 갈라졌다: 한 연구소의 모델에 맞춰 튜닝된 퍼스트파티 에이전트, 그리고 원하는 어떤 모델(또는 로컬 가중치)이든 겨눌 수 있는 모델 비종속 에이전트.

에이전트주체개방성모델형태
Claude CodeAnthropic클로즈드소스Claude (퍼스트파티)자율적, 에이전트형 멀티파일 작업; OS 강제 샌드박스; 깊은 skills/MCP/서브에이전트 생태계
Codex CLIOpenAI오픈(Apache-2.0, Rust)GPT (퍼스트파티)자율 터미널 에이전트; 네이티브 Windows 샌드박스; 넓은 플랫폼 지원
Gemini CLIGoogle오픈소스Gemini (퍼스트파티)대용량 컨텍스트 에이전트, Google 생태계 연동(아래 최신성 노트 참고)
opencode커뮤니티 (anomalyco)오픈(MIT, TypeScript)임의(모델 비종속)가장 많은 스타를 받은 오픈 에이전트; CLI + 데스크톱; 원하는 모델 사용
Aider커뮤니티오픈(Apache-2.0)로컬 포함 임의Git 네이티브 페어 프로그래머, 완전 자율 오케스트레이터는 아님
Cline / Goose / 기타커뮤니티오픈임의에디터 내장형(Cline) 또는 범용 오픈 에이전트(Goose); 모델 비종속

실제로 결정을 좌우하는 축

잠시 리더보드는 무시하라. 지속되는 질문은 다음과 같다:

Guided walkthrough1 of 5
  1. 퍼스트파티 에이전트(Claude Code, Codex CLI, Gemini CLI)는 자체 모델에 맞춰 튜닝되어 있어 대개 가장 매끄러운 최고 경험을 준다. 모델 비종속 에이전트(opencode, Aider, Cline)는 도구를 바꾸지 않고도 모델을 교체할 수 있게 해준다 — 오늘은 프론티어, 내일은 저렴하거나 로컬로. 종속을 피하거나 로컬 가중치를 돌리는 것이 중요하다면 비종속을 골라라.
Pro tip
  • 헤드라인 벤치마크로 하네스를 사지 마라. 당신 자신의 저장소에서 실제 작업을 상대로 한 30분 시험으로 사라 — 모든 모델 리더보드를 이기는 '당신 자신의 코드로 평가하기'와 똑같은 수다.
  • 개방성은 매일 쓰는 기능이 아니라 헤지다. 그 가치는 가격이 바뀌거나 무료 등급이 사라져서 옮기고 싶은 날에 드러난다.

이식성: 컨텍스트를 한 번만 써라

가장 큰 숨은 전환 비용은 당신의 프로젝트 컨텍스트 — 빌드 명령, 관례, 테스트 규칙, 에이전트가 추론할 수 없는 것들 — 이다. 2026년에는 이에 대한 사실상의 표준이 있다: AGENTS.md, 저장소 루트에 두는 순수 Markdown 파일로, Linux Foundation 산하 Agentic AI Foundation이 관리하며 Codex, Gemini CLI, Cursor, Aider, Copilot의 코딩 에이전트, opencode, Goose 그리고 20개 이상의 다른 도구가 네이티브로 읽는다(6만 개 이상의 저장소가 채택함).

  • AGENTS.md = 도구 간 공용 프로젝트 컨텍스트. 한 번 쓰면 대부분의 에이전트가 읽는다.
  • CLAUDE.md = Claude Code 자체의 프로젝트 메모리 파일(CLAUDE.md 참고). AGENTS.md를 가리키는 작은 CLAUDE.md를 둘 수도 있고, 둘 다 유지할 수도 있다.
  • SKILL.md = 재사용 가능한 skills를 프론트매터와 번들 스크립트로 패키징하기 위한 Anthropic의 별도 스펙. 이는 AGENTS.md와 경쟁 관계가 아니라 보완적이다 — 하나는 프로젝트를 설명하고, 다른 하나는 재사용 가능한 절차를 패키징한다.

컨텍스트를 AGENTS.md에 담아두면, 다른 에이전트를 시도하는 날에 프로젝트 규칙이 공짜로 따라온다.

최소한의 AGENTS.md — 에이전트가 추론할 수 없는 것만 써라

# AGENTS.md

## Setup
- Install: `pnpm install`
- Dev server: `pnpm dev` (port 3000)

## Build & test (run before every commit)
- Typecheck: `pnpm typecheck`
- Lint: `pnpm lint`
- Tests: `pnpm test` — all must pass

## Conventions
- TypeScript strict; no `any`.
- Components in `src/components`, one per file.
- Never edit files under `generated/` by hand.

## Constraints
- Do NOT run `git push` or open PRs without being asked.
- Secrets live in `.env.local`; never commit them.
Watch out
  • 에이전트가 스스로 발견할 수 없는 것만 AGENTS.md에 넣어라. 뻔한 것을 다시 말하면 매 실행마다 토큰을 쓰고 정작 중요한 규칙을 묻어버린다. 손으로 큐레이션하라 — 자동 생성된 컨텍스트 파일은 잡음이 되기 쉽다.

한 호흡으로 내리는 결정

  • 가장 풍부한 도구 생태계와 함께하는 깊고 자율적인 Claude 작업Claude Code.
  • GPT에 묶여 있으면서 강력한 플랫폼/Windows 지원을 갖춘 오픈소스 퍼스트파티 에이전트Codex CLI.
  • 모델을 자유롭게 바꾸거나 로컬 가중치를 돌리고 싶다opencode 또는 Cline.
  • 신중하고, git 네이티브하며, 사람이 루프에 있는 편집Aider.
  • 큰 Google 생태계 컨텍스트 전략Gemini CLI(먼저 현재 접근 방식을 확인하라).

무엇을 고르든, 프로젝트 컨텍스트를 AGENTS.md에 유지하고, 확정하기 전에 당신 자신의 저장소에서 실제 작업으로 그 선택을 입증하라.

Check yourself

0/4
  1. 사람들이 코딩 에이전트의 '하네스(harness)'라고 할 때 무엇을 뜻하는가?
  2. 어떤 블로그가 한 에이전트에 대해 '코딩 벤치마크에서 83%'라고 보고한다. 그 숫자는 실제로 무엇을 측정하는가?
  3. opencode나 Aider 같은 모델 비종속 에이전트를 고르는 이유는?
  4. AGENTS.md는 무엇을 위한 것인가?

플래시카드

코딩 에이전트 CLI 용어
Enter 또는 스페이스 키를 눌러 카드를 뒤집습니다. 좌우 화살표 키로 카드를 이동할 수 있습니다.용어가 표시되었습니다.
1 / 8

출처 및 더 읽을거리