본문으로 건너뛰기

Claude Fable 5 & Mythos 5: 플래그십 필드 가이드

중급

2026년 6월 9일 Anthropic은 Claude Fable 5 — "Mythos-급" 플래그십으로 능력 면에서 Opus 위에 앉음 — 를 제한 릴리스 형제 Claude Mythos 5와 함께 배포했습니다. 런칭 포스트만 훑어보면 "큰 모델, 더 높은 가격"이라는 인상만 남습니다. 그것이 스토리를 놓칩니다. Fable 5는 그 통합 표면이 이전의 모든 Claude와 실질적으로 다른 최초의 Anthropic 모델입니다: 성공적인 HTTP 200 with stop_reason: "refusal"인-밴드 거부하고, 원시 사고 체인이 결코 반환되지 않으며, Opus 4.8 재시도용으로 특별히 만들어진 fallback credit이라는 완전히 새로운 청구 원시 기능이 있습니다. 앱이 최상위 모델을 고정한다면, 이전의 모든 Sonnet을 드롭인했던 방식으로 Fable 5를 드롭인하지 않습니다. 그것을 위해 재배선합니다.

이 페이지는 실용적 필드 가이드입니다: Fable 5가 실제로 무엇이고, Opus 4.8보다 무엇을 더 잘하고, 코드가 바뀌어야 하는 정확한 네 곳, Opus 4.8 vs Sonnet 5 대비 언제 옳은 선택인지, 그리고 런칭에서 "다일간 자율 실행" 이야기를 잠금 해제하는 프롬프팅 전환.

What you'll learn
  • Fable 5가 모델 수준에서 무엇인지 이해 — 1M 컨텍스트, 적응형 thinking만, Mythos-급 포지셔닝
  • Opus 4.8에서 순진한 드롭인 마이그레이션을 깨뜨리는 네 API 변경 마스터
  • 응답에서 거부를 인식(HTTP 200이지 에러가 아님) 및 서버 측 또는 클라이언트 측 fallback 설정
  • Fable 5 vs Opus 4.8 vs Sonnet 5를 언제 고를지 알기, 새벽 3시에도 추론할 수 있는 결정 표와 함께
  • 프롬프팅 조정: 간결성, 경계, 메모리 스캐폴드, 그리고 왜 send-to-user 도구가 긴 자율 실행에 중요한지

한 단락 버전

Fable 5는 Mythos-급 플래그십입니다: Anthropic이 Opus 에 포지셔닝하는 티어. claude-fable-5는 API와 모든 주요 클라우드에서 일반적으로 사용 가능; claude-mythos-5는 안전 분류기 없이 정확히 같은 모델로, Project Glasswing 안의 승인된 파트너에게만 제공됩니다. 가격($10 in / $50 out per MTok), 컨텍스트(1M 토큰), 출력 상한(128K), 지식 컷오프를 공유합니다. Fable 5의 분류기가 요청을 거부하면 stop_reason: "refusal"과 함께 성공적 HTTP 200을 되돌려받고, Opus 4.8에 fallback 경로를 설정했을 것으로 예상됩니다. 그것이 릴리스의 형태 전체입니다.

왜 "Opus 4.8 + 더 많이"가 아닌지

Anthropic은 Fable 5를 그렇지 않으면 사람이 시간, 일, 또는 주가 걸릴 문제를 가리키는 모델로 프레이밍합니다. 그들 자신의 말로, 더 단순한 워크로드에서만 테스트하는 것은 능력 범위를 과소평가합니다. Opus 4.8 대비 구체적 델타:

  • 장기 자율성. 강한 지시 유지가 있는 다일간, 목표 지향 실행. Fable 5는 이전 모델이 표류했던 장기간에 걸쳐 생산적 출력을 지속합니다.
  • 어렵고 잘 명세된 문제에서 첫-샷 정확성. 초기 테스터는 이전에 며칠의 반복이 필요했던 시스템의 단일 패스 구현을 보고했습니다.
  • 비전. 밀집한 기술 이미지, 웹 앱, 상세한 스크린샷에서 실질적으로 더 높은 정확도 — 종종 더 적은 출력 토큰을 사용.
  • 코드 리뷰와 디버깅. 버그 찾기 재현율이 눈에 띄게 더 높음(분류기가 커버하는 사이버 보안 영역 외).
  • 위임. 병렬 서브에이전트를 급파하고 지속하는 데 훨씬 더 신뢰할 만하고, 장시간 실행 피어 에이전트와 통신에 더 나음.
  • 모호성. 복잡하고 다중 스레드된 요청을 받고 단계별 사양 없이 다음에 무엇을 할지 결정하는 데 더 나음.

여러분이 하는 트레이드는 비용(Sonnet 5 출력 가격의 5배), 지연(개별 요청이 더 높은 effort 설정에서 여러 실행될 수 있음), 다른 통합 계약입니다. 그 계약이 대부분의 마이그레이션 작업이 사는 곳입니다.

드롭인 마이그레이션을 깨뜨리는 네 API 변경

Opus 4.8을 고정하고 있었고 문자열을 claude-fable-5로 바꾸면 네 가지가 다르게 동작합니다. 이 중 어느 것이든 놓치면 앱이 크래시하거나, 조용히 출력을 잃거나, 거부를 우아하게 처리하지 못합니다.

Guided walkthrough1 of 4
  1. Fable 5의 분류기가 요청을 거부하면 HTTP 에러를 받지 않습니다 — content: []와 stop_reason: "refusal"을 가진 일반 메시지 응답을 받습니다. stop_details는 어떤 카테고리가 트리거되었는지 알려줍니다(cyber, bio, frontier_llm, 또는 reasoning_extraction). 출력 전 도착하는 거부에 대해서는 청구되지 않습니다; 입력 토큰이 usage에 나타나지만 청구되지 않고, 요청은 rate limit에 카운트되지 않습니다. stop_reason에 직접 분기 — 절대 stop_details나 content에 분기하지 마세요.

거부 인식

거부는 예외가 아니라 성공적 메시지입니다. 이것이 여러분이 분기하는 정확한 응답 모양입니다:

{
"id": "msg_01XFUDYJgAACzvnptvVoYEL",
"type": "message",
"role": "assistant",
"model": "claude-fable-5",
"content": [],
"stop_reason": "refusal",
"stop_details": {
"type": "refusal",
"category": "cyber",
"explanation": "This request was declined because it could enable cyber harm."
},
"usage": { "input_tokens": 412, "output_tokens": 0 }
}

stop_details.explanation은 사람이 읽을 수 있지만 안정적이지 않음 — 표시하되 파싱하지 마세요. stop_details 자체는 "refusal" 외의 모든 stop reason에 대해 null입니다. 문서화된 네 카테고리:

category의미
"cyber"사이버 해악(악성코드, 익스플로잇)을 가능하게 할 수 있음. 양성 사이버 보안 작업도 트리거 가능.
"bio"생물학적 해악을 가능하게 할 수 있음. 유익한 생명과학 작업도 트리거 가능.
"frontier_llm"경쟁 AI 모델 개발을 지원할 수 있음(Anthropic 상업 조건 하에 제한됨). 양성 ML 작업도 트리거 가능.
"reasoning_extraction"모델에게 내부 추론을 응답 텍스트로 재현하도록 요청. 대신 적응형 thinking 출력을 사용.
Watch out
  • 거부는 HTTP 200입니다. 5xx 카운트로 지은 모니터링은 절대 그것을 보지 못합니다 — 거부당 전용 이벤트를 방출하고 거부와 fallback-서빙 응답 사이의 갭에 경보.
  • 중간 스트림 거부는 여러분에게 청구합니다: 입력 토큰과 이미 스트림된 어떤 부분 출력이든, 정상 요율로. 출력 전 거부만 무료.
  • 같은 모델에서 재시도는 보통 또 다른 거부를 얻습니다. 재시도를 fallback 모델에 가리키세요(Opus 4.8이 Anthropic이 제안한 쌍).

Fallback 설정 — 하나의 경로 선택

서버 측 (가장 단순, 한 번의 왕복)

Server-side fallback with the Messages API

curl --fail-with-body -sS https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "anthropic-beta: server-side-fallback-2026-06-01" \
-H "content-type: application/json" \
-d '{
  "model": "claude-fable-5",
  "max_tokens": 1024,
  "fallbacks": [{"model": "claude-opus-4-8"}],
  "messages": [{"role": "user", "content": "Hello, Claude"}]
}'

엔트리는 순서대로 시도되며, 서로 달라야 하고, 각각 요청 모델의 허용된 allowed_fallback_models(베타 헤더가 설정될 때 Models API에 게시됨) 중 하나여야 하며, 요청 모델 자체여서는 안 됩니다. 각 엔트리는 그 시도에만 max_tokensthinking을 재정의할 수 있습니다.

응답은 각 모델 경계를 표시하는 fallback 컨텐츠 블록 — {"type": "fallback", "from": {"model": ...}, "to": {"model": ...}} — 과 모든 시도를 기록하는 usage.iterations 배열을 나릅니다. 거부한 모델은 일반 message 반복으로 나타나고; 응답한 모델은 fallback_message 반복으로 나타납니다.

Claude API와 Claude Platform on AWS에서 사용 가능. Amazon Bedrock, Google Cloud, Microsoft Foundry, Message Batches API에서 사용 불가 — 그곳에서는 SDK 미들웨어를 사용하세요.

클라이언트 측 (모든 곳에서 작동, 하나의 설정)

모든 Anthropic SDK는 BetaRefusalFallbackMiddleware(Python/TypeScript/Go/Java/PHP/Ruby/C#)를 배포합니다. 클라이언트에 한 번 구성하고, 대화 전반에 BetaFallbackState를 공유하여 후속 턴이 수락한 모델에 고정되게 유지:

from anthropic import Anthropic, BetaFallbackState, BetaRefusalFallbackMiddleware

client = Anthropic(
middleware=[BetaRefusalFallbackMiddleware([{"model": "claude-opus-4-8"}])],
)
state = BetaFallbackState() # share across the conversation

with state:
message = client.beta.messages.create(
model="claude-fable-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Hello, Claude"}],
)
print(f"served by: {message.model}")

미들웨어는 모든 요청을 fallback-credit-2026-06-01에도 옵트인하므로, 재시도의 프롬프트 캐시 비용이 자동으로 환불됩니다.

수동 재시도 (원시 HTTP, 커스텀 로직)

stop_reason == "refusal"을 감지하고, 변경되지 않은 본문을 fallback으로 model을 설정하여 재전송(fallback credit을 원한다면 되사기는 정확한 매치를 요구), 그리고 — 다중 턴 대화에 대해 — 이후 턴에 대해 되돌아가지 말고 fallback 모델을 계속 사용.

Fallback 배선 시 흔한 함정

  • 세션이 아니라 요청당 재시도 예산. 한 턴이 여러 거부를 생성할 수 있습니다(에이전트 + 서브에이전트가 각각 API 호출).
  • 서브에이전트 호출에 자체 fallbacks를 부여. 파라미터는 도구 실행 내부에서 이루어진 모델 호출로 전파되지 않습니다.
  • 모든 요청 경로에 fallback 구성 — 재시도 핸들러, 에러 복구, 백그라운드 워커. fallback 없이 요청을 재발행하는 핸들러는 정확히 fallback이 가장 필요한 요청에서 보호를 잃습니다.
  • fallback을 요청의 속성으로 만들고, 주변 상태로 만들지 마세요. 공유 플래그나 캐시된 설정은 동기화를 벗어나고 조용히 요청을 보호되지 않은 채 남길 수 있습니다.
  • 거부당 그리고 fallback-서빙 응답당 신호 방출. 둘 사이의 갭에 경보: 상승하는 갭은 fallback도 거부되고 있음을 의미합니다.
  • 베타 헤더를 server-side-fallback-2026-06-01 외의 어떤 것으로도 부르지 마세요. 다른 날짜는 400 에러를 반환합니다.

Fable 5 vs Opus 4.8 vs Sonnet 5 언제 고를지

옳은 모델은 여러분이 무엇을 중시하는지에 달려 있습니다: 원시 능력, 토큰당 비용, 또는 상황이 어긋날 때 API가 어떻게 동작하는지.

필요한 것…손을 뻗을 대상이유
가장 어려운 문제 — 다일 자율 실행, 모호한 사양의 첫-샷, 밀집 비전 작업Claude Fable 5Mythos-급 능력; 장기 작업 지속; 방대한 컨텍스트 전반의 더 나은 지시 유지.
zero-data-retention이 있거나 거부 계약이 없는 최상위 추론Claude Opus 4.8ZDR 적격; 고전 API 표면(에러는 에러); Fable 5의 자연스러운 fallback 타깃.
워크호스: 균형 잡힌 품질, 1M 컨텍스트, 어디서든 실행할 만큼 저렴Claude Sonnet 5Claude Code의 기본; 종종 비용의 일부에 Opus 품질에 근접. 마이그레이션 함정은 Sonnet 5 field guide 참조.
Fable의 분류기가 설계상 차단하는 사이버 보안이나 생명 과학 작업Opus 4.8Fable 5는 명시적으로 공격 사이버나 bio/lab 작업을 의도하지 않음 — 모델을 설정하고 분류기와 싸우지 마세요.
검색, 분류, 빡빡한 지연 예산의 저렴한 서브에이전트Haiku 4.5가장 빠르고 저렴한 티어; 에이전트 트리의 잎으로 사용.
Pro tip
  • Fable 5는 Sonnet 5의 출력 가격의 5배입니다. Sonnet 5가 깨끗하게 처리하는 워크로드에서 Sonnet에 머무는 것은 타협이 아니라 옳은 답입니다.
  • 통합이 최상위 티어에서 zero data retention을 사용할 수 없다면 Opus 4.8을 프라이머리로 유지. Fable 5는 필수 30일 보존을 가집니다.
  • Anthropic은 Fable 5를 테스트할 때 여러분 난이도 범위의 상단에서 시작하기를 명시적으로 권장. 기존 회귀 스위트만 그것에 대해 실행하면 잠금 해제하는 것을 놓칩니다.

여러분이 실제로 느끼는 프롬프팅 전환

Fable 5의 지시 따르기는 긴, 항목화된 스타일 가이드를 떨어뜨리고 행동당 한 문장을 쓸 수 있을 만큼 강합니다. Anthropic 자체 가이드의 세 프롬프트 조각은 그대로 훔칠 가치가 있습니다:

Keep Fable 5 from overplanning on ambiguous tasks

When you have enough information to act, act. Do not re-derive facts already established in the conversation, re-litigate a decision the user has already made, or narrate options you will not pursue in user-facing messages. If you are weighing a choice, give a recommendation, not an exhaustive survey. This does not apply to thinking blocks.

Ground progress claims during long autonomous runs

Before reporting progress, audit each claim against a tool result from this session. Only report work you can point to evidence for; if something is not yet verified, say so explicitly. Report outcomes faithfully: if tests fail, say so with the output; if a step was skipped, say that; when something is done and verified, state it plainly without hedging.

Autonomous-pipeline reminder — kill 'shall I…?' checkpoints

You are operating autonomously. The user is not watching in real time and cannot answer questions mid-task, so asking "Want me to…?" or "Shall I…?" will block the work. For reversible actions that follow from the original request, proceed without asking. Before ending your turn, check your last paragraph. If it is a plan, an analysis, a question, a list of next steps, or a promise about work you have not done ("I'll…", "let me know when…"), do that work now with tool calls. End your turn only when the task is complete or you are blocked on input only the user can provide.

두 개의 더 작지만 중요한 전환:

  • Effort가 주 레버. 기본으로 high 사용; 가장 어려운 능력 민감 작업에는 xhigh; 품질을 속도와 트레이드하려면 medium / low로 내림. Fable 5의 더 낮은 effort도 이전 모델의 xhigh 성능을 종종 능가합니다 — 작업이 일상적이면 지연을 테이블에 남기지 마세요.
  • 사전 존재하는 skill과 프롬프트 리팩터. Opus 4.8용으로 튜닝된 skill은 종종 Fable 5에 너무 지시적이고 출력을 저하시킬 수 있습니다. Anthropic은 명시적으로 오래된 지시를 리뷰하고 종종 제거한 다음 Fable 5 자체 기본이 작업을 하게 두기를 권장합니다. "show your reasoning" 언어에 대해 감사 — reasoning_extraction 거부 카테고리를 트리거하고 fallback을 높일 수 있습니다.

명명할 가치가 있는 드문 실패 모드

두 동작이 긴 세션에서 나타나 처음 통합자를 당황시킵니다:

  • 텍스트 전용 의도 진술. 긴 실행 깊숙이 Fable 5는 가끔 도구 호출을 발행하지 않고 "이제 X를 실행하겠습니다"로 턴을 끝내거나, 이미 충분한 컨텍스트를 가진 때 허가를 요청할 수 있습니다. 수정은 단순한 "진행하세요" 답장이거나 위의 autonomous-pipeline 시스템 리마인더를 추가.
  • 컨텍스트 예산 불안. 매우 긴 세션에서 Fable 5는 새 세션을 시작하거나 자체 작업을 다듬으라고 제안할 수 있습니다. 이것은 하니스가 남은 토큰 카운트다운을 모델에 노출할 때 가장 자주 트리거됩니다. 가능하다면 보여주지 마세요; 반드시 해야 한다면 You have ample context remaining. Do not stop, summarize, or suggest a new session on account of context limits. Continue the work.를 추가.

비동기 에이전트를 위한 send-to-user 도구

UX가 작업 도중 컨텐츠를 문자 그대로 전달하는 데 의존하는 장시간 실행 에이전트를 위해 클라이언트 측 send_to_user 도구를 정의하세요. 도구 입력은 결코 요약되지 않으므로 그것을 통해 라우팅한 어떤 것이든 온전하게 사용자에게 도달합니다. 도구 호출의 입력을 여러분 UI에 직접 렌더링하고 단순 확인을 반환하는 것이 모델에 턴을 끝내지 않는 부분 결과물의 채널을 부여합니다.

{
"name": "send_to_user",
"description": "Display a message directly to the user. Use this for progress updates, partial results, or content the user must see exactly as written before the task finishes.",
"input_schema": {
"type": "object",
"properties": {
"message": {"type": "string", "description": "The content to display to the user."}
},
"required": ["message"]
}
}

도구를 한 줄 시스템 프롬프트 큐와 짝지으세요: "Between tool calls, when you have content the user must read verbatim (a partial deliverable, a direct answer to their question), call the send_to_user tool with that content." 큐 없이는 Fable 5가 그것을 거의 호출하지 않습니다.

데이터 보존 함정

Fable 5와 Mythos 5 모두 Covered Models로 지정되며 30일 데이터 보존을 갖고 zero data retention 하에 사용 불가입니다. 통합에 ZDR 요구 사항이 있다면(규제 산업, 계약 의무, 엔터프라이즈 고객) Fable 5는 드롭인이 아닙니다 — Opus 4.8을 최상위 티어로 고정하고 프로덕션 트래픽을 라우팅하기 전에 official model-specific data retention page를 확인하세요.

Mythos 5 — 여러분이 아마 쓸 수 없는 형제

claude-mythos-5는 안전 분류기 없는 Fable 5와 같은 모델입니다. 정부와 엔터프라이즈 사이버 파트너와의 공동 프로그램 Project Glasswing 안의 승인된 고객과 선택된 생물학 연구자에게만 배포됩니다. 자체 서브 접근이 아닙니다; 있다면 Anthropic, AWS 또는 Google Cloud 계정 팀이 등록한 것입니다. 트레이드오프는 실제입니다: 거부 없음은 내장된 사이버/bio 분류기도 잃는다는 뜻이므로, 하류 안전 책임이 완전히 호출 애플리케이션으로 이동합니다. Anthropic은 Mythos 5 접근이 없는 고객이 분류기가 거부하는 프런티어-사이버와 프런티어-bio 작업을 뺀 같은 능력을 위해 Fable 5를 사용할 수 있음을 명시적으로 언급합니다.

빠른 점검 — 개념이 붙었나?

Check yourself

0/4
  1. 앱이 Fable 5를 호출하고 content: []와 stop_reason: "refusal"이 있는 메시지를 되돌려받습니다. 어떤 HTTP 상태를 받았나요?
  2. Opus 4.8 코드 경로의 확장 thinking 예산을 Fable 5로 마이그레이션할 때 계속 쓰고 싶습니다. 어떻게 하나요?
  3. Fable 5가 여러분에게 반환하지 않을 것은?
  4. 단일 요청이 fallbacks: [{"model": "claude-opus-4-8"}] 설정을 갖고 있습니다. Fable 5가 출력 전에 거부합니다. 무엇이 청구되나요?

용어 치트 시트

Enter 또는 스페이스 키를 눌러 카드를 뒤집습니다. 좌우 화살표 키로 카드를 이동할 수 있습니다.용어가 표시되었습니다.
1 / 8

요약

Key takeaways
  • Fable 5는 MTok당 $10/$50의 1M 컨텍스트를 가진 Mythos-급 플래그십 — 다일 자율 실행, 밀집 비전, 어려운 사양의 첫-샷을 위해 고르세요; 다른 모든 것에는 Sonnet 5에 머무세요.
  • 마이그레이션할 네 API 변경: HTTP 200으로서의 인-밴드 거부, 적응형 thinking만, 원시 thinking 컨텐츠 없음, 일급 원시 기능으로서의 fallback.
  • Claude API / AWS에서 단순성을 위해 서버 측 fallback 선택; 다른 모든 곳에서 SDK 미들웨어 선택; 둘 다 여러분을 위해 자동으로 fallback credit 적용.
  • 30일 데이터 보존은 필수 — Fable 5는 ZDR 적격이 아닙니다. ZDR 요구 사항이 있다면 Opus 4.8을 고정.
  • 지시적인 Opus-4.8 시대 프롬프트를 한 줄로 재작성; 'show your reasoning' 언어에 대해 감사; 주 품질/지연 레버로 effort 사용.

Next