Pular para o conteúdo principal

Escolhendo um Modelo Claude

Iniciante

A Anthropic oferece uma família de modelos em diferentes pontos de capacidade/custo/velocidade. Escolher bem é, em grande parte, uma questão de combinar o modelo à tarefa — e não pagar a mais por uma capacidade de que você não precisa.

Os modelos atuais

Last verified: 2026-09-14 · Official models & pricing

ModelAPI model IDTierBest for
Claude Fable 5.1claude-fable-5-1Mythos-class — flagship (above Opus)Anthropic's most capable widely released model, released September 1, 2026. For demanding reasoning and long-horizon agentic work, or when Opus 5 at higher effort still falls short on your evals. Same list price as Fable 5 with cache reads at a quarter of the cost. Three breaking changes vs Fable 5: forced tool_choice (any/tool) returns 400, thinking blocks are readable only by Fable 5.1 or newer, and editing earlier turns invalidates thinking blocks. Refuses in-band (HTTP 200, stop_reason: refusal); fallback targets are Opus 5 and Opus 4.8. 30-day retention (NOT ZDR-eligible); not on Priority Tier. (Supersedes Claude Fable 5, now a legacy model.)
Claude Mythos 5.1claude-mythos-5-1Mythos-class — restricted (Project Glasswing)Same underlying model, specs and pricing as Fable 5.1 with a different safeguard configuration, offered only to approved Project Glasswing participants (currently US organizations, via the Cyber Verification and Life Sciences Verification programs). Does not run the conversation-binding check on thinking blocks. Customers without access should use Fable 5.1.
Claude Opus 5claude-opus-5Opus — most capableComplex agentic coding and enterprise work: 1M context, 128k output, with materially better numbers than Opus 4.8. Default on Claude Max, strongest available on Claude Pro. (Supersedes Claude Opus 4.8, now a legacy model.)
Claude Sonnet 5claude-sonnet-5Sonnet — balancedThe default workhorse and Claude Code's default model: the best combination of speed and intelligence, with a 1M-token context window. Start here for most work. (Supersedes Claude Sonnet 4.6, now a legacy model.)
Claude Haiku 4.5claude-haiku-4-5-20251001Haiku — fastest & cheapestHigh-volume, latency-sensitive tasks: classification, extraction, routing, simple chat, and cheap sub-agents.
Claude Fable 5claude-fable-5Mythos-class — flagship (above Opus)Legacy since September 1, 2026 (superseded by Fable 5.1) but still available. Multiday autonomous runs, first-shot on ambiguous specs, dense vision, sustained delegation to parallel subagents. GA June 9 2026. Refuses in-band (HTTP 200, stop_reason: refusal) — configure server-side or client-side fallback. Adaptive thinking only; raw thinking never returned. 30-day retention (NOT ZDR-eligible). Two reasons to stay on it for now: it supports forced tool_choice and Priority Tier, which Fable 5.1 does not.
Claude Mythos 5claude-mythos-5Mythos-class — restricted (Project Glasswing), legacySuperseded by Mythos 5.1. Shares Fable 5's specs and pricing, offered separately for defensive cybersecurity workflows in Project Glasswing. Invitation-only, no self-serve sign-up. Customers without access should use Fable 5.1.

Model IDs are exact; tiers and 'best for' are guidance. Pricing, context-window sizes and rate limits change frequently and are intentionally NOT listed here — always read them on the official page above. This file is the single source of truth: never hard-code model facts in prose, link to this table instead.

Experimente: qual modelo se encaixa?

Responda a três perguntas e obtenha uma recomendação inicial:

Dificuldade da tarefa
O que mais importa
Volume de requisições
Recommended
Claude Sonnet

O padrão equilibrado — raciocínio e programação fortes por uma fração do custo do Opus. Comece por aqui e só suba de nível se atingir um teto real de qualidade.

Consulte o ID exato do modelo na tabela de modelos. Apenas uma regra geral — faça uma avaliação rápida com seus próprios dados para ter certeza.

O modelo mental: uma escada de capacidade

  • Comece com o Sonnet. Ele é o cavalo de batalha padrão — forte em raciocínio e codificação a um custo sensato. A maioria das tarefas deve começar aqui.
  • Suba para o Opus apenas quando o Sonnet tiver dificuldades e a qualidade importar mais que o custo (raciocínio difícil, agentes complicados, código intrincado).
  • Desça para o Haiku em trabalhos de alto volume, sensíveis à latência ou simples (classificação, extração, roteamento, subagentes baratos).

Como escolher de verdade

  1. Use o Sonnet como padrão e coloque em produção.
  2. Atingindo um teto de qualidade? Experimente o Opus apenas no subconjunto difícil.
  3. Custo ou latência incomodando? Veja se o Haiku é bom o suficiente para aquela etapa.
  4. Misture modelos. Use o Haiku para pré/pós-processamento barato e o Sonnet/Opus para o núcleo difícil. Esse "escalonamento de modelos" é uma das maiores alavancas de custo — veja Custo e Latência.

:::tip Não escolha apenas por benchmarks Benchmarks públicos são um indício inicial, não um veredito para a sua tarefa. Rode uma pequena eval em um punhado das suas entradas reais entre dois modelos — leva minutos e supera adivinhar. :::

Consultando o ID exato do modelo

Sempre passe o ID atual do modelo na API (por exemplo, na sua chamada messages.create). Obtenha-o na tabela de modelos acima ou na página oficial de modelos — e prefira lê-lo a partir da configuração em vez de codificá-lo em vários lugares, para que atualizações de modelo sejam uma mudança de uma única linha.

Próximo