Выбор модели Claude
Anthropic предлагает семейство моделей с разными точками баланса возможностей, стоимости и скорости. Правильный выбор — это в основном подбор модели под задачу, а не переплата за возможности, которые вам не нужны.
- Понимать лестницу Haiku → Sonnet → Opus как компромисс возможностей, стоимости и скорости
- Начинать с правильного значения по умолчанию вместо гаданий, затем осознанно двигаться вверх или вниз
- Смешивать уровни в одной системе — самый большой рычаг снижения затрат, которым большинство никогда не пользуется
- Правильно находить точный ID модели, чтобы обновления оставались изменением одной строки
Текущие модели
Last verified: 2026-08-07 · Official models & pricing
| Model | API model ID | Tier | Best for |
|---|---|---|---|
| Claude Opus 5 | claude-opus-5 | Opus — most capable | Complex agentic coding and enterprise work: 1M context, 128k output, with materially better numbers than Opus 4.8. Default on Claude Max, strongest available on Claude Pro. (Supersedes Claude Opus 4.8, now a legacy model.) |
| Claude Sonnet 5 | claude-sonnet-5 | Sonnet — balanced | The default workhorse and Claude Code's default model: the best combination of speed and intelligence, with a 1M-token context window. Start here for most work. (Supersedes Claude Sonnet 4.6, now a legacy model.) |
| Claude Haiku 4.5 | claude-haiku-4-5-20251001 | Haiku — fastest & cheapest | High-volume, latency-sensitive tasks: classification, extraction, routing, simple chat, and cheap sub-agents. |
| Claude Fable 5 | claude-fable-5 | Mythos-class — flagship (above Opus) | Anthropic's most capable widely released model. Multiday autonomous runs, first-shot on ambiguous specs, dense vision, sustained delegation to parallel subagents. GA June 9 2026. Refuses in-band (HTTP 200, stop_reason: refusal) — configure server-side or client-side fallback to another current Claude model (Opus 5 is the recommended default). Adaptive thinking only; raw thinking never returned. 30-day retention (NOT ZDR-eligible). |
| Claude Mythos 5 | claude-mythos-5 | Mythos-class — restricted (Project Glasswing) | Same capabilities as Fable 5 without the safety classifiers. Limited availability to approved Project Glasswing partners only; not self-serve. Customers without access should use Fable 5. |
Model IDs are exact; tiers and 'best for' are guidance. Pricing, context-window sizes and rate limits change frequently and are intentionally NOT listed here — always read them on the official page above. This file is the single source of truth: never hard-code model facts in prose, link to this table instead.
Попробуйте: какая модель подходит?
Ответьте на три вопроса и получите отправную рекомендацию:
Сбалансированный вариант по умолчанию — сильные рассуждения и кодинг за долю стоимости Opus. Начните отсюда и переходите выше только при реальном упоре в потолок качества.
Найдите точный ID модели в таблице моделей. Это лишь ориентир — для уверенности проведите быструю проверку на собственных данных.
Ментальная модель: лестница возможностей
- Начинайте с Sonnet. Это рабочая лошадка по умолчанию — сильные рассуждения и код по разумной цене. Большинство задач должны начинаться здесь.
- Переходите к Opus только когда Sonnet не справляется и качество важнее стоимости (сложные рассуждения, каверзные агенты, запутанный код).
- Опускайтесь до Haiku для больших объёмов, задач, чувствительных к задержкам, или простой работы (классификация, извлечение, маршрутизация, дешёвые суб-агенты).
Как на самом деле выбирать
- Это сбалансированная рабочая лошадка. Начинать с чего-то другого — значит оптимизировать до того, как у вас есть данные о вашей реальной задаче.
- Не обновляйте всю нагрузку. Найдите случаи, где Sonnet ошибается, и направляйте только их на Opus — вы получаете качество, не платя за него везде.
- Классификации, извлечению, маршрутизации и дешёвым суб-агентам редко нужна более крупная модель. Проверьте это, а не предполагайте.
- Используйте Haiku для дешёвой пред- и постобработки, а Sonnet/Opus — для сложного ядра. Такое разделение по уровням — один из самых больших рычагов снижения затрат — см. «Стоимость и задержка».
Разделение моделей по уровням заслуживает отдельного чтения: Стоимость и задержка.
:::tip Не выбирайте только по бенчмаркам Публичные бенчмарки — это отправная подсказка, а не приговор для вашей задачи. Проведите крошечную оценку на горстке ваших реальных входов на двух моделях — это занимает минуты и лучше, чем гадание. :::
Как найти точный ID модели
Всегда передавайте актуальный API ID модели (например, в вызове messages.create). Возьмите его из таблицы моделей выше или с официальной страницы моделей — и предпочитайте читать его из конфига вместо жёсткого прописывания во многих местах, чтобы обновление модели оставалось изменением одной строки.
Проверьте себя
0/4- Haiku → Sonnet → Opus — это лестница возможностей, стоимости и скорости — выбирайте ступень, не гадайте модель.
- По умолчанию берите Sonnet и выпускайте; двигайтесь вверх или вниз только на основании данных из вашей задачи.
- Обновляйте сложное подмножество, а не всю нагрузку — маршрутизация лучше сплошного обновления.
- Смешивание уровней в одной системе — один из самых больших доступных вам рычагов снижения затрат.
- Бенчмарки — это подсказка; крошечная оценка на ваших реальных входах — приговор.
- Читайте ID модели из конфига и смотрите его в живой таблице моделей — никогда не прописывайте факты о модели жёстко.