Kimi K2 для пользователей Claude
Вы уже мыслите категориями Claude. А потом r/LocalLLaMA не перестаёт говорить о Kimi K2 — модели от Moonshot AI с открытыми весами и агент-ориентированной архитектурой, которая обменивает вызовы инструментов на сотни шагов, не теряя нить, за долю цены передовых моделей. Вот что отличает эту историю от любого другого рассказа в духе «переходи на X»: поскольку Moonshot предоставляет эндпойнт, совместимый с Anthropic, вы можете направить свой существующий Claude Code на Kimi K2, изменив две переменные окружения. Больше ничего в вашем рабочем процессе не меняется. Эта страница накладывает вашу ментальную модель Claude на Kimi K2, показывает точную замену и отмечает те немногие вещи, которые действительно различаются.
- Перевести концепции Claude в их эквиваленты Kimi K2 (приложение Kimi, API Moonshot, K2-Instruct против K2 Thinking, открытые веса)
- Понять одно большое структурное отличие: Kimi K2 — это модель с открытыми весами (Modified MIT) и архитектурой MoE, а не закрытая передовая модель
- Направить Claude Code на Kimi K2 через совместимый с Anthropic эндпойнт Moonshot с помощью замены двух переменных
- Знать реальные расхождения и оговорки, прежде чем полагаться на слой совместимости
- Знать, когда Kimi K2 обычно оказывается лучшим выбором — длинные агентные прогоны, чувствительное к стоимости программирование и самостоятельный хостинг
Карта концепций за 60 секунд
Если вы прочитаете только один раздел, прочитайте этот. Вот как то, что вы знаете в Claude, соотносится с миром Kimi:
| В Claude вы называете это… | В мире Kimi это… | Та же идея? |
|---|---|---|
| Claude.ai (чат-приложение) | Приложение Kimi (kimi.com / мобильное) | Да — потребительская/ассистентская оболочка |
| Селектор модели (Opus / Sonnet / Haiku) | Варианты K2 — K2-Instruct (быстрый агентный) и K2 Thinking (глубокие рассуждения) | Да — выбираете по скорости против глубины рассуждений |
| Расширенное мышление | Чередующаяся цепочка рассуждений + вызовы инструментов у K2 Thinking | Да — рассуждение здесь является вариантом, а не просто переключателем |
| Anthropic Messages API | Нативный API Moonshot и совместимый с Anthropic эндпойнт | Частично — слой совместимости говорит на вашем диалекте |
| Использование инструментов | Нативный вызов инструментов Kimi (агент-ориентированный по замыслу) | Да — тот же цикл объявить→вызвать→выполнить→вернуть |
| Закрытые веса, только хостинг | Открытые веса на Hugging Face (Modified MIT) | Нет — это главное отличие; можно хостить самостоятельно |
| Claude Code | Claude Code, направленный на Kimi, или собственный Kimi CLI от Moonshot | В основном — та же оболочка, другая модель за ней |
Самая важная строка — предпоследняя: Kimi K2 имеет открытые веса. Всё, что следует ниже — самостоятельный хостинг, низкая цена, разрешительная лицензия — вытекает из этого.
Что такое Kimi K2 на самом деле
Kimi K2 — это модель типа Mixture-of-Experts: примерно 1T всего параметров при ~32B активных на токен (384 эксперта, 8 выбираются на токен). Она была предобучена на ~15.5T токенов и выпущена под Modified MIT License — по-настоящему открытые веса, которые можно скачать, изучить и запустить. Moonshot построил её агент-ориентированной: карточка модели описывает её как «специально разработанную для использования инструментов, рассуждений и автономного решения задач».
Для вас важнее всего два варианта:
- K2-Instruct — drop-in агентная/чат-модель. Контекст 128K. Самостоятельно заявленные 65.8% на SWE-bench Verified, 53.7% на LiveCodeBench, 89.5% на MMLU. Это ваша ежедневная рабочая лошадка в форме Sonnet.
- K2 Thinking — рассуждающий агент. Он сквозным образом чередует цепочку рассуждений с вызовами функций и остаётся стабильным на протяжении 200–300 последовательных вызовов инструментов — черта, которую люди превозносят для агентов с длинным горизонтом. Нативный INT4, контекст 256K. Самостоятельно заявленные 71.3% на SWE-bench Verified, 44.9% на Humanity's Last Exam (с инструментами), 60.2% на BrowseComp. Это ваш аналог Opus с расширенным мышлением.
- Открытые веса меняют смысл слова «переход». С Grok или Gemini вы арендуете чёрный ящик; с Kimi K2 вы можете также скачать её, запустить на собственном железе и никогда не отправлять ни одного токена вовне. По той же причине она является опорой наших страниц об открытых моделях и локальных агентах.
Убойная фича для пользователей Claude: направьте Claude Code на Kimi
В отличие от большинства альтернатив, вам не нужно покидать свою оболочку. Moonshot предоставляет совместимый с Anthropic эндпойнт (/anthropic/v1/messages), так что Claude Code — который говорит на Anthropic Messages API — может общаться с Kimi K2, переопределив две переменные окружения.
- Создайте аккаунт на платформе разработчиков Moonshot (platform.moonshot.ai или platform.moonshot.cn в материковом Китае) и сгенерируйте API-ключ. Он начинается с sk-.
- Направьте базовый URL Anthropic и токен авторизации Claude Code на Moonshot вместо Anthropic. Больше ничего в вашей настройке Claude Code — CLAUDE.md, навыки, MCP-серверы, слэш-команды — менять не нужно.
- Задайте модели актуальный id Kimi (например, preview/датированный id kimi-k2). Id моделей ротируются — читайте текущий список моделей Moonshot, а не прописывайте жёстко старый.
- Запустите claude и работайте с ним как всегда. Относитесь к этому как к новой модели за знакомым рулём: перезапустите собственные задачи и сравните. Та же оболочка ≠ то же поведение.
Направьте Claude Code на Kimi K2 (shell)
# Route Claude Code to Moonshot's Anthropic-compatible endpoint export ANTHROPIC_BASE_URL="https://api.moonshot.ai/anthropic" export ANTHROPIC_AUTH_TOKEN="sk-your-moonshot-api-key" # Then just run Claude Code as normal: claude # (In mainland China, use https://api.moonshot.cn/anthropic instead.)
- Слой совместимости близок, но не идентичен. Совместимый с Anthropic интерфейс Moonshot реализует не все функции Anthropic (например, параметр document), и есть известные расхождения вокруг поля thinking, которые могут проявиться с субагентами или запросами структурированного вывода. Если функция ведёт себя странно, подозревайте слой совместимости раньше, чем свою конфигурацию — и сверяйтесь с текущей документацией Moonshot по совместимости.
За пределами Claude Code: сырой API и самостоятельный хостинг
Если вы пишете собственную интеграцию, а не управляете Claude Code, у вас есть три пути:
- Совместимый с Anthropic эндпойнт — переиспользуйте свой клиент в форме Claude/Messages, изменив базовый URL и ключ (как выше). Наименьшее трение, если ваш код уже в форме Anthropic.
- Нативный API Moonshot — Moonshot также предлагает совместимую с OpenAI оболочку, так что код в форме OpenAI мигрирует тоже заменой базового URL + ключа. Удобно, если ваш стек пришёл со стороны OpenAI.
- Хостите веса самостоятельно — скачайте с Hugging Face и обслуживайте с помощью движка инференса, поддерживающего нативный разбор инструментов Kimi (vLLM, SGLang и им подобные). Это финал в плане приватности/стоимости: ни один токен не покидает вашу инфраструктуру. См. Запуск моделей локально с Ollama и Приватный локальный AI-стек для локального пути.
Что переносится без изменений
Почти всё ваше мастерство работы с Claude переносится, потому что Kimi K2 агент-ориентирована и нативно работает с инструментами, как и Claude:
- Привычки промптинга. Чёткие инструкции, явные ограничения, примеры и ролевое обрамление — всё работает. См. Основы промптинга и Перенос промптов между моделями.
- Дисциплина использования инструментов. Цикл объявить→вызвать→выполнить→вернуть имеет ту же форму, что и Использование инструментов в Claude. Kimi создана для него и держится на очень длинных цепочках инструментов.
- Инженерия контекста. Плотный контекст, хороший поиск и структурированные входы важны ровно так же — а на длинных агентных прогонах, пожалуй, даже больше. См. Инженерия контекста.
- Навыки управления агентом. Определение границ задач, ревью диффов и удержание прогонов «на рельсах» переносятся напрямую в любую оболочку — включая Claude Code, направленный на Kimi. См. Что такое Claude Code? и Оболочки для долгоживущих агентов.
Когда Kimi K2 обычно блистает
- Агентные прогоны с длинным горизонтом. Главная черта — стабильность на протяжении сотен последовательных вызовов инструментов — тянитесь к K2 Thinking, когда задача является марафоном использования инструментов, а не одним ответом.
- Чувствительное к стоимости программирование в масштабе. Сильные самостоятельно заявленные результаты SWE-bench при экономике открытых весов делают её естественной целью A/B-тестирования для высоконагруженных агентов программирования.
- Приватность и самостоятельный хостинг. Открытые веса означают, что вы можете запустить её полностью на собственном железе — то единственное, что не может предложить ни одна закрытая передовая модель.
- Сохранение мышечной памяти Claude Code. Когда вам нужна более дешёвая или самостоятельно хостящаяся модель без переучивания рабочего процесса, замену двух переменных трудно превзойти.
Честный ответ большую часть времени: та, что выигрывает вашу оценку на задаче, которая важна — и та, что позволяют ваши ограничения по приватности и бюджету. Навык переносим; настройка и оценка — вот настоящая работа. О независимом от провайдера способе выбора см. Выбор модели и Сколько стоит AI у разных провайдеров.
Проверьте себя
0/3- Kimi K2 — это MoE-модель от Moonshot с открытыми весами и агент-ориентированной архитектурой (~1T всего / ~32B активных, Modified MIT) — открытые веса и есть вся суть: самостоятельный хостинг, низкая стоимость, разрешительная лицензия.
- Два варианта чисто накладываются на вашу ментальную модель Claude: K2-Instruct (быстрый агентный ≈ Sonnet) и K2 Thinking (глубокие рассуждения + чередующиеся вызовы инструментов ≈ Opus с расширенным мышлением).
- Выдающееся для пользователей Claude: совместимый с Anthropic эндпойнт Moonshot позволяет направить Claude Code на Kimi путём переопределения двух переменных окружения — без изменения рабочего процесса.
- Слой совместимости близок, но не идентичен — некоторые функции Anthropic (например, document) и поведение поля thinking расходятся; сверяйтесь с текущей документацией Moonshot, когда что-то работает не так.
- Тянитесь к Kimi K2 для длинных агентных прогонов, чувствительного к стоимости программирования и приватности/самостоятельного хостинга — но названия вариантов, показатели и цены быстро устаревают, так что проверяйте и оценивайте.
Источники и дополнительное чтение
- moonshotai/Kimi-K2-Instruct · Hugging Face — официальная карточка модели K2-Instruct: архитектура, лицензия и самостоятельно заявленные бенчмарки.
- moonshotai/Kimi-K2-Thinking · Hugging Face — карточка модели K2 Thinking: чередующиеся рассуждения + вызовы инструментов, контекст и показатели.
- moonshotai на Hugging Face — полная модельная организация Moonshot, включая более новые точечные релизы и вариант Base.
- MoonshotAI/Kimi-K2 · GitHub — репозиторий K2, включая обсуждение совместимого с Anthropic эндпойнта и заметки по развёртыванию.
- Представляем Kimi K2 Thinking — собственное изложение Moonshot о рассуждающем агенте.
- Платформа разработчиков Moonshot AI — API-ключи, актуальные id моделей и цены (авторитетное место для любого конкретного числа).
Далее
- Независимый от провайдера способ выбора → Выбор модели
- Более широкое поле открытых весов → Открытые модели DeepSeek и Qwen · Сколько стоит AI у разных провайдеров
- Хостите веса самостоятельно → Запуск моделей локально с Ollama · Приватный локальный AI-стек
- Приходите и от других ассистентов? → ChatGPT для пользователей Claude · Gemini для пользователей Claude · Grok для пользователей Claude
- Заставьте длинные цепочки инструментов вести себя правильно → Оболочки для долгоживущих агентов · Инженерия контекста