В Claude Code на аккаунте Anthropic сейчас доступны четыре модели: Claude Opus 5, Claude Sonnet 5, Claude Fable 5 и Claude Haiku 4.5. Переключаются они командой /model, и с версии 2.1.153 выбор из этой команды сохраняется в пользовательский файл настроек — то есть действует и в следующих сессиях. Ниже разобрано, чем модели отличаются по документации Anthropic, как устроены окно контекста и уровни усилия и какую модель разумно ставить под какую задачу. Все числа и названия — из официальной документации по состоянию на 24 августа 2026 года; линейка меняется часто, поэтому перед важным решением сверяйтесь с первоисточником.
Что доступно в Claude Code сегодня
В настройке модели Claude Code принимает две разные вещи: псевдоним (короткое слово вроде opus) и полное имя модели (вроде claude-opus-5). Псевдоним удобнее — он сам указывает на рекомендованную версию для вашего провайдера и обновляется со временем. Полное имя нужно тогда, когда версию требуется зафиксировать.
| Псевдоним | Что делает |
|---|---|
default | Снимает любое переопределение и возвращает модель по умолчанию для вашего аккаунта |
best | Fable 5 там, где организация имеет к нему доступ, иначе последняя модель Opus |
fable | Claude Fable 5 — для самых тяжёлых и долгих задач |
opus | Последняя модель Opus для сложных рассуждений |
sonnet | Последняя модель Sonnet для повседневной работы с кодом |
haiku | Быстрая и экономичная модель Haiku для простых задач |
opus[1m], sonnet[1m] | Тот же ряд, но с окном контекста в миллион токенов |
opusplan | Гибрид: opus в режиме планирования, sonnet на исполнении |
На Anthropic API псевдоним opus сейчас указывает на Opus 5, а sonnet — на Sonnet 5. У других провайдеров те же псевдонимы разрешаются в другие версии: например, на Microsoft Foundry opus — это Opus 4.6, а sonnet — Sonnet 4.5.
Сами модели различаются так (данные из обзорной таблицы моделей Anthropic):
| Модель | Идентификатор | Контекст | Максимум вывода | Скорость | Цена API, $ за 1M токенов |
|---|---|---|---|---|---|
| Claude Fable 5 | claude-fable-5 | 1M | 128K | медленнее прочих | 10 вход / 50 выход |
| Claude Opus 5 | claude-opus-5 | 1M | 128K | средняя | 5 / 25 |
| Claude Sonnet 5 | claude-sonnet-5 | 1M | 128K | быстрая | 2 / 10 |
| Claude Haiku 4.5 | claude-haiku-4-5 | 200K | 64K | самая быстрая | 1 / 5 |
Цены в таблице — прайс Claude API. На подписке (Pro, Max, Team, Enterprise) оплата не потокенная, но соотношение остаётся ориентиром: тот же объём токенов на Opus 5 стоит в два с половиной раза дороже, чем на Sonnet 5, и в пять раз дороже, чем на Haiku 4.5, а Fable 5 — вдвое дороже Opus 5. Подробнее про деньги — в статье про стоимость Claude Code.
Официальные описания короткие и довольно точные: Fable 5 — «интеллект следующего поколения для долго работающих агентов», Opus 5 — «для сложной агентной работы с кодом и корпоративных задач», Sonnet 5 — «лучшее сочетание скорости и интеллекта», Haiku 4.5 — «самая быстрая модель с околофронтирным интеллектом».
Модель по умолчанию зависит от типа аккаунта: на Max, Team Premium, Enterprise с оплатой по факту и на Anthropic API это Opus 5, на Pro, Team Standard и подписочных местах Enterprise — Sonnet 5. Fable 5 не является моделью по умолчанию ни на одном типе аккаунта: сессия работает на нём только после явного выбора.
claude update.Как переключить модель и куда это записывается
Способов задать модель несколько, и они выстроены по приоритету — от самого сильного к самому слабому:
- В сессии:
/modelс именем или псевдонимом переключает сразу,/modelбез аргумента открывает выбор. - При запуске: флаг
claude --model opus. - Переменная окружения:
ANTHROPIC_MODEL. - Файл настроек: поле
model. - Умолчание для новых сессий:
ANTHROPIC_DEFAULT_MODEL(с версии 2.1.236).
claude --model opus
/model sonnet
/model claude-opus-5
/model сохраняется как умолчание для новых сессий: Claude Code пишет поле model в ваш пользовательский файл настроек. В интерактивном выборе Enter означает «переключить и сохранить», а клавиша s — «только на эту сессию». Набранное вручную /model sonnet ведёт себя как Enter. То есть разовое «попробую Opus» тихо становится вашим постоянным умолчанием, пока вы не поменяете его обратно.Флаг --model и переменная ANTHROPIC_MODEL, наоборот, действуют только на ту сессию, которую вы ими запустили. Именно поэтому документация советует: если нужно держать разные модели в разных терминалах одновременно, запускайте каждый со своим --model, а не переключайтесь через /model. Это ровно тот случай, когда в одном окне идёт долгий разбор на Opus, а в соседнем механическая правка на Sonnet.
Ещё две вещи стоит знать. Возобновлённые сессии (claude --resume, --continue, /resume) сохраняют ту модель, на которой их записали, независимо от текущей настройки — чтобы чужой выбор /model не менял модель при возврате к старой беседе. И текущую модель всегда можно посмотреть в /status или в строке состояния.
Окно контекста и расширенный контекст
Окно контекста — это сколько текста модель держит перед глазами за один запрос. У Fable 5, Opus 5 и Sonnet 5 оно равно 1 млн токенов, у Haiku 4.5 — 200 тысяч. Миллион токенов документация оценивает примерно в 555 тысяч слов.
Доступность расширенного окна зависит от модели и тарифа. На Anthropic API Fable 5, Sonnet 5 и Opus начиная с 4.7 всегда работают с окном в 1M. На подписках Max, Team и Enterprise Opus автоматически получает миллионное окно без дополнительной настройки; на Pro то же самое требует докупленных кредитов использования. Sonnet 5 — отдельный случай: на Anthropic API у него нет варианта на 200K, суффикс [1m] ему не нужен и кредиты не требуются ни на одном тарифе.
/model opus[1m]
/model claude-opus-4-8[1m]
Расширенное окно оплачивается по обычной цене модели — надбавки за токены сверх 200K нет. Когда контекст подходит к пределу, Claude Code сжимает беседу автоматически; порог настраивается командой /autocompact и принимает значения от 100K до 1M. Для Sonnet 5 порог по умолчанию — около 967 тысяч токенов.
Практический смысл здесь скромнее, чем кажется. Большое окно не делает модель умнее — оно лишь откладывает момент, когда история беседы начнёт сжиматься и терять детали. Длинная сессия расходует лимит быстрее короткой независимо от модели, потому что вся история отправляется с каждым запросом.
Уровни усилия — второй регулятор рядом с моделью
Кроме модели у Claude Code есть отдельная настройка — уровень усилия. Она управляет тем, сколько токенов модель тратит на ответ, включая рассуждение, объяснения и вызовы инструментов. Ниже уровень — быстрее и дешевле, выше — глубже разбор.
| Модель | Доступные уровни |
|---|---|
| Fable 5, Opus 5, Sonnet 5, Opus 4.8, Opus 4.7 | low, medium, high, xhigh, max |
| Opus 4.6, Sonnet 4.6 | low, medium, high, max |
| Haiku 4.5 | уровни усилия не поддерживаются |
Умолчание — high на всех моделях, поддерживающих усилие, кроме Opus 4.7, где по умолчанию xhigh. Если задать уровень, которого у активной модели нет, Claude Code опустится до ближайшего поддерживаемого: xhigh на Opus 4.6 отработает как high.
Как документация описывает уровни: low — для коротких, узких задач, где интеллект не критичен; medium — экономия токенов там, где можно уступить немного качества; high — баланс, умолчание; xhigh — более глубокий разбор за большие траты; max — «может улучшить результат на требовательных задачах, но даёт убывающую отдачу и склонен к переусложнению, проверяйте перед широким применением».
/effort medium
/effort auto
claude --effort xhigh
Уровень можно поставить командой /effort, флагом --effort, переменной CLAUDE_CODE_EFFORT_LEVEL, полем effortLevel в настройках (там max не принимается) или стрелками влево-вправо прямо в меню /model. Уровни low, medium, high и xhigh сохраняются между сессиями, а max — только на текущую, если не задан через переменную окружения.
Отдельно стоит помнить две мелочи. Слово ultrathink в тексте запроса просит более глубокое рассуждение на один ход, не меняя настройку сессии; другие формулировки вроде «think hard» Claude Code как ключевые слова не распознаёт. А ultracode в меню /effort — это не уровень модели, а настройка самого Claude Code: она отправляет модели xhigh и вдобавок заставляет планировать динамический рабочий процесс под каждую содержательную задачу.
Шкала усилия калибруется отдельно для каждой модели, поэтому одинаковое название уровня не означает одинаковую величину на разных моделях.
Что выбор модели делает с лимитом и скоростью
Первое, что стоит развести: сессионный и недельный лимиты общие для всех моделей, поэтому переключение через /model их не восстанавливает. А вот сообщение «You've hit your Opus limit» относится только к запросам к Opus — после него переход на другую модель позволяет продолжать работу. Подробно про окна и сообщения — в статье про лимиты Claude Code.
Второе: документация Anthropic прямо называет причины неожиданно высокого расхода — «длинные сессии, которые никто не очищал, и Opus, оставленный моделью по умолчанию». Два самых полезных навыка отсюда — /clear между несвязанными задачами и подбор модели под работу.
Третье: модель выбирается не только для главной сессии. У субагента модель задаётся полем model во фронтматтере — псевдонимом, полным именем или значением inherit (оно же по умолчанию), и документация советует ставить haiku для простых исследовательских субагентов, чтобы дорогие модели оставались на задачах, которым они действительно нужны. Для команд агентов рекомендация другая: Sonnet, поскольку он балансирует возможности и стоимость на координационной работе; при этом команда агентов расходует примерно в семь раз больше токенов, чем обычная сессия, когда участники работают в режиме планирования.
Про скорость документация даёт только качественное сравнение задержки: Haiku 4.5 — самая быстрая, Sonnet 5 — быстрая, Opus 5 — средняя, Fable 5 — медленнее прочих. Числовых замеров Anthropic не публикует, и это честнее, чем цифры, которые зависят от длины запроса и загрузки сервиса.
Ещё один фактор расхода, который легко упустить: Claude Code тратит токены на фоновые функции даже в простое — например, на сводки прошлых бесед для claude --resume. Документация оценивает это обычно менее чем в четыре цента за сессию, и для фоновой работы используется модель из ANTHROPIC_DEFAULT_HAIKU_MODEL.
Отдельно про доступ: Россия не входит в список поддерживаемых Anthropic стран, оплата российскими картами не проходит. На выбор модели это не влияет — влияет на возможность вообще оплатить тариф; фактическая картина разобрана в статье про Claude Code в России.
Задача — разумная модель
Официальная рекомендация Anthropic на удивление проста: «Берите модель поменьше, когда работа рутинная — правки, которые вы можете описать точно, механические изменения, вопросы о коде, который уже в контексте. Берите модель побольше, когда задача действительно трудная — неочевидные баги, незнакомая предметная область, архитектурные решения». Таблица ниже — приложение этого правила к типичным ситуациям, а не отдельный источник истины.
| Задача | Модель | Почему |
|---|---|---|
| Переименование, форматирование, правка по точному описанию | Sonnet 5, при большом объёме — Haiku 4.5 | Работа механическая, интеллект не является узким местом |
| Обычная фича по внятному ТЗ, тесты, рефакторинг одного модуля | Sonnet 5 | Документация прямо называет Sonnet моделью для большинства задач с кодом |
| Неочевидный баг, разбор чужого кода, незнакомый стек | Opus 5 | Случай, где не хватает именно способности модели, а не усердия |
| Архитектурное решение, план миграции | opusplan или Opus 5 в режиме планирования |
Планирование на Opus, исполнение на Sonnet — встроенный режим |
| Задача крупнее одного подхода, длинная автономная сессия | Fable 5 | Позиционируется как модель для задач, не помещающихся в одно сидение |
| Субагент на поиск по репозиторию, чтение логов | model: haiku во фронтматтере |
Объём чтения большой, требования к рассуждению низкие |
| Участники команды агентов | Sonnet | Прямая рекомендация раздела про стоимость команд агентов |
Что модели в принципе умеют и где отказывают независимо от размера — разобрано отдельно в статье про ИИ для программирования. Выбор модели не двигает эту границу, он двигает только цену и глубину внутри неё.
Типичная ошибка: тяжёлая модель на механической работе
Самая распространённая ошибка — поставить самую сильную модель один раз и забыть. Она выглядит безобидной, потому что результат всегда приемлемый, а платите вы не за отдельный запрос. Проявляется она позже: лимит заканчивается в середине рабочего дня, ответы приходят медленнее, чем нужно для итеративной правки, а половина потраченного пришлась на переименования и запуск тестов.
Обратная ошибка встречается реже, но обходится дороже по времени: держать лёгкую модель на задаче, где не хватает именно способности разобраться. Тогда сессия уходит в круг «попробовал — не то — попробовал ещё раз», и суммарный расход выходит больше, чем если бы вы сразу взяли модель посильнее.
У Anthropic есть аккуратный способ различать эти случаи. Когда Claude ошибся, спросите себя: ему не хватило знаний или не хватило работы? Если весь нужный контекст у него был, он явно взялся за задачу и всё равно не справился — берите модель побольше. Если он пропустил шаг: не прочитал файл, не запустил тесты, не перепроверил результат — поднимайте уровень усилия, модель менять не нужно.
Практический вывод из этого простой. Модель под задачу переключают, а не выбирают навсегда — благо это одна команда. А если задачи разного веса идут параллельно, дешевле держать их в разных терминалах со своими --model: так тяжёлая модель работает только там, где она нужна. В нашем приложении VibeeCode такие терминалы живут в одном окне, но сам приём не требует ничего, кроме двух запусков claude с разными флагами.
Короткий итог
- Умолчание уже разумное. На Pro это Sonnet 5, на Max и API — Opus 5. Менять его стоит осознанно, а не «на всякий случай».
- Sonnet 5 — рабочая лошадь. Большинство задач с кодом закрывается им, а по цене токенов он в два с половиной раза дешевле Opus 5.
- Opus 5 — под трудное. Неочевидные баги, незнакомый код, архитектура. Для связки «подумать — сделать» есть
opusplan. - Fable 5 — под длинное. Не является умолчанием нигде, выбирается явно через
/model fable. - Haiku 4.5 — под объём. Субагенты, чтение логов, поиск по репозиторию. Уровней усилия у него нет.
- Усилие — отдельный регулятор. Пропущенные шаги лечатся уровнем
xhigh, а не сменой модели. - Помните про запись в конфиг.
/modelсохраняет выбор для будущих сессий; чтобы поменять модель разово, жмитеsв меню или запускайте отдельный терминал с--model. - Проверяйте линейку. Модели и требования к версии CLI меняются раз в несколько месяцев; таблицы выше актуальны на 24 августа 2026 года.