Расход Claude Code считается в двух окнах одновременно: пятичасовом, которое сбрасывается скользящим окном, и недельном, которое сбрасывается в фиксированное время, назначенное вашему аккаунту. Оба окна общие для всех продуктов Claude — переписка на claude.ai, десктоп-приложение и терминал тратят один и тот же счёт. Точных цифр (сколько сообщений, часов или токенов входит в тариф) Anthropic не публикует, поэтому единственный надёжный способ узнать свой остаток — команда /usage внутри CLI.

Какие лимиты бывают

Ограничений в Claude Code несколько, и они разной природы. Путать их дорого: от того, какой именно потолок вы задели, зависит, поможет ли смена модели или придётся ждать.

ОграничениеКак устроеноПомогает ли /model
Окно сессии Скользящее пятичасовое окно расхода на подписке Нет: окно общее для всех моделей
Недельное окно Недельный потолок, сбрасывается в фиксированное время, закреплённое за аккаунтом Нет: окно общее для всех моделей
Лимит на Opus Отдельный счётчик только на запросы к Opus Да: на другой модели работа продолжается
Контекстное окно Длина одного разговора, а не расход по тарифу Не относится к лимитам использования

Когда вы упираетесь в потолок, Claude Code показывает одно из трёх сообщений и называет время сброса:

You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pm

Первые два блокируют дальнейшие запросы до указанного времени. Третье — только запросы к Opus: команда /model переводит сессию на другую модель, и работа продолжается. Расход при этом идёт в оба окна сразу, поэтому один интенсивный вечер способен выбрать недельный запас раньше, чем закончится пятичасовое окно.

Предупреждение о переполнении контекста — это не лимит тарифа. Anthropic в документации разводит эти два случая явно: сообщение об авто-компактизации означает, что разговор подошёл к границе контекстного окна модели и старая история будет свёрнута в резюме. Ваш недельный запас при этом может быть нетронут.

Лимиты общие с веб-версией Claude

Это самый частый источник недоумения: человек почти не работал в терминале, а лимит уже выбран. Формулировка справки Anthropic не оставляет места для трактовок — использование всех продуктовых поверхностей Claude (claude.ai, Claude Code, десктоп-приложение Claude) засчитывается в один и тот же лимит. Отдельного «пакета для терминала» не существует. Работа через расширения для VS Code, Cursor и продуктов JetBrains считается туда же.

Практическое следствие простое: длинное утро в чате уменьшает то, что останется на вечернюю сессию в терминале. Если вы держите Claude открытым как справочник и параллельно кодите — это один бюджет, а не два.

На тарифах Claude for Teams и Enterprise устройство то же самое: расход каждого участника идёт из его посадочной квоты, которая сбрасывается по скользящему пятичасовому и по недельному окну, а сама квота общая с чатом Claude и Cowork. Размер квоты зависит от типа места (Standard или Premium).

Сколько именно даётся

Здесь придётся написать неудобное: абсолютных цифр Anthropic не публикует. На 24 августа 2026 года в справочных статьях о тарифах Pro и Max нет ни количества сообщений, ни количества часов, ни объёма токенов на окно. Есть только относительные ориентиры:

  • Pro — «не менее чем в пять раз больше использования за сессию по сравнению с бесплатным доступом»;
  • Max 5x — в пять раз больше за сессию, чем Pro;
  • Max 20x — в двадцать раз больше за сессию, чем Pro.

Anthropic дополнительно оговаривает, что может ограничивать использование и другими способами — недельными и месячными потолками, ограничениями по моделям и функциям — по своему усмотрению. То есть даже относительные ориентиры не являются обещанием.

Причина, по которой цифра в сообщениях была бы бессмысленной, названа в той же справке: расход зависит от длины и сложности разговора, использованных функций, выбранной модели и уровня усилий. Одно и то же «сообщение» может стоить и сотню токенов, и сотню тысяч. Поэтому любые числа вида «на Pro хватает N запросов», встречающиеся в обзорах, — это чужие замеры, а не публикация Anthropic. Сравнение самих тарифов и того, что в них входит, разобрано отдельно в статье про цену Claude Code.

Как посмотреть свой расход

Вместо угадывания есть четыре штатных способа.

Команда /usage

Основной инструмент. У подписчиков Pro, Max, Team и Enterprise она показывает полосы расхода по тарифу, статистику активности и разбивку: сколько потребления пришлось на навыки, сабагентов, плагины и отдельные MCP-серверы, каждый — в процентах от общего. Отдельно отмечаются поведенческие флаги — например, «длинный контекст» или «промахи кэша», — когда на одну из этих причин приходится 10 процентов расхода или больше. Клавиши d и w переключают окно между сутками и семью днями.

У блока Session в верхней части команды другое назначение: он считает токены и стоимость текущей сессии по прайс-листу и адресован тем, кто работает по API-ключу. Подписчикам эта сумма ничего не говорит о списаниях.

Важная оговорка про разбивку. Полосы расхода приходят с сервера, а разбивка по источникам считается локально, из истории сессий на этой машине. Работа с другого компьютера и переписка на claude.ai в неё не попадают, а сами числа документация называет приблизительными.

Страница расхода в аккаунте

Для подписки это Settings → Usage на claude.ai — там же живут дополнительные кредиты (usage credits) и месячный потолок трат по ним. Для работы по API авторитетный источник другой — страница Usage в Claude Console; локальная оценка стоимости в CLI считается по стандартным ставкам и не учитывает скидки и контрактные условия.

Строка состояния

Если хочется видеть остаток постоянно, настраиваемая строка состояния получает поля rate_limits.five_hour.used_percentage и rate_limits.seven_day.used_percentage (проценты от 0 до 100), а также resets_at — момент сброса каждого окна. Поля появляются только у подписчиков claude.ai и только после первого ответа API в сессии, поэтому скрипт должен корректно переживать их отсутствие.

Команда /context

Показывает, из чего сейчас состоит контекст: системный промпт, память, файлы CLAUDE.md, описания навыков, MCP-инструменты, прочитанные файлы. Это не про тариф, а про то, почему каждый следующий запрос стал дороже. Есть ещё /insights — отчёт о том, как вы работаете, по локальной истории сессий; учтите, что его собственный анализ тоже расходует токены.

Что съедает лимит быстрее всего

Ключевой механизм, который объясняет почти все неожиданные списания: Claude Code отправляет весь разговор с каждым запросом, и каждый шаг с инструментом — это ещё один запрос, несущий очередную порцию результатов. Однострочный вопрос в сессии, открытой с утра, всё равно тянет за собой всю накопленную историю.

  • Длинный контекст. Кэширование промпта удешевляет повторную отправку истории, но не отменяет её. Чем длиннее сессия, тем дороже в ней любая мелочь.
  • Промахи кэша. Первое сообщение после паузы, превышающей время жизни кэша, переобрабатывает весь контекст заново. На подписке это час; при работе на дополнительных кредитах и по API-ключу — пять минут по умолчанию.
  • Чтение больших файлов целиком. В учебной симуляции из документации системный промпт занимает около 4200 токенов, файл CLAUDE.md проекта — 1800, а одно чтение исходника — от 1100 до 2400. Десяток файлов «на всякий случай» стоит дороже, чем сама правка.
  • Параллельные агенты. Каждый работающий экземпляр держит собственное контекстное окно. Для командной работы агентов Anthropic называет ориентир: примерно в семь раз больше токенов, чем у обычной сессии, когда участники работают в режиме планирования. Несколько панелей с агентами в одном окне — например, в VibeeCode — это несколько независимых счётчиков, а не один. Что даёт и чего стоит такая схема, разобрано в статье про несколько ИИ-агентов одновременно.
  • Сама компактизация. Команда /compact читает разговор, который сворачивает, поэтому компактизация большого контекста — сама по себе крупный запрос. Для чистого старта дешевле /clear: он не стоит ничего.
  • Фоновая активность. Запланированные задачи, сообщения из других ваших сессий и проверки хода фоновой работы стартуют новый ход и отправляют полный контекст даже тогда, когда вы к терминалу не подходили.
  • Рассуждения. Расширенное мышление включено по умолчанию, его токены тарифицируются как выходные, и бюджет по умолчанию может составлять десятки тысяч токенов на запрос — в зависимости от модели.

Приёмы экономии

Что настроить один раз

  • Модель под задачу. Sonnet справляется с большинством задач по коду и стоит дешевле Opus; Opus имеет смысл держать для сложных архитектурных решений. Для простых сабагентов в их описании указывается model: haiku. Подробнее — в статье про модели Claude Code.
  • Уровень усилий. Команда /effort управляет глубиной рассуждений. По умолчанию на поддерживающих моделях стоит high; уровень medium документация прямо описывает как способ сократить расход токенов там, где можно поступиться частью качества рассуждений.
  • Лишние MCP-серверы. Описания инструментов по умолчанию загружаются отложенно, но неиспользуемые серверы всё равно стоит выключить через /mcp, а посмотреть, кто занимает место, — через /context. Там, где есть обычная утилита командной строки, она дешевле по контексту, чем MCP-сервер.
  • Короткий CLAUDE.md. Файл загружается в контекст при старте каждой сессии, поэтому подробные инструкции под редкие сценарии лучше вынести в навыки, которые подгружаются по вызову. Ориентир документации — держать CLAUDE.md в пределах 200 строк.
  • Хуки-фильтры. Хук может отфильтровать вывод перед тем, как его увидит модель: вместо десятитысячного лога в контекст попадут только строки с ошибками.
  • Порог авто-компактизации. Команда /autocompact с числом (например, /autocompact 500k) задаёт, насколько заполненным должно стать контекстное окно перед автоматической свёрткой; принимаются значения от 100K до 1M токенов, но не выше окна самой модели.

Что делать в каждой сессии

  • Узкая задача вместо широкой. «Улучши этот проект» запускает сплошное сканирование; «добавь проверку ввода в функцию входа в auth.ts» позволяет обойтись минимумом чтений. Как формулировать такие задачи — в статье про промпты для вайбкодинга.
  • Точные ссылки на файлы. Названный путь заменяет поиск по проекту и несколько чтений-кандидатов.
  • /clear между несвязанными задачами. Старый контекст не просто мешает — он оплачивается в каждом следующем сообщении. Перед очисткой удобно дать сессии имя через /rename, чтобы потом вернуться к ней через /resume.
  • /compact с указанием фокуса. Формулировка вида /compact focus on the auth bug fix оставляет в резюме то, что нужно вам, а не то, что автоматика сочла важным.
  • Объёмные операции — сабагенту. Прогон тестов, разбор логов, чтение документации можно отдать сабагенту: подробный вывод останется в его окне, а в основной разговор вернётся только сводка. В примере из документации сабагент читает три файла и возвращает около 420 токенов.
  • Режим планирования и ранняя остановка. Shift+Tab переводит в режим планирования, где Claude сначала предлагает подход, а не переписывает половину проекта в неверном направлении. Если направление всё же не то — Escape останавливает работу сразу, а /rewind возвращает к предыдущей контрольной точке. Переделка стоит дороже, чем пауза.

Лимит упёрся: что делать

Порядок действий зависит от того, какое из трёх сообщений вы увидели.

  1. Прочитать время сброса. Оно указано прямо в сообщении. Команда /usage покажет оба окна и когда каждое обнулится.
  2. Если это лимит Opus — выполнить /model и выбрать другую модель. Сессия продолжится.
  3. Если это окно сессии или недельное — смена модели не поможет, окна общие для всех моделей. В десктоп-приложении на карточке лимита во вкладке Code есть флажок автоматического продолжения после сброса.
  4. Дополнительные кредиты. Команда /usage-credits открывает страницу управления ими у подписчиков Pro и Max; участникам Team и Enterprise без прав на биллинг она отправляет запрос администраторам. При работе на кредитах время жизни кэша падает с часа до пяти минут, то есть расход при том же стиле работы вырастет; вернуть часовой кэш можно переменной окружения ENABLE_PROMPT_CACHING_1H=1.
  5. Использовать паузу. Пока окно не сбросилось, полезно подготовить следующую задачу текстом: точные пути к файлам, критерий готовности, команда проверки. Такая сессия окажется в разы короче импровизации.
Про доступ из России. Россия не входит в список поддерживаемых стран Anthropic, и оплата российскими картами не проходит — это касается и повышения тарифа, и покупки дополнительных кредитов. Обходные схемы мы не разбираем и не рекомендуем.

Чек-лист экономии

  1. Помнить, что чат на claude.ai и терминал тратят один счёт.
  2. Раз в день смотреть /usage, а не гадать по ощущениям.
  3. Вывести проценты обоих окон в строку состояния, чтобы не упираться внезапно.
  4. /clear при переходе к несвязанной задаче — вместо бесконечной сессии.
  5. /compact с указанием фокуса, когда историю всё-таки надо сохранить.
  6. Давать точные пути к файлам вместо просьбы «разберись в проекте».
  7. Держать Sonnet моделью по умолчанию, Opus включать под конкретную задачу.
  8. Снижать уровень усилий на простой работе.
  9. Выключить MCP-серверы, которыми сейчас не пользуетесь, и проверить /context.
  10. Сократить CLAUDE.md, вынеся редкие инструкции в навыки.
  11. Объёмное чтение и прогон тестов отдавать сабагенту.
  12. Запускать параллельных агентов осознанно: каждый — отдельный счётчик.
  13. Останавливать неверное направление сразу, не дожидаясь конца ответа.

Ни один из этих приёмов не увеличивает квоту. Все они уменьшают количество токенов, которое проходит через модель ради того же результата, — а это единственная величина, на которую вы действительно влияете.