Расход Claude Code считается в двух окнах одновременно: пятичасовом, которое сбрасывается скользящим окном, и недельном, которое сбрасывается в фиксированное время, назначенное вашему аккаунту. Оба окна общие для всех продуктов Claude — переписка на claude.ai, десктоп-приложение и терминал тратят один и тот же счёт. Точных цифр (сколько сообщений, часов или токенов входит в тариф) Anthropic не публикует, поэтому единственный надёжный способ узнать свой остаток — команда /usage внутри CLI.
Какие лимиты бывают
Ограничений в Claude Code несколько, и они разной природы. Путать их дорого: от того, какой именно потолок вы задели, зависит, поможет ли смена модели или придётся ждать.
| Ограничение | Как устроено | Помогает ли /model |
|---|---|---|
| Окно сессии | Скользящее пятичасовое окно расхода на подписке | Нет: окно общее для всех моделей |
| Недельное окно | Недельный потолок, сбрасывается в фиксированное время, закреплённое за аккаунтом | Нет: окно общее для всех моделей |
| Лимит на Opus | Отдельный счётчик только на запросы к Opus | Да: на другой модели работа продолжается |
| Контекстное окно | Длина одного разговора, а не расход по тарифу | Не относится к лимитам использования |
Когда вы упираетесь в потолок, Claude Code показывает одно из трёх сообщений и называет время сброса:
You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pm
Первые два блокируют дальнейшие запросы до указанного времени. Третье — только запросы к Opus: команда /model переводит сессию на другую модель, и работа продолжается. Расход при этом идёт в оба окна сразу, поэтому один интенсивный вечер способен выбрать недельный запас раньше, чем закончится пятичасовое окно.
Лимиты общие с веб-версией Claude
Это самый частый источник недоумения: человек почти не работал в терминале, а лимит уже выбран. Формулировка справки Anthropic не оставляет места для трактовок — использование всех продуктовых поверхностей Claude (claude.ai, Claude Code, десктоп-приложение Claude) засчитывается в один и тот же лимит. Отдельного «пакета для терминала» не существует. Работа через расширения для VS Code, Cursor и продуктов JetBrains считается туда же.
Практическое следствие простое: длинное утро в чате уменьшает то, что останется на вечернюю сессию в терминале. Если вы держите Claude открытым как справочник и параллельно кодите — это один бюджет, а не два.
На тарифах Claude for Teams и Enterprise устройство то же самое: расход каждого участника идёт из его посадочной квоты, которая сбрасывается по скользящему пятичасовому и по недельному окну, а сама квота общая с чатом Claude и Cowork. Размер квоты зависит от типа места (Standard или Premium).
Сколько именно даётся
Здесь придётся написать неудобное: абсолютных цифр Anthropic не публикует. На 24 августа 2026 года в справочных статьях о тарифах Pro и Max нет ни количества сообщений, ни количества часов, ни объёма токенов на окно. Есть только относительные ориентиры:
- Pro — «не менее чем в пять раз больше использования за сессию по сравнению с бесплатным доступом»;
- Max 5x — в пять раз больше за сессию, чем Pro;
- Max 20x — в двадцать раз больше за сессию, чем Pro.
Anthropic дополнительно оговаривает, что может ограничивать использование и другими способами — недельными и месячными потолками, ограничениями по моделям и функциям — по своему усмотрению. То есть даже относительные ориентиры не являются обещанием.
Причина, по которой цифра в сообщениях была бы бессмысленной, названа в той же справке: расход зависит от длины и сложности разговора, использованных функций, выбранной модели и уровня усилий. Одно и то же «сообщение» может стоить и сотню токенов, и сотню тысяч. Поэтому любые числа вида «на Pro хватает N запросов», встречающиеся в обзорах, — это чужие замеры, а не публикация Anthropic. Сравнение самих тарифов и того, что в них входит, разобрано отдельно в статье про цену Claude Code.
Как посмотреть свой расход
Вместо угадывания есть четыре штатных способа.
Команда /usage
Основной инструмент. У подписчиков Pro, Max, Team и Enterprise она показывает полосы расхода по тарифу, статистику активности и разбивку: сколько потребления пришлось на навыки, сабагентов, плагины и отдельные MCP-серверы, каждый — в процентах от общего. Отдельно отмечаются поведенческие флаги — например, «длинный контекст» или «промахи кэша», — когда на одну из этих причин приходится 10 процентов расхода или больше. Клавиши d и w переключают окно между сутками и семью днями.
У блока Session в верхней части команды другое назначение: он считает токены и стоимость текущей сессии по прайс-листу и адресован тем, кто работает по API-ключу. Подписчикам эта сумма ничего не говорит о списаниях.
Страница расхода в аккаунте
Для подписки это Settings → Usage на claude.ai — там же живут дополнительные кредиты (usage credits) и месячный потолок трат по ним. Для работы по API авторитетный источник другой — страница Usage в Claude Console; локальная оценка стоимости в CLI считается по стандартным ставкам и не учитывает скидки и контрактные условия.
Строка состояния
Если хочется видеть остаток постоянно, настраиваемая строка состояния получает поля rate_limits.five_hour.used_percentage и rate_limits.seven_day.used_percentage (проценты от 0 до 100), а также resets_at — момент сброса каждого окна. Поля появляются только у подписчиков claude.ai и только после первого ответа API в сессии, поэтому скрипт должен корректно переживать их отсутствие.
Команда /context
Показывает, из чего сейчас состоит контекст: системный промпт, память, файлы CLAUDE.md, описания навыков, MCP-инструменты, прочитанные файлы. Это не про тариф, а про то, почему каждый следующий запрос стал дороже. Есть ещё /insights — отчёт о том, как вы работаете, по локальной истории сессий; учтите, что его собственный анализ тоже расходует токены.
Что съедает лимит быстрее всего
Ключевой механизм, который объясняет почти все неожиданные списания: Claude Code отправляет весь разговор с каждым запросом, и каждый шаг с инструментом — это ещё один запрос, несущий очередную порцию результатов. Однострочный вопрос в сессии, открытой с утра, всё равно тянет за собой всю накопленную историю.
- Длинный контекст. Кэширование промпта удешевляет повторную отправку истории, но не отменяет её. Чем длиннее сессия, тем дороже в ней любая мелочь.
- Промахи кэша. Первое сообщение после паузы, превышающей время жизни кэша, переобрабатывает весь контекст заново. На подписке это час; при работе на дополнительных кредитах и по API-ключу — пять минут по умолчанию.
- Чтение больших файлов целиком. В учебной симуляции из документации системный промпт занимает около 4200 токенов, файл CLAUDE.md проекта — 1800, а одно чтение исходника — от 1100 до 2400. Десяток файлов «на всякий случай» стоит дороже, чем сама правка.
- Параллельные агенты. Каждый работающий экземпляр держит собственное контекстное окно. Для командной работы агентов Anthropic называет ориентир: примерно в семь раз больше токенов, чем у обычной сессии, когда участники работают в режиме планирования. Несколько панелей с агентами в одном окне — например, в VibeeCode — это несколько независимых счётчиков, а не один. Что даёт и чего стоит такая схема, разобрано в статье про несколько ИИ-агентов одновременно.
- Сама компактизация. Команда
/compactчитает разговор, который сворачивает, поэтому компактизация большого контекста — сама по себе крупный запрос. Для чистого старта дешевле/clear: он не стоит ничего. - Фоновая активность. Запланированные задачи, сообщения из других ваших сессий и проверки хода фоновой работы стартуют новый ход и отправляют полный контекст даже тогда, когда вы к терминалу не подходили.
- Рассуждения. Расширенное мышление включено по умолчанию, его токены тарифицируются как выходные, и бюджет по умолчанию может составлять десятки тысяч токенов на запрос — в зависимости от модели.
Приёмы экономии
Что настроить один раз
- Модель под задачу. Sonnet справляется с большинством задач по коду и стоит дешевле Opus; Opus имеет смысл держать для сложных архитектурных решений. Для простых сабагентов в их описании указывается
model: haiku. Подробнее — в статье про модели Claude Code. - Уровень усилий. Команда
/effortуправляет глубиной рассуждений. По умолчанию на поддерживающих моделях стоитhigh; уровеньmediumдокументация прямо описывает как способ сократить расход токенов там, где можно поступиться частью качества рассуждений. - Лишние MCP-серверы. Описания инструментов по умолчанию загружаются отложенно, но неиспользуемые серверы всё равно стоит выключить через
/mcp, а посмотреть, кто занимает место, — через/context. Там, где есть обычная утилита командной строки, она дешевле по контексту, чем MCP-сервер. - Короткий CLAUDE.md. Файл загружается в контекст при старте каждой сессии, поэтому подробные инструкции под редкие сценарии лучше вынести в навыки, которые подгружаются по вызову. Ориентир документации — держать CLAUDE.md в пределах 200 строк.
- Хуки-фильтры. Хук может отфильтровать вывод перед тем, как его увидит модель: вместо десятитысячного лога в контекст попадут только строки с ошибками.
- Порог авто-компактизации. Команда
/autocompactс числом (например,/autocompact 500k) задаёт, насколько заполненным должно стать контекстное окно перед автоматической свёрткой; принимаются значения от 100K до 1M токенов, но не выше окна самой модели.
Что делать в каждой сессии
- Узкая задача вместо широкой. «Улучши этот проект» запускает сплошное сканирование; «добавь проверку ввода в функцию входа в auth.ts» позволяет обойтись минимумом чтений. Как формулировать такие задачи — в статье про промпты для вайбкодинга.
- Точные ссылки на файлы. Названный путь заменяет поиск по проекту и несколько чтений-кандидатов.
/clearмежду несвязанными задачами. Старый контекст не просто мешает — он оплачивается в каждом следующем сообщении. Перед очисткой удобно дать сессии имя через/rename, чтобы потом вернуться к ней через/resume./compactс указанием фокуса. Формулировка вида/compact focus on the auth bug fixоставляет в резюме то, что нужно вам, а не то, что автоматика сочла важным.- Объёмные операции — сабагенту. Прогон тестов, разбор логов, чтение документации можно отдать сабагенту: подробный вывод останется в его окне, а в основной разговор вернётся только сводка. В примере из документации сабагент читает три файла и возвращает около 420 токенов.
- Режим планирования и ранняя остановка. Shift+Tab переводит в режим планирования, где Claude сначала предлагает подход, а не переписывает половину проекта в неверном направлении. Если направление всё же не то — Escape останавливает работу сразу, а
/rewindвозвращает к предыдущей контрольной точке. Переделка стоит дороже, чем пауза.
Лимит упёрся: что делать
Порядок действий зависит от того, какое из трёх сообщений вы увидели.
- Прочитать время сброса. Оно указано прямо в сообщении. Команда
/usageпокажет оба окна и когда каждое обнулится. - Если это лимит Opus — выполнить
/modelи выбрать другую модель. Сессия продолжится. - Если это окно сессии или недельное — смена модели не поможет, окна общие для всех моделей. В десктоп-приложении на карточке лимита во вкладке Code есть флажок автоматического продолжения после сброса.
- Дополнительные кредиты. Команда
/usage-creditsоткрывает страницу управления ими у подписчиков Pro и Max; участникам Team и Enterprise без прав на биллинг она отправляет запрос администраторам. При работе на кредитах время жизни кэша падает с часа до пяти минут, то есть расход при том же стиле работы вырастет; вернуть часовой кэш можно переменной окруженияENABLE_PROMPT_CACHING_1H=1. - Использовать паузу. Пока окно не сбросилось, полезно подготовить следующую задачу текстом: точные пути к файлам, критерий готовности, команда проверки. Такая сессия окажется в разы короче импровизации.
Чек-лист экономии
- Помнить, что чат на claude.ai и терминал тратят один счёт.
- Раз в день смотреть
/usage, а не гадать по ощущениям. - Вывести проценты обоих окон в строку состояния, чтобы не упираться внезапно.
/clearпри переходе к несвязанной задаче — вместо бесконечной сессии./compactс указанием фокуса, когда историю всё-таки надо сохранить.- Давать точные пути к файлам вместо просьбы «разберись в проекте».
- Держать Sonnet моделью по умолчанию, Opus включать под конкретную задачу.
- Снижать уровень усилий на простой работе.
- Выключить MCP-серверы, которыми сейчас не пользуетесь, и проверить
/context. - Сократить CLAUDE.md, вынеся редкие инструкции в навыки.
- Объёмное чтение и прогон тестов отдавать сабагенту.
- Запускать параллельных агентов осознанно: каждый — отдельный счётчик.
- Останавливать неверное направление сразу, не дожидаясь конца ответа.
Ни один из этих приёмов не увеличивает квоту. Все они уменьшают количество токенов, которое проходит через модель ради того же результата, — а это единственная величина, на которую вы действительно влияете.