Сначала раздели работу, потом считай токены
У Claude Pro лимит — не только длина одного сообщения. Считай размер контекста, историю диалога, файлы и текущие правила тарифа. Перед публикацией сверяй их со справкой Anthropic.
Ошибка, которую я бы убрал сразу: Публиковать одно число как вечный лимит тарифа.
Что подготовить до проверки
- Разделение usage limit и context window.
- Версия исходников и список файлов в контексте.
- Один критерий приёмки для текущего шага.
- Checkpoint до того, как диалог станет слишком длинным.
- Резюме с открытыми вопросами для следующего чата.
- Дата проверки актуальных условий Claude Pro / Claude Code.
Разложи длинную работу на части
- Опиши задачу и исходники
Запиши, что должна сделать модель, какие файлы ей нужны и какой факт нельзя потерять. Для ревью кода хватит одного модуля, теста и ожидаемого поведения — не всего репозитория.
Что увидишь: Работу можно разделить на независимые части.
Если не сработало: Убери второстепенные файлы и оставь один вопрос, на который должен ответить текущий чат.
- Заведи журнал контекста
Рядом с результатом храни версию исходников, список добавленных файлов, решение и открытые вопросы. Новый чат получает состояние проекта, не пересказ наугад.
Сверь: Понятно, какая версия документа или кода была в контексте.
Если не сходится: Сохрани короткое резюме и ссылку на исходник, затем начни новый диалог.
- Поставь checkpoint
После отдельного этапа остановись и попроси краткое резюме: что сделано, что проверено, какие ограничения остались. Не жди, пока модель начнёт пропускать детали.
Что должно совпасть: Следующий чат может продолжить работу по резюме и исходникам.
Если ответ другой: Раздели задачу ещё на один уровень: анализ, правка и проверка должны идти отдельно.
- Сверь результат с исходником
Проверь пропущенные условия, ссылки на файлы и спорные выводы, не только длину ответа. Если ответ стал общим, вернись к исходному документу. Просьба «напиши длиннее» не чинит пропуск.
Перед запуском: Есть список ручных проверок до принятия результата.
Если упёрлось: Пометь сомнительные места и перенеси их в короткий новый запрос.
Журнал, который экономит повторную загрузку
В простом Markdown-файле достаточно пяти полей: задача, версия исходников, что уже проверено, открытые вопросы и следующий шаг. Для командной работы добавь имя проверяющего и дату.
Пример записи: `task: review-auth`, `source_version: 1.4.2`, `checked: login + timeout`, `open: refresh token`, `next: run tests`. Такой файл полезнее длинного пересказа диалога.
- Не храни в журнале токены и пароли.
- Ссылайся на версию файла, не на фразу «последний вариант».
task: review-auth
source_version: 1.4.2
files:
- src/auth.ts
- tests/auth.test.ts
checked:
- login
- timeout
open:
- refresh token
next: run tests
Когда сжатие начинает вредить
Сокращай повторяющиеся объяснения и старую переписку, но не удаляй ограничения, исключения и исходные значения. Если модель должна принять решение по договору или коду, оставь рядом фрагмент, на который она опирается.
Проверка: человек, который не видел старый чат, должен понять, откуда взялся вывод. Если это невозможно, резюме слишком короткое.
- Сохраняй спорные места отдельно.
- Не заменяй первичный документ одним итоговым ответом.
Usage limit и окно контекста
По help-центру Anthropic: usage limits — сколько ты можешь взаимодействовать с Claude за период; length limits / context window — глубина одного чата. На платных планах новые модели могут давать окно до 1M токенов, другие — 500K или 200K. Часть окна всегда резервируется под ответ.
Claude.ai, Claude Code и Claude Desktop делят один usage-бюджет. Сообщение «usage limit» и «conversation too long» — разные счётчики. Перед публикацией цифр открой support.claude.com (статьи How do usage and length limits work? и How large is the context window…) и запиши дату проверки.
- Не называй оценку гарантией.
- После обновления тарифа повтори короткий тест.
- Не копируй «~44k токенов за 5 часов» из блогов без сверки с Anthropic.
Практические приёмы до сброса лимита
Держи tools/connectors выключенными, пока они не нужны: web search, Research и MCP съедают и context, и usage. Для рутинных задач снижайте effort и отключай extended thinking.
Projects с RAG помогают не грузить весь корпус в чат. Короткий новый чат с резюме и исходником часто дешевле, чем продолжение раздутой истории.
- Один критерий приёмки на шаг.
- Сохраняй исходник рядом с резюме.
Таблица контекста
Запиши размер исходника, историю диалога, вложения и итоговый ответ в одной строке. Отметь, что можно сжать и что нельзя потерять.
Так видно, какой файл съедает окно — без повторных запросов вслепую.
- Храни исходники рядом с результатом.
- Проверяй лимит перед серией одинаковых задач.
Рабочая граница
Для длинного проекта задай checkpoint: после него новый чат получает короткое резюме и ссылки на исходные документы.
Если ответ начал пропускать детали, не проси писать длиннее. Вернись к источнику и раздели задачу.
- Не удаляй старый диалог до проверки результата.
- Не называй оценку лимита гарантией тарифа.
Что проверить перед публикацией
Открой актуальную справку Anthropic и зафиксируй дату проверки. Условия Pro и доступность функций могут меняться.
Отделяй наблюдение из теста от правила сервиса.
- Ставь дату рядом с факт-проверкой.
- Ссылайся на официальную справку.
Один чат, checkpoint или новый запуск
| Критерий | Вопрос | Хороший признак |
|---|---|---|
| Один чат | Когда подходит? | Короткая задача с небольшим числом файлов |
| Checkpoint | Что даёт? | Продолжение без повторной загрузки всей истории |
| Новый чат | Что перенести? | Резюме, версии исходников и список нерешённых вопросов |
| Точный лимит | Что проверить? | Актуальные условия тарифа, не цифру из старого поста |
Что должно получиться
Рабочий сценарий, который переживает длинный проект без потери исходных материалов.
Где расчёт лимита вводит в заблуждение
История, файлы и ответ тоже занимают контекст. Одного измерения текста недостаточно.
Окно контекста ограничивает один чат. Usage limit ограничивает, сколько ты можешь работать за период на всех поверхностях Claude.
Сжатый пересказ может потерять условие, на котором держится решение. Исходник должен оставаться доступным.
Если модель уже путает файлы и ограничения, ещё один длинный prompt редко исправляет ситуацию.
Anthropic не публикует стабильную «ровно N токенов Pro в месяц» как единую цифру для всех сценариев. Лимиты зависят от модели, длины сессии, инструментов и меняются.
Когда лучше остановиться и подключить специалиста
Подключи специалиста, если лимиты влияют на командный процесс, бюджет или автоматический API-маршрут.
Что перепроверить в справке Claude
Что считать контекстом Claude?
Сообщения, историю диалога, вложенные файлы и ответ в рамках текущей работы. Размер окна зависит от модели: на платных планах у новых моделей Anthropic указывает до 1M токенов, у других — 500K или 200K. Проверяй актуальный help-центр.
Чем usage limit отличается от length limit?
Usage limit — «бюджет общения» за период (Claude / Claude Code / Desktop). Length limit — сколько материала помещается в один чат. Это разные счётчики.
Когда открывать новый чат?
Когда закончился отдельный этап, изменился набор исходников или модель начала пропускать условия. Перед переходом сохрани резюме и версии файлов.
Можно ли оценить лимит заранее?
Можно оценить размер задачи и выбрать короткие сессии. Это не заменяет актуальные ограничения тарифа и фактическое поведение продукта. Смотри support.claude.com и usage в аккаунте.
Что делать, если ответ стал хуже?
Вернуться к исходнику, отделить спорный вопрос и прогнать его в коротком чате с явным критерием проверки.






