Лимиты Claude: 9 привычек, чтобы не упираться в них к среде

Claude считает не количество сообщений, а объём текста, который уходит в модель с каждым запросом. В длинном чате это весь диалог целиком, на каждом ходу. Поэтому лимит кончается не от того, что вы много спрашиваете, а от того, что каждый вопрос тащит за собой всю историю. Лечится это не отказом от работы, а девятью привычками, каждая из которых занимает меньше минуты.

Почему лимит кончается: токены вместо сообщений

Нейросеть читает текст кусочками — токенами. Когда вы отправляете сообщение в чат, модель получает не только его, но и всё, что было выше: ваши вопросы, свои ответы, загруженные файлы. Это и есть контекст. Первое сообщение стоит сотни токенов, тридцатое в том же чате — десятки тысяч. Внешне вы нажали «отправить» одинаково, а списалось в сотню раз больше.

Отсюда главный вывод: экономить нужно не количество вопросов, а то, что едет вместе с каждым вопросом.

Девять привычек

1. Выбирайте модель под задачу

Haiku — на быстрые ответы и простые правки. Sonnet — на ежедневную работу. Opus и Fable — только когда у задачи много деталей и цена ошибки высокая. Старшие модели расходуют лимит заметно быстрее, и гонять их на «переформулируй абзац» — самая частая причина пустого лимита. Подробно — в статье какую модель Claude выбрать.

2. Правьте сообщение, а не пишите новое

Получили плохой ответ — нажмите на карандаш у своего сообщения и отредактируйте его. Новое сообщение под плохим ответом оставит в контексте и неудачный вопрос, и неудачный ответ, и они будут ехать дальше на каждом ходу.

3. Новый чат каждые 15 сообщений

Когда диалог разросся, попросите итог и перенесите его в новый чат:

Сведи наш разговор в пять строк: задача, что уже решили,
какие данные важны, что осталось сделать, в каком формате
нужен результат. Я вставлю это в новый чат.

Это самая выгодная привычка из девяти: новый чат с итогом в пять строк стоит копейки против продолжения старого.

4. Собирайте просьбы в одно сообщение

Три вопроса тремя сообщениями — это три прохода по всему контексту. Те же три вопроса одним сообщением — один проход. Пишите списком: «сделай А, потом Б, потом проверь В».

5. Выключайте лишнее

Поиск в интернете, подключённые сервисы и инструменты добавляют в каждый запрос свои описания и результаты. Если в этом чате поиск не нужен — выключите его. Если нужна одна конкретная страница, дайте ссылку на неё: чтение одной страницы стоит её объёма, а поиск по сети — объёма всех найденных страниц.

6. Разложите работу по дню

Лимит восстанавливается окнами по времени, пока вы не работаете. Три коротких подхода — утром, днём и вечером — дают больше, чем один марафон до упора. Тяжёлые задачи ставьте на начало окна.

7. Настройте память

Если вы в каждом чате пересказываете, кто вы и чем занимаетесь, — это лишние токены каждый раз. Запишите это один раз в настройках: Claude будет знать ваш контекст без пересказа.

8. Кладите файлы в проект

Проекты в Claude хранят файлы и инструкции для всех чатов внутри. Загрузите бриф, прайс или регламент один раз в проект вместо того, чтобы вставлять его в каждый новый чат. Документы проекта Claude подгружает умнее, чем текст, вставленный в сообщение.

9. Напишите постоянные инструкции

В Claude Code это файл CLAUDE.md в папке проекта, в приложении — раздел инструкций в настройках или в проекте. Одна страница правил («отвечай кратко», «без вступлений», «таблицей, если сравнение») сокращает каждый ответ и избавляет от переспрашиваний.

Что даёт больше всего

Привычка Сколько времени Эффект
Новый чат с итогом 1 минута самый большой
Правильная модель 5 секунд большой
Правка вместо нового сообщения 5 секунд средний
Файлы в проект 2 минуты один раз средний, растёт со временем
Постоянные инструкции 10 минут один раз средний, растёт со временем

Если внедрять по одной, начните с первых двух строк таблицы.

Где ИИ ошибается

Итог чата теряет детали. Когда модель сворачивает длинный разговор в пять строк, мелкие договорённости могут выпасть. Перечитайте итог перед переносом и допишите то, что важно именно вам.

Младшая модель на сложной задаче. Экономия на модели оборачивается переделками: Haiku быстро даст ответ, но на задаче с десятью условиями пропустит три. Две переделки съедят больше, чем один запрос к старшей модели.

Память помнит устаревшее. Если вы сменили работу или проект, а в памяти осталось старое, Claude будет подстраиваться под прошлое. Раз в месяц открывайте память и чистите.

Что дальше

Если хочется разобраться глубже, как устроен расход, прочитайте что такое токен и что такое контекст нейросети. Все официальные материалы Anthropic по промптам собраны в статье 17 руководств по Claude.

Частые вопросы

Почему лимит Claude кончается так быстро?

Потому что с каждым сообщением модель заново читает весь диалог. Двадцатое сообщение в длинном чате стоит в разы дороже первого, хотя выглядит таким же коротким.

Поможет ли платная подписка?

Подписка поднимает потолок, но не меняет механику. Если держать один чат на сто сообщений, упрётесь и на дорогом тарифе. Привычки из статьи работают на любом плане.

Как долго восстанавливается лимит?

Лимит устроен окнами по времени: израсходованное постепенно возвращается, пока вы не работаете. Точные цифры Anthropic меняет, актуальные — в справке Claude.

Нужно внедрить ИИ в компанию?

Аудит процессов, практикум с командой на её данных, регламенты. От 10 до 30 участников.

Обсудить задачи компании →
Ярослав Сажнев
Ярослав Сажнев — преподаватель ИИ в РАНХиГС, внедрение ИИ в компании. Подробнее об авторе