Лимиты Claude: 9 привычек, чтобы не упираться в них к среде
Claude считает не количество сообщений, а объём текста, который уходит в модель с каждым запросом. В длинном чате это весь диалог целиком, на каждом ходу. Поэтому лимит кончается не от того, что вы много спрашиваете, а от того, что каждый вопрос тащит за собой всю историю. Лечится это не отказом от работы, а девятью привычками, каждая из которых занимает меньше минуты.
Почему лимит кончается: токены вместо сообщений
Нейросеть читает текст кусочками — токенами. Когда вы отправляете сообщение в чат, модель получает не только его, но и всё, что было выше: ваши вопросы, свои ответы, загруженные файлы. Это и есть контекст. Первое сообщение стоит сотни токенов, тридцатое в том же чате — десятки тысяч. Внешне вы нажали «отправить» одинаково, а списалось в сотню раз больше.
Отсюда главный вывод: экономить нужно не количество вопросов, а то, что едет вместе с каждым вопросом.
Девять привычек
1. Выбирайте модель под задачу
Haiku — на быстрые ответы и простые правки. Sonnet — на ежедневную работу. Opus и Fable — только когда у задачи много деталей и цена ошибки высокая. Старшие модели расходуют лимит заметно быстрее, и гонять их на «переформулируй абзац» — самая частая причина пустого лимита. Подробно — в статье какую модель Claude выбрать.
2. Правьте сообщение, а не пишите новое
Получили плохой ответ — нажмите на карандаш у своего сообщения и отредактируйте его. Новое сообщение под плохим ответом оставит в контексте и неудачный вопрос, и неудачный ответ, и они будут ехать дальше на каждом ходу.
3. Новый чат каждые 15 сообщений
Когда диалог разросся, попросите итог и перенесите его в новый чат:
Сведи наш разговор в пять строк: задача, что уже решили,
какие данные важны, что осталось сделать, в каком формате
нужен результат. Я вставлю это в новый чат.
Это самая выгодная привычка из девяти: новый чат с итогом в пять строк стоит копейки против продолжения старого.
4. Собирайте просьбы в одно сообщение
Три вопроса тремя сообщениями — это три прохода по всему контексту. Те же три вопроса одним сообщением — один проход. Пишите списком: «сделай А, потом Б, потом проверь В».
5. Выключайте лишнее
Поиск в интернете, подключённые сервисы и инструменты добавляют в каждый запрос свои описания и результаты. Если в этом чате поиск не нужен — выключите его. Если нужна одна конкретная страница, дайте ссылку на неё: чтение одной страницы стоит её объёма, а поиск по сети — объёма всех найденных страниц.
6. Разложите работу по дню
Лимит восстанавливается окнами по времени, пока вы не работаете. Три коротких подхода — утром, днём и вечером — дают больше, чем один марафон до упора. Тяжёлые задачи ставьте на начало окна.
7. Настройте память
Если вы в каждом чате пересказываете, кто вы и чем занимаетесь, — это лишние токены каждый раз. Запишите это один раз в настройках: Claude будет знать ваш контекст без пересказа.
8. Кладите файлы в проект
Проекты в Claude хранят файлы и инструкции для всех чатов внутри. Загрузите бриф, прайс или регламент один раз в проект вместо того, чтобы вставлять его в каждый новый чат. Документы проекта Claude подгружает умнее, чем текст, вставленный в сообщение.
9. Напишите постоянные инструкции
В Claude Code это файл CLAUDE.md в папке проекта, в приложении — раздел инструкций в настройках или в проекте. Одна страница правил («отвечай кратко», «без вступлений», «таблицей, если сравнение») сокращает каждый ответ и избавляет от переспрашиваний.
Что даёт больше всего
| Привычка | Сколько времени | Эффект |
|---|---|---|
| Новый чат с итогом | 1 минута | самый большой |
| Правильная модель | 5 секунд | большой |
| Правка вместо нового сообщения | 5 секунд | средний |
| Файлы в проект | 2 минуты один раз | средний, растёт со временем |
| Постоянные инструкции | 10 минут один раз | средний, растёт со временем |
Если внедрять по одной, начните с первых двух строк таблицы.
Где ИИ ошибается
Итог чата теряет детали. Когда модель сворачивает длинный разговор в пять строк, мелкие договорённости могут выпасть. Перечитайте итог перед переносом и допишите то, что важно именно вам.
Младшая модель на сложной задаче. Экономия на модели оборачивается переделками: Haiku быстро даст ответ, но на задаче с десятью условиями пропустит три. Две переделки съедят больше, чем один запрос к старшей модели.
Память помнит устаревшее. Если вы сменили работу или проект, а в памяти осталось старое, Claude будет подстраиваться под прошлое. Раз в месяц открывайте память и чистите.
Что дальше
Если хочется разобраться глубже, как устроен расход, прочитайте что такое токен и что такое контекст нейросети. Все официальные материалы Anthropic по промптам собраны в статье 17 руководств по Claude.
Частые вопросы
Почему лимит Claude кончается так быстро?
Потому что с каждым сообщением модель заново читает весь диалог. Двадцатое сообщение в длинном чате стоит в разы дороже первого, хотя выглядит таким же коротким.
Поможет ли платная подписка?
Подписка поднимает потолок, но не меняет механику. Если держать один чат на сто сообщений, упрётесь и на дорогом тарифе. Привычки из статьи работают на любом плане.
Как долго восстанавливается лимит?
Лимит устроен окнами по времени: израсходованное постепенно возвращается, пока вы не работаете. Точные цифры Anthropic меняет, актуальные — в справке Claude.
Аудит процессов, практикум с командой на её данных, регламенты. От 10 до 30 участников.
Обсудить задачи компании →