Гайд по Claude · Чому довга розмова з'їдає ліміт швидше

Чому довга розмова з'їдає ліміт швидше

Версія: 26.08.2026

Бо кожне ваше повідомлення відправляє всю розмову заново. Десяте повідомлення в довгому чаті коштує дорожче за перше, хоча ви написали той самий рядок.

Це не покарання за балакучість. Це те, як влаштована робота моделі.

Два різні обмеження, які постійно плутають

Що обмежуєКоли впираєтесь
Ліміт використанняскільки повідомлень ви можете надіслати«зачекайте до скидання»
Довжина контекстускільки поміщається в одну розмову«розмова задовга»

Перше – про час і тариф. Друге – про одну конкретну розмову. Уперлися в друге – новий чат допоможе. Уперлися в перше – ні.

Що витрачає ліміт швидше

За документацією, на витрату впливають:

Тобто одне і те саме питання коштує по-різному залежно від того, як ви його поставили.

Ліміт один на всі поверхні

Пряма цитата з довідки: витрата на claude.ai, у Claude Code і в застосунку для комп'ютера рахується в один і той самий ліміт.

Якщо вранці ви щось довго робили в Claude Code, у чаті ввечері буде менше запасу.

Коли скидається

Ліміт сесії скидається кожні п'ять годин.

Тижневий ліміт теж є, і не тільки на Max. Перевірено на екрані акаунта Pro: там видно і п'ятигодинний ліміт, і тижневий по всіх моделях. Скидається він у фіксований час тижня, закріплений за акаунтом.

Що видно в Settings > Usage

Три смуги, і кожна означає своє.

СмугаЩо показує
Current sessionп'ятигодинний ліміт, з таймером до скидання
All modelsтижневий ліміт на все разом
Fableокремий тижневий ліміт саме для Fable

Третій рядок – несподіванка для більшості. У найпотужнішої моделі свій власний бюджет, окремий від решти.

На Pro це виглядає інакше: біля Fable 5 у перемикачі стоїть позначка «Requires usage credits».

Лічильник контексту просто в полі вводу

Найкорисніша дрібниця з усіх, і про неї не пишуть.

Натисніть на індикатор біля назви моделі внизу. Відкриється віконце:

Context window                        0
Plan usage limits · Pro
5-hour limit    Resets in 1 hr 41 min   32%
Weekly · all models  Resets Mon 10:00 PM  17%

Перший рядок – заповненість контексту цієї розмови. Тобто ви бачите наживо, наскільки розмова «набрякла».

Це прямо відповідає на питання «коли починати новий чат». Не за відчуттям, а за числом.

Свій залишок і лічильник видно в Settings > Usage і в цьому віконці.

Що реально економить

Це поради з довідки, не наші здогади.

Об'єднуйте питання. Три пов'язані питання в одному повідомленні коштують менше, ніж три повідомлення.

Кладіть постійні документи в проєкт. Цитата: вміст у проєктах кешується і не рахується проти ліміту при повторному використанні. Далі: щоразу, коли ви до нього звертаєтесь, рахуються тільки нові, не закешовані частини.

Це найсильніший важіль з усіх. Один документ у знаннях проєкту дешевший за той самий документ, прикріплений до кожного нового чату.

Знижуйте зусилля на простому. Рівні low і medium, за документацією, добре працюють на рутинних задачах і розтягують ліміт.

Не тримайте зайвого в розмові. Якщо тема змінилася – новий чат.

Чого робити не варто

Не просіть переказати попередню розмову «щоб не втратити». Переказ теж потрапляє в контекст і теж коштує.

Не вантажте документ «про запас». Файл на 200 сторінок займає місце, навіть якщо ви питаєте про один абзац.

Не вмикайте все підряд. Пошук, мислення і Research – корисні, але кожен додає роботи. Про них є окрема сторінка.

Наш власний випадок

У проєкті «Розумний Помічник» був прогін, де AI переписував базу знань у 58 сторінок тексту.

Рахунок сформував не написаний текст. Його сформувало перечитування контексту: 9,1 мільйона прочитаних з кешу токенів при мізерному обсязі написаного.

Висновок, який ми з цього зробили і яким користуємось: читати матеріал блоками, кожен рівно один раз, і не тримати в контексті те, що вже не потрібне.

Джерела

Про цей текст. Кожне твердження про Claude звірене з офіційною документацією: адреса і дата перевірки вказані в тексті. Моделі і тарифи змінюються швидко – якщо бачите розбіжність з тим, що на екрані, вірте екрану.