Що насправді відбувається, коли ви пишете Claude
Версія: 26.08.2026
Модель не «читає ваше повідомлення». Вона щоразу отримує всю розмову з початку і дописує до неї наступний шматок. Кожен ваш новий рядок відправляється разом з усім попереднім.
З цього випливає майже все інше в цьому гайді.
Токен
Текст ріжеться на шматочки – токени. Документація дає орієнтир: один токен – це приблизно 4 символи або 0,75 англійського слова.
Для української точного числа немає. Кирилиця зазвичай дає більше токенів на те саме слово, ніж латиниця.
Токени рахуються двічі: те, що ви надіслали, і те, що модель написала у відповідь.
Контекстне вікно
Контекстне вікно – це робоча пам'ять однієї розмови. Документація каже так:
«Контекстне вікно – це весь текст, на який модель може спиратися, коли складає відповідь, включно з самою відповіддю».
Туди входить усе:
- ваші повідомлення;
- усі відповіді Claude;
- завантажені файли;
- зображення;
- інструкції, яких ви не бачите.
Розміри у поточних моделях:
| Модель | Контекстне вікно |
|---|---|
| Fable 5 | 1 млн токенів |
| Opus 5 | 1 млн токенів |
| Sonnet 5 | 1 млн токенів |
| Haiku 4.5 | 200 тис. токенів |
Мільйон токенів – це приблизно 555 тисяч англійських слів. Багато. Але не безмежно.
Більше контексту не означає краще
Це не наша думка, це в документації прямим текстом:
«Більше контексту не є автоматично кращим. Зі зростанням кількості токенів точність і пригадування погіршуються – явище, відоме як context rot».
Далі там же: важливо не скільки місця є, а що саме ви туди поклали.
Практичний висновок. Чат на сорок повідомлень про п'ять різних тем працює гірше, ніж свіжий чат про одну тему. Не тому що система втомилася. Тому що потрібне тоне серед непотрібного.
Чому Claude не пам'ятає вчорашню розмову
Бо новий чат – це порожнє контекстне вікно. Нічого з минулого туди не потрапляє автоматично.
Є функція пам'яті, яка це частково змінює. Але вона працює інакше і має свої правила. Їй присвячена окрема сторінка.
Що буває, коли вікно закінчується
Два різні випадки, і їх плутають.
В API запит просто відхиляється з помилкою «prompt is too long».
У чаті поведінка м'якша. Документація зазначає, що чат-інтерфейси на кшталт claude.ai можуть керувати вікном за принципом «перший зайшов – перший вийшов». Тобто найстаріші повідомлення випадають.
А з увімкненим виконанням коду Claude сам стискає ранні повідомлення в підсумок. Розмова триває, але старі подробиці стають переказом, а не оригіналом. І це витрачає більше ліміту.
Що з цього робити вже сьогодні
- Нову тему – новий чат.
- Довгу розмову, яка почала «плисти», не рятуйте – переносьте суть у новий чат.
- Важливий документ давайте один раз, а не переказуйте його шматками.
Джерела
- Контекстне вікно: platform.claude.com/docs/en/build-with-claude/context-windows – звірено 25.08.2026
- Розміри вікон і токенізатор: platform.claude.com/docs/en/about-claude/models/overview – звірено 25.08.2026
- Токен як 4 символи: platform.claude.com/docs/en/about-claude/pricing – звірено 25.08.2026
- Стиснення розмови в чаті: support.claude.com/en/articles/11647753 – оновлено 13.07.2026