Гайд по Claude · Що насправді відбувається, коли ви пишете Claude

Що насправді відбувається, коли ви пишете Claude

Версія: 26.08.2026

Модель не «читає ваше повідомлення». Вона щоразу отримує всю розмову з початку і дописує до неї наступний шматок. Кожен ваш новий рядок відправляється разом з усім попереднім.

З цього випливає майже все інше в цьому гайді.

Токен

Текст ріжеться на шматочки – токени. Документація дає орієнтир: один токен – це приблизно 4 символи або 0,75 англійського слова.

Для української точного числа немає. Кирилиця зазвичай дає більше токенів на те саме слово, ніж латиниця.

Токени рахуються двічі: те, що ви надіслали, і те, що модель написала у відповідь.

Контекстне вікно

Контекстне вікно – це робоча пам'ять однієї розмови. Документація каже так:

«Контекстне вікно – це весь текст, на який модель може спиратися, коли складає відповідь, включно з самою відповіддю».

Туди входить усе:

Розміри у поточних моделях:

МодельКонтекстне вікно
Fable 51 млн токенів
Opus 51 млн токенів
Sonnet 51 млн токенів
Haiku 4.5200 тис. токенів

Мільйон токенів – це приблизно 555 тисяч англійських слів. Багато. Але не безмежно.

Більше контексту не означає краще

Це не наша думка, це в документації прямим текстом:

«Більше контексту не є автоматично кращим. Зі зростанням кількості токенів точність і пригадування погіршуються – явище, відоме як context rot».

Далі там же: важливо не скільки місця є, а що саме ви туди поклали.

Практичний висновок. Чат на сорок повідомлень про п'ять різних тем працює гірше, ніж свіжий чат про одну тему. Не тому що система втомилася. Тому що потрібне тоне серед непотрібного.

Чому Claude не пам'ятає вчорашню розмову

Бо новий чат – це порожнє контекстне вікно. Нічого з минулого туди не потрапляє автоматично.

Є функція пам'яті, яка це частково змінює. Але вона працює інакше і має свої правила. Їй присвячена окрема сторінка.

Що буває, коли вікно закінчується

Два різні випадки, і їх плутають.

В API запит просто відхиляється з помилкою «prompt is too long».

У чаті поведінка м'якша. Документація зазначає, що чат-інтерфейси на кшталт claude.ai можуть керувати вікном за принципом «перший зайшов – перший вийшов». Тобто найстаріші повідомлення випадають.

А з увімкненим виконанням коду Claude сам стискає ранні повідомлення в підсумок. Розмова триває, але старі подробиці стають переказом, а не оригіналом. І це витрачає більше ліміту.

Що з цього робити вже сьогодні

  1. Нову тему – новий чат.
  2. Довгу розмову, яка почала «плисти», не рятуйте – переносьте суть у новий чат.
  3. Важливий документ давайте один раз, а не переказуйте його шматками.

Джерела

Про цей текст. Кожне твердження про Claude звірене з офіційною документацією: адреса і дата перевірки вказані в тексті. Моделі і тарифи змінюються швидко – якщо бачите розбіжність з тим, що на екрані, вірте екрану.