Автор Денис Гавриляк
Чому Claude Max так швидко закінчується — і як його розтягнути
Claude рахує токени, а не повідомлення — і кожне повідомлення надсилає всю вашу розмову заново. Чому довгі розмови дорожчають і які звички продовжують життя підписці Max.

Якщо коротко
- Claude рахує токени, а не повідомлення. Двоє людей можуть надіслати однакову кількість повідомлень, і в одного з них ліміт закінчиться значно раніше
- Кожне повідомлення надсилає всю розмову заново. Claude нічого не пам’ятає між повідомленнями, тож щоразу отримує всю розмову цілком. На п’ятдесятому повідомленні Claude знову перечитує всі сорок дев’ять попередніх
- Почати нову розмову — безкоштовно. Це найдієвіша звичка з усіх, і вона нічого вам не коштує
- Повернення після довгої перерви коштує дорожче. Claude тримає дешеву копію вашої розмови одну годину. Після цього наступне повідомлення платить повну ціну за все
- Anthropic не публікує, скільки саме дає Max. Офіційної кількості токенів чи повідомлень немає ні для якого тарифу. Хто називає вам цифру — вигадав її
Ми щодня створюємо продукти з Claude на підписках Max і впиралися в ці ліміти раніше, ніж зрозуміли, як вони працюють. Усе нижче взято з документації самої Anthropic, посилання — наприкінці. Звички — наші.
Чому Claude Max вичерпується так швидко?
Уявіть, що відповідаєте на лист і до кожної відповіді степлером прикріплюєте ксерокопію всього листування. Стос паперу щоразу товщає. А платите ви за кожну сторінку — навіть коли ваше нове повідомлення займає один рядок.
Саме так працює Claude. Він не пам’ятає вашу розмову між повідомленнями, тож уся вона надсилається знову щоразу, коли ви пишете. Ваші витрати залежать від того, наскільки довга розмова, а не від того, скільки ви попросили.
Кожна звичка нижче — це просто ще один спосіб тримати цей стос паперу тонким.
Що Anthropic насправді каже про ліміти
Почніть звідси, бо більшість порад на цю тему спирається на цифри, яких ніхто ніколи не публікував. Ось уся публічна картина.
Що задокументовано про тариф Max, а чого немає ніде. Порожні рядки — це і є висновок, а не те, що ми забули пошукати.
| Що хочуть знати | Що каже Anthropic | Де |
|---|---|---|
| Опубліковано | ||
| Ціна | $100/міс. за Max 5x, $200/міс. за Max 20x | What is the Max plan? — ціни для вебу; у магазинах застосунків вони інші |
| Як часто оновлюється | Ліміт, що «оновлюється кожні п’ять годин», плюс тижневий ліміт, який «діє для всіх моделей» | Та сама сторінка. Тижневий ліміт оновлюється у фіксований час, прив’язаний до вашого акаунта |
| Скільки ви отримуєте | Max 5x дає «уп’ятеро більше використання за сесію, ніж тариф Pro». Max 20x — «у 20 разів» | Та сама сторінка — і це вся відповідь, яку вони дають |
| Зміна, про яку варто знати | П’ятигодинні ліміти Claude Code подвоїли. Крім того, Pro і Max більше не отримують менших лімітів у години пік | Anthropic, 6 травня 2026. Якщо ви читали, що в години пік ліміт закінчується швидше, — це застаріла інформація |
| Не опубліковано ніде | ||
| Скільки токенів ви маєте на п’ять годин | цифру не опубліковано | Для Pro теж немає опублікованої цифри, тож «уп’ятеро більше за Pro» не перетворюється ні на що, що можна порахувати |
| Скільки — на тиждень | цифру не опубліковано | З тієї самої причини |
| Скільки витрачає кожна модель | цифру не опубліковано | Ліміти реальні — Claude повідомить, коли ви в один із них упретеся, — але пороги не задокументовано |
Корисно знати, коли впираєтеся в стіну. Якщо в повідомленні сказано, що вичерпано ліміт сесії або тижневий ліміт, зміна моделі не допоможе — цей ліміт спільний для всіх. Якщо ж названо конкретну модель, перехід на іншу дозволить працювати далі. Саме повідомлення підкаже, який випадок ваш.
Чотири речі, що спалюють ваш ліміт
Anthropic опублікувала їх за порядком впливу в серпні 2026 року, і цей порядок дивує більшість людей:
1. Наскільки довга розмова. 2. Скільки обмінів репліками знадобилося. 3. Яку модель ви обрали. 4. Наскільки старанно вона думає.
Майже всі починають із третього пункту — переходять на дешевшу модель. Він третій у списку не випадково.
Модель важить. Opus коштує в кілька разів більше за повідомлення, ніж Sonnet, а Sonnet — більше, ніж Haiku. Але дешева модель, що тягне за собою величезну розмову, обійдеться дорожче, ніж дорога модель у щойно розпочатій. Довжина перемагає.
Коли починати заново, а коли підсумовувати
Це рішення ви ухвалюєте найчастіше, і відповідь на нього зрозуміла. Claude дає два способи звільнити місце, і коштують вони зовсім по-різному.
Вводьте це в Claude Code. Обидві команди звільняють місце. Безкоштовна — лише одна.
/clear | /compact | |
|---|---|---|
| Що робить | Викидає розмову й починає з нуля | Замінює розмову коротким підсумком і продовжує |
| Скільки коштує | Нічого | Щоб підсумувати, Claude мусить прочитати всю розмову — тож це саме по собі велике повідомлення |
| Коли використовувати | Ви закінчили, і наступне завдання ніяк не пов’язане | Ви посеред роботи й вам потрібна нитка, але не кожна деталь |
Більшість тягнеться до /compact, коли насправді вже закінчила і їй потрібен /clear, — і платить за підсумок роботи, до якої ніхто не повернеться.
Якщо все ж хочете підсумувати, робіть це до того, як підете, а не після. Протягом тієї години підсумок коштує частку від очікуваного. Зробіть це наступного ранку — і Claude спочатку перечитає все за повною ціною.
Звички, що заощаджують найбільше
За тим, наскільки відчутна різниця. Перша група важить більше, ніж дві інші разом.
Усе тут задокументовано Anthropic. Якщо вони не публікують, скільки це заощаджує, ми так і пишемо, а не вгадуємо.
| Звичка | Чому це працює | Що відомо |
|---|---|---|
| Тримайте розмову короткою — це важить найбільше | ||
| Починайте нову розмову між завданнями | Залиште одну відкритою на весь день — і кожне повідомлення тягтиме за собою весь день | Нічого не коштує. Спершу введіть /rename, якщо хочете потім її знайти, і /resume, щоб до неї повернутися |
| Відправляйте великі пошуки деінде | Скажіть «використай субагента, щоб знайти X». Пошук відбувається в окремому просторі, а до вас повертається лише відповідь | У прикладі Anthropic пошук переглядає кілька файлів і повертає короткий підсумок — решта у вашу розмову не потрапляє |
| Вказуйте точний файл | Введіть @ і назву файлу, щоб указати його напряму — Claude відкриє саме цей файл, а не шукатиме | Заощаджує пошук і файли, які Claude відкрив би дорогою |
| Тримайте інструкції проєкту короткими | Файл CLAUDE.md у вашому проєкті завантажується в кожну розмову, навіть коли не має жодного стосунку до завдання | Anthropic радить не більше 200 рядків |
| Менше обмінів репліками — друге за важливістю | ||
| Нехай спершу спланує, а потім будує | Натисніть Shift+Tab, доки індикатор не покаже режим планування, — ця комбінація перемикає режими дозволів. Claude продумує підхід і показує його вам, перш ніж щось писати | Пояснення Anthropic: це запобігає «дорогій переробці, коли початковий напрям виявився хибним» |
| Просіть конкретне | «Покращ цей код» змушує Claude читати все. «Виправ кнопку входу на сторінці реєстрації» — ні | Опублікованої цифри немає — але це різниця між чотирма прочитаними файлами і сорока |
| Зупиняйте рано, а не сперечайтеся | Escape зупиняє миттєво. /rewind повертає до моменту, коли все ще йшло правильно | Кожен крок хибним шляхом — ще одне повідомлення, що тягне всю розмову, а виправлення коштує ще дорожче |
| Скажіть, як перевірити результат | Опишіть результат, який очікуєте, або вставте скриншот того, що пішло не так | Він помічає власні помилки «ще до того, як вам доведеться просити виправлень» |
| Модель і рівень зусиль — важливо, але в останню чергу | ||
| Обирайте модель на початку | Opus коштує в кілька разів більше за повідомлення, ніж Sonnet, а Sonnet — більше, ніж Haiku | Зміна посеред завдання змушує Claude перечитати всю розмову — кожна модель тримає власну копію |
| Знижуйте рівень зусиль для простих задач | Що старанніше думає, то дорожче, а потрібно це не завжди | Та сама пастка на більшості моделей: зміна посеред завдання починає розмову наново. Налаштуйте один раз |
Як побачити, куди насправді йде ліміт
Вгадувати не доведеться. Введіть у Claude Code:
/usage— показує, скільки тарифу ви вже використали і що його з’їло. Позначає все, на що припадає велика частка, — наприклад, розмову, яка надто розрослася. Натиснітьdабоw, щоб перемикатися між останньою добою й останнім тижнем/context— показує, що займає місце у вашій поточній розмові просто зараз. Запустіть у новій розмові, щоб помітити інструменти й інструкції, які ви тягаєте без потреби/insights— аналізує, як ви працювали останнім часом, і пише звіт про те, де виникає тертя. Варто запустити хоча б раз. Він теж витрачає частину ліміту
Одна річ, яка всіх плутає. /usage показує суму в доларах, і на Max це не рахунок. Anthropic пише прямо: у підписників «використання включене в підписку, тож сума вартості сесії не має значення для оплати». Сприймайте це як спідометр, а не рахунок — корисно, щоб бачити, які звички дорогі, а не гроші, які ви винні.
Що ми змінили у власній роботі
Чотири речі — у порядку, в якому вони дали відчутний результат:
- Нова розмова стала нормою. Раніше ми підсумовували наприкінці кожного завершеного завдання — платили за стискання роботи, до якої вже ніхто не заглядав. Тепер завершити щось означає почати нову розмову
- Великі пошуки відбуваються деінде. Будь-що на кшталт «переглянь усе й скажи, де це відбувається» ми делегуємо, тож сорок файлів ніколи не потрапляють в основну розмову. Ми отримуємо відповідь, а розмова лишається короткою
- Модель і рівень зусиль обираємо один раз, на початку. Це було найменш очевидним. Перехід на потужнішу модель «лише для цього складного шматка» непомітно змушував Claude перечитувати всю розмову
- Усе довге одразу записуємо у файл. Підсумок, що існує лише в розмові, зникає разом із нею, а відновлювати його дорого. Відкрити файл знову майже нічого не коштує
Ідеться не про те, щоб менше користуватися Claude. А про те, щоб не платити за ту саму розмову п’ятдесят разів. Якщо хочете, щоб досвідчені інженери робили це разом із вами на справжньому продукті, — саме цим є наш напрям MVP із ШІ на базі Claude.
Чи варто платити за Max 20x?
Спершу виправте звички. Вони нічого не коштують, і їхній ефект накопичується. Людина, яка починає нові розмови й тримає інструкції короткими, цілком може отримати від Max 5x більше, ніж людина на 20x, у якої одна розмова відкрита від сніданку до сну.
Переходьте на вищий тариф, якщо вже все це зробили, а ліміт і далі закінчується, — зазвичай коли ви ведете кілька розмов одночасно або працюєте довгими днями, і п’ять годин справді стають обмеженням. Є й проміжний варіант: кредити на використання (usage credits) дозволяють працювати понад ліміт і доплачувати за перевищення, з місячною межею, яку ви встановлюєте самі. Шукайте їх у Settings, у розділі Usage.
Є одна пастка, про яку варто знати. Щойно ви переходите на кредити, дешева копія розмови живе вже не годину, а п’ять хвилин, бо тепер за неї виставляють рахунок. Нічого не ламається — просто перерви коштують дорожче.
А якщо ліміт закінчився посеред завдання, свіжі версії Claude Code можуть дочекатися оновлення й продовжити з того самого місця. Перевірте це, перш ніж братися переробляти роботу вручну.
Якщо хочете заглибитися, ми писали про те, скільки насправді коштує вайбкодинг порівняно з наймом інженерів, і — бо цю частину зазвичай пропускають — про ризики безпеки застосунків, створених вайбкодингом. Якщо ви будуєте саме для iPhone чи Android, є Claude Code з Xcode і Claude Code з Android Studio.
Джерела
Кожна цифра вище взята з одного з цих джерел, усі переглянуто 15 вересня 2026 року. У кожній примітці сказано, що саме джерело доводить, а що — ні.
Документація Anthropic
- Claude Code — “Manage costs effectively”Джерело для звичок, причин, чому витрати ростуть у довгій розмові, того, що показує
/usage, і поради тримати інструкції проєкту до 200 рядків. Суми в доларах там — середні показники великих компаній, які платять за токени, а не цифри для підписок, тому тут ми їх не наводимо. - Claude Code — “How Claude Code uses prompt caching”Джерело для зниженої ціни перечитування, годинного терміну, того, що змушує Claude починати розмову наново, і чому підсумок дешевший протягом тієї години.
- Claude Code — “Subagents”Джерело для делегування великих пошуків, щоб у вашу розмову поверталася лише відповідь.
- Claude Code — “Explore the context window”Інтерактивна демонстрація того, як заповнюється розмова. Приклад пошуку, що повертає короткий підсумок, — звідси. Це ілюстративні цифри Anthropic для однієї прикладової сесії, а не вимірювання на вашому комп’ютері.
Сторінки тарифів
- Claude Help Center — “What is the Max plan?”Ціни, п’ятигодинне оновлення, тижневий ліміт і порівняння 5x/20x із Pro. Жодних цифр токенів чи повідомлень — тому ця стаття теж жодних не наводить.
- Claude Help Center — “What is the Pro plan?”Перевірено спеціально, щоб з’ясувати, чи є реальна цифра далі по ланцюжку. Pro описано як «щонайменше вп’ятеро більше використання за сесію порівняно з нашим безкоштовним сервісом» — ще одне кратне, під яким нічого немає. Від безкоштовного до Pro і від Pro до Max усе відносне.
- Anthropic — “Higher usage limits” (6 травня 2026)Подвоєння п’ятигодинних лімітів Claude Code і скасування зменшення лімітів у години пік для Pro і Max. Варто знати, бо чимало статей досі описують стару поведінку.
Написано командою, що створює Claude Code
- “Maximizing the value of your Claude Code sessions” (14 серпня 2026)Джерело для порядку чотирьох речей, що спалюють ліміт, і для підсумовування до перерви, а не після.
- “Lessons from building Claude Code: prompt caching is everything” (30 квітня 2026)Чому це важливо не лише вам, а й Anthropic: вони відстежують, як часто повторно використовується та сама дешева копія, і пишуть, що високий показник «допомагає нам робити ліміти на підписках щедрішими».
Чого ця стаття не стверджує
- Жодної кількості токенів чи повідомлень для жодного тарифу. Anthropic не публікує таких цифр ні для якого рівня.
- Жодного відсотка економії для жодної звички, якщо його не опублікувала Anthropic. Ми не проводили контрольованого тесту впродовж періоду тарифу, а коливання однієї людини від тижня до тижня все одно поглинули б результат.
- Жодних тверджень, що це назавжди. Claude Code часто змінюється, а ліміти вже змінювалися у 2026 році. Актуальна інформація — на сторінках за посиланнями; ця стаття — знімок станом на вересень 2026 року.
Схожі статті
- Чому iPhone закриває важкі застосунки першимиРозробка
- Claude Code і Xcode: робочий процес для iOS-інженерів у 2026 роціШІ та інструменти
- Claude Code і Android Studio: робочий процес для Kotlin-інженерів у 2026 роціШІ та інструменти
