Перейти до вмісту
← Блог
Розробка

Автор Денис Гавриляк

Чому Claude Max так швидко закінчується — і як його розтягнути

Claude рахує токени, а не повідомлення — і кожне повідомлення надсилає всю вашу розмову заново. Чому довгі розмови дорожчають і які звички продовжують життя підписці Max.

Чому Claude Max так швидко закінчується — і як його розтягнути

Якщо коротко

  • Claude рахує токени, а не повідомлення. Двоє людей можуть надіслати однакову кількість повідомлень, і в одного з них ліміт закінчиться значно раніше
  • Кожне повідомлення надсилає всю розмову заново. Claude нічого не пам’ятає між повідомленнями, тож щоразу отримує всю розмову цілком. На п’ятдесятому повідомленні Claude знову перечитує всі сорок дев’ять попередніх
  • Почати нову розмову — безкоштовно. Це найдієвіша звичка з усіх, і вона нічого вам не коштує
  • Повернення після довгої перерви коштує дорожче. Claude тримає дешеву копію вашої розмови одну годину. Після цього наступне повідомлення платить повну ціну за все
  • Anthropic не публікує, скільки саме дає Max. Офіційної кількості токенів чи повідомлень немає ні для якого тарифу. Хто називає вам цифру — вигадав її

Ми щодня створюємо продукти з Claude на підписках Max і впиралися в ці ліміти раніше, ніж зрозуміли, як вони працюють. Усе нижче взято з документації самої Anthropic, посилання — наприкінці. Звички — наші.

Чому Claude Max вичерпується так швидко?

Уявіть, що відповідаєте на лист і до кожної відповіді степлером прикріплюєте ксерокопію всього листування. Стос паперу щоразу товщає. А платите ви за кожну сторінку — навіть коли ваше нове повідомлення займає один рядок.

Саме так працює Claude. Він не пам’ятає вашу розмову між повідомленнями, тож уся вона надсилається знову щоразу, коли ви пишете. Ваші витрати залежать від того, наскільки довга розмова, а не від того, скільки ви попросили.

Кожна звичка нижче — це просто ще один спосіб тримати цей стос паперу тонким.

НічогоСкільки коштує почати нову розмовуДокументація Claude Code, переглянуто 15 вересня 2026: «Коли вам потрібен чистий аркуш, а не продовження, /clear нічого не коштує».
~10%Скільки коштує перечитати розмову протягом тієї годиниДокументація Claude Code про кешування промптів. Перечитана історія «тарифікується приблизно за 10% від стандартної ціни вхідних токенів». Значно дешевше — але не безкоштовно, і це стосується всієї розмови щоразу.
1 годинаСкільки можна відійти, поки це не стане дорогимДокументація Claude Code про кешування промптів. На підписці дешева копія живе годину. Після цього наступне повідомлення перечитує все за повною ціною.
Жодної цифриЩо Anthropic публікує про те, скільки дає MaxПеревірено на сторінках тарифів Max і Pro, 15 вересня 2026. Кожен платний тариф описано лише як кратне від нижчого.

Що Anthropic насправді каже про ліміти

Почніть звідси, бо більшість порад на цю тему спирається на цифри, яких ніхто ніколи не публікував. Ось уся публічна картина.

Що задокументовано про тариф Max, а чого немає ніде. Порожні рядки — це і є висновок, а не те, що ми забули пошукати.

Що хочуть знатиЩо каже AnthropicДе
Опубліковано
Ціна$100/міс. за Max 5x, $200/міс. за Max 20xWhat is the Max plan? — ціни для вебу; у магазинах застосунків вони інші
Як часто оновлюєтьсяЛіміт, що «оновлюється кожні п’ять годин», плюс тижневий ліміт, який «діє для всіх моделей»Та сама сторінка. Тижневий ліміт оновлюється у фіксований час, прив’язаний до вашого акаунта
Скільки ви отримуєтеMax 5x дає «уп’ятеро більше використання за сесію, ніж тариф Pro». Max 20x — «у 20 разів»Та сама сторінка — і це вся відповідь, яку вони дають
Зміна, про яку варто знатиП’ятигодинні ліміти Claude Code подвоїли. Крім того, Pro і Max більше не отримують менших лімітів у години пікAnthropic, 6 травня 2026. Якщо ви читали, що в години пік ліміт закінчується швидше, — це застаріла інформація
Не опубліковано ніде
Скільки токенів ви маєте на п’ять годинцифру не опублікованоДля Pro теж немає опублікованої цифри, тож «уп’ятеро більше за Pro» не перетворюється ні на що, що можна порахувати
Скільки — на тижденьцифру не опублікованоЗ тієї самої причини
Скільки витрачає кожна модельцифру не опублікованоЛіміти реальні — Claude повідомить, коли ви в один із них упретеся, — але пороги не задокументовано

Корисно знати, коли впираєтеся в стіну. Якщо в повідомленні сказано, що вичерпано ліміт сесії або тижневий ліміт, зміна моделі не допоможе — цей ліміт спільний для всіх. Якщо ж названо конкретну модель, перехід на іншу дозволить працювати далі. Саме повідомлення підкаже, який випадок ваш.

Чотири речі, що спалюють ваш ліміт

Anthropic опублікувала їх за порядком впливу в серпні 2026 року, і цей порядок дивує більшість людей:

1. Наскільки довга розмова. 2. Скільки обмінів репліками знадобилося. 3. Яку модель ви обрали. 4. Наскільки старанно вона думає.

Майже всі починають із третього пункту — переходять на дешевшу модель. Він третій у списку не випадково.

Модель важить. Opus коштує в кілька разів більше за повідомлення, ніж Sonnet, а Sonnet — більше, ніж Haiku. Але дешева модель, що тягне за собою величезну розмову, обійдеться дорожче, ніж дорога модель у щойно розпочатій. Довжина перемагає.

Коли починати заново, а коли підсумовувати

Це рішення ви ухвалюєте найчастіше, і відповідь на нього зрозуміла. Claude дає два способи звільнити місце, і коштують вони зовсім по-різному.

Вводьте це в Claude Code. Обидві команди звільняють місце. Безкоштовна — лише одна.

/clear/compact
Що робитьВикидає розмову й починає з нуляЗамінює розмову коротким підсумком і продовжує
Скільки коштуєНічогоЩоб підсумувати, Claude мусить прочитати всю розмову — тож це саме по собі велике повідомлення
Коли використовуватиВи закінчили, і наступне завдання ніяк не пов’язанеВи посеред роботи й вам потрібна нитка, але не кожна деталь

Більшість тягнеться до /compact, коли насправді вже закінчила і їй потрібен /clear, — і платить за підсумок роботи, до якої ніхто не повернеться.

Якщо все ж хочете підсумувати, робіть це до того, як підете, а не після. Протягом тієї години підсумок коштує частку від очікуваного. Зробіть це наступного ранку — і Claude спочатку перечитає все за повною ціною.

Звички, що заощаджують найбільше

За тим, наскільки відчутна різниця. Перша група важить більше, ніж дві інші разом.

Усе тут задокументовано Anthropic. Якщо вони не публікують, скільки це заощаджує, ми так і пишемо, а не вгадуємо.

ЗвичкаЧому це працюєЩо відомо
Тримайте розмову короткою — це важить найбільше
Починайте нову розмову між завданнямиЗалиште одну відкритою на весь день — і кожне повідомлення тягтиме за собою весь деньНічого не коштує. Спершу введіть /rename, якщо хочете потім її знайти, і /resume, щоб до неї повернутися
Відправляйте великі пошуки деіндеСкажіть «використай субагента, щоб знайти X». Пошук відбувається в окремому просторі, а до вас повертається лише відповідьУ прикладі Anthropic пошук переглядає кілька файлів і повертає короткий підсумок — решта у вашу розмову не потрапляє
Вказуйте точний файлВведіть @ і назву файлу, щоб указати його напряму — Claude відкриє саме цей файл, а не шукатимеЗаощаджує пошук і файли, які Claude відкрив би дорогою
Тримайте інструкції проєкту короткимиФайл CLAUDE.md у вашому проєкті завантажується в кожну розмову, навіть коли не має жодного стосунку до завданняAnthropic радить не більше 200 рядків
Менше обмінів репліками — друге за важливістю
Нехай спершу спланує, а потім будуєНатисніть Shift+Tab, доки індикатор не покаже режим планування, — ця комбінація перемикає режими дозволів. Claude продумує підхід і показує його вам, перш ніж щось писатиПояснення Anthropic: це запобігає «дорогій переробці, коли початковий напрям виявився хибним»
Просіть конкретне«Покращ цей код» змушує Claude читати все. «Виправ кнопку входу на сторінці реєстрації» — ніОпублікованої цифри немає — але це різниця між чотирма прочитаними файлами і сорока
Зупиняйте рано, а не сперечайтесяEscape зупиняє миттєво. /rewind повертає до моменту, коли все ще йшло правильноКожен крок хибним шляхом — ще одне повідомлення, що тягне всю розмову, а виправлення коштує ще дорожче
Скажіть, як перевірити результатОпишіть результат, який очікуєте, або вставте скриншот того, що пішло не такВін помічає власні помилки «ще до того, як вам доведеться просити виправлень»
Модель і рівень зусиль — важливо, але в останню чергу
Обирайте модель на початкуOpus коштує в кілька разів більше за повідомлення, ніж Sonnet, а Sonnet — більше, ніж HaikuЗміна посеред завдання змушує Claude перечитати всю розмову — кожна модель тримає власну копію
Знижуйте рівень зусиль для простих задачЩо старанніше думає, то дорожче, а потрібно це не завждиТа сама пастка на більшості моделей: зміна посеред завдання починає розмову наново. Налаштуйте один раз

Як побачити, куди насправді йде ліміт

Вгадувати не доведеться. Введіть у Claude Code:

  • /usage — показує, скільки тарифу ви вже використали і що його з’їло. Позначає все, на що припадає велика частка, — наприклад, розмову, яка надто розрослася. Натисніть d або w, щоб перемикатися між останньою добою й останнім тижнем
  • /context — показує, що займає місце у вашій поточній розмові просто зараз. Запустіть у новій розмові, щоб помітити інструменти й інструкції, які ви тягаєте без потреби
  • /insights — аналізує, як ви працювали останнім часом, і пише звіт про те, де виникає тертя. Варто запустити хоча б раз. Він теж витрачає частину ліміту

Одна річ, яка всіх плутає. /usage показує суму в доларах, і на Max це не рахунок. Anthropic пише прямо: у підписників «використання включене в підписку, тож сума вартості сесії не має значення для оплати». Сприймайте це як спідометр, а не рахунок — корисно, щоб бачити, які звички дорогі, а не гроші, які ви винні.

Що ми змінили у власній роботі

Чотири речі — у порядку, в якому вони дали відчутний результат:

  1. Нова розмова стала нормою. Раніше ми підсумовували наприкінці кожного завершеного завдання — платили за стискання роботи, до якої вже ніхто не заглядав. Тепер завершити щось означає почати нову розмову
  2. Великі пошуки відбуваються деінде. Будь-що на кшталт «переглянь усе й скажи, де це відбувається» ми делегуємо, тож сорок файлів ніколи не потрапляють в основну розмову. Ми отримуємо відповідь, а розмова лишається короткою
  3. Модель і рівень зусиль обираємо один раз, на початку. Це було найменш очевидним. Перехід на потужнішу модель «лише для цього складного шматка» непомітно змушував Claude перечитувати всю розмову
  4. Усе довге одразу записуємо у файл. Підсумок, що існує лише в розмові, зникає разом із нею, а відновлювати його дорого. Відкрити файл знову майже нічого не коштує

Ідеться не про те, щоб менше користуватися Claude. А про те, щоб не платити за ту саму розмову п’ятдесят разів. Якщо хочете, щоб досвідчені інженери робили це разом із вами на справжньому продукті, — саме цим є наш напрям MVP із ШІ на базі Claude.

Чи варто платити за Max 20x?

Спершу виправте звички. Вони нічого не коштують, і їхній ефект накопичується. Людина, яка починає нові розмови й тримає інструкції короткими, цілком може отримати від Max 5x більше, ніж людина на 20x, у якої одна розмова відкрита від сніданку до сну.

Переходьте на вищий тариф, якщо вже все це зробили, а ліміт і далі закінчується, — зазвичай коли ви ведете кілька розмов одночасно або працюєте довгими днями, і п’ять годин справді стають обмеженням. Є й проміжний варіант: кредити на використання (usage credits) дозволяють працювати понад ліміт і доплачувати за перевищення, з місячною межею, яку ви встановлюєте самі. Шукайте їх у Settings, у розділі Usage.

Є одна пастка, про яку варто знати. Щойно ви переходите на кредити, дешева копія розмови живе вже не годину, а п’ять хвилин, бо тепер за неї виставляють рахунок. Нічого не ламається — просто перерви коштують дорожче.

А якщо ліміт закінчився посеред завдання, свіжі версії Claude Code можуть дочекатися оновлення й продовжити з того самого місця. Перевірте це, перш ніж братися переробляти роботу вручну.

Якщо хочете заглибитися, ми писали про те, скільки насправді коштує вайбкодинг порівняно з наймом інженерів, і — бо цю частину зазвичай пропускають — про ризики безпеки застосунків, створених вайбкодингом. Якщо ви будуєте саме для iPhone чи Android, є Claude Code з Xcode і Claude Code з Android Studio.

Джерела

Кожна цифра вище взята з одного з цих джерел, усі переглянуто 15 вересня 2026 року. У кожній примітці сказано, що саме джерело доводить, а що — ні.

Документація Anthropic

  1. Claude Code — “Manage costs effectively”Джерело для звичок, причин, чому витрати ростуть у довгій розмові, того, що показує /usage, і поради тримати інструкції проєкту до 200 рядків. Суми в доларах там — середні показники великих компаній, які платять за токени, а не цифри для підписок, тому тут ми їх не наводимо.
  2. Claude Code — “How Claude Code uses prompt caching”Джерело для зниженої ціни перечитування, годинного терміну, того, що змушує Claude починати розмову наново, і чому підсумок дешевший протягом тієї години.
  3. Claude Code — “Subagents”Джерело для делегування великих пошуків, щоб у вашу розмову поверталася лише відповідь.
  4. Claude Code — “Explore the context window”Інтерактивна демонстрація того, як заповнюється розмова. Приклад пошуку, що повертає короткий підсумок, — звідси. Це ілюстративні цифри Anthropic для однієї прикладової сесії, а не вимірювання на вашому комп’ютері.

Сторінки тарифів

  1. Claude Help Center — “What is the Max plan?”Ціни, п’ятигодинне оновлення, тижневий ліміт і порівняння 5x/20x із Pro. Жодних цифр токенів чи повідомлень — тому ця стаття теж жодних не наводить.
  2. Claude Help Center — “What is the Pro plan?”Перевірено спеціально, щоб з’ясувати, чи є реальна цифра далі по ланцюжку. Pro описано як «щонайменше вп’ятеро більше використання за сесію порівняно з нашим безкоштовним сервісом» — ще одне кратне, під яким нічого немає. Від безкоштовного до Pro і від Pro до Max усе відносне.
  3. Anthropic — “Higher usage limits” (6 травня 2026)Подвоєння п’ятигодинних лімітів Claude Code і скасування зменшення лімітів у години пік для Pro і Max. Варто знати, бо чимало статей досі описують стару поведінку.

Написано командою, що створює Claude Code

  1. “Maximizing the value of your Claude Code sessions” (14 серпня 2026)Джерело для порядку чотирьох речей, що спалюють ліміт, і для підсумовування до перерви, а не після.
  2. “Lessons from building Claude Code: prompt caching is everything” (30 квітня 2026)Чому це важливо не лише вам, а й Anthropic: вони відстежують, як часто повторно використовується та сама дешева копія, і пишуть, що високий показник «допомагає нам робити ліміти на підписках щедрішими».

Чого ця стаття не стверджує

  1. Жодної кількості токенів чи повідомлень для жодного тарифу. Anthropic не публікує таких цифр ні для якого рівня.
  2. Жодного відсотка економії для жодної звички, якщо його не опублікувала Anthropic. Ми не проводили контрольованого тесту впродовж періоду тарифу, а коливання однієї людини від тижня до тижня все одно поглинули б результат.
  3. Жодних тверджень, що це назавжди. Claude Code часто змінюється, а ліміти вже змінювалися у 2026 році. Актуальна інформація — на сторінках за посиланнями; ця стаття — знімок станом на вересень 2026 року.

Схожі статті

Працювати з Applefy
Поговорімо

Забронюйте дзвінок з нашим CEO

Портрет Дениса Гавриляка, засновника та CEO Applefy

Денис Гавриляк

Засновник і CEO

  • 10+ років у розробці програмного забезпечення
  • Магістр із кібербезпеки
  • Глибоке й актуальне знання інструментів ШІ

Ви говоритимете з людиною, яка сама створює продукт. Денис особисто працює над продуктом, архітектурою та випуском — і уважно стежить за тим, на що інструменти ШІ справді здатні в реальному продукті, а не лише в демо.