AI ФАКТОР

Довгі сесії Claude збільшують рахунок на 36%

Практика 08.09.2026
Довгі сесії Claude збільшують рахунок на 36%

AI Architect Денис Клименко проаналізував 30 сесій: 857 млн токенів коштували $582. Запит до Opus у довгій сесії обходився у $0.121 проти $0.078 у короткій за однакової якості. Контекст понад 300 000 токенів сформував 58% витрат на перечитування кешу, а 98% токенів припало на повторну обробку сказаного.

Причина — Claude з кожним повідомленням знову отримує попередній діалог. Найбільше контекст роздувають виводи команд у терміналі — 36–42% — і прочитані файли проєкту — 28%. Після великого логу прибрати його із сесії неможливо: треба закрити її.

Як накопичується вартість

Модель не зберігає попередню розмову як окрему внутрішню пам’ять. З кожним новим повідомленням їй знову передається весь контекст сесії. Тому п’ятдесятий запит містить не лише нове завдання, а й сорок дев’ять попередніх обмінів. За оцінкою Дениса Клименка, 98% усіх токенів у проаналізованій роботі припало саме на перечитування вже сказаного.

Початковий контекст робочої сесії становив близько 40 000 токенів: до нього входили глобальні та локальні правила, навички й пам’ять. На піках обсяг зростав до 405 000 токенів. Через повторне передавання накопиченого контексту витрати збільшуються швидше, ніж кількість запитів.

Що саме перевантажує сесію

Найбільшу частку контексту створюють не відповіді моделі, а робочі матеріали, додані під час виконання завдання. Виводи команд у терміналі становили 36–42% використаних ресурсів, прочитані файли проєкту — ще 28%. Якщо один раз додати довгий журнал подій, він повторно оброблятиметься в кожному наступному запиті до завершення цієї сесії.

  • Понад 300 000 токенів: такі сесії сформували 58% рахунку за перечитування кешу.
  • До 200 000 токенів: цей обсяг фахівець називає орієнтиром для оптимальної робочої сесії.
  • 405 000 токенів: максимальний зафіксований обсяг контексту в його роботі.

Видалити окремий великий фрагмент із уже накопиченого контексту не можна. Щоб перестати передавати його разом із наступними повідомленнями, потрібно завершити поточну сесію.

Як контролювати бюджет у щоденній роботі

Для керівників команд і фахівців, які використовують Claude для тривалих завдань, основним об’єктом контролю стає не кількість відповідей, а розмір контексту. Окреме стороннє питання доцільно переносити в нове вікно, а після завершення задачі — очищати сесію командою /clear.

  • Не надсилати повні журнали на сотні рядків, якщо для відповіді потрібен лише конкретний фрагмент.
  • Не передавати весь проєкт, коли питання стосується однієї функції.
  • Застосовувати /compact під час тривалих однотипних розмов, а не регулярно без потреби.
  • Враховувати, що стиснення скидає кеш, тому запускати /compact кожні п’ять хвилин недоцільно.
  • Починати нову сесію після завершення окремої задачі або переходу до іншої теми.

Практичний висновок із наведеного аналізу: економія залежить від того, скільки старих повідомлень, логів і файлів модель змушена перечитувати перед кожною новою відповіддю. Рекомендації стосуються організації роботи із сесіями, а не зміни моделі чи погіршення якості результату.

Раніше в теміChatGPT навчиться писати вашим голосомПізніше в теміCopilot збирає презентації з OneNote та Excel
Читати в ТелеграміПрактика ШІ в бізнесі — щодня, без хайпу