AI ФАКТОР

GPT-5.6 став дешевшим для API

Новина 31.07.2026 #новини #моделі
GPT-5.6 став дешевшим для API

OpenAI знизила ціни на GPT-5.6 Luna на 80%: тепер модель коштує $0.20 за мільйон вхідних токенів і $1.20 за мільйон вихідних. Terra подешевшала на 20% — до $2 і $12 за мільйон токенів відповідно. Для GPT-5.6 Sol з’явився Fast mode: до 2.5× швидші відповіді за подвійну ціну без зміни рівня інтелекту.

Це робить сімейство GPT-5.6 більш розділеним за задачами: Sol — для найскладніших проблем, Terra — для щоденної production-роботи, Luna — для масових workflow з інструментами та багатокроковими процесами.

Що це означає для бізнесу: командам варто переглянути маршрутизацію запитів в API: не тримати все на Sol, тестувати Terra для типових задач і Luna — там, де важливі масштаб, швидкість і нижча ціна.

Що саме змінилося в лінійці GPT-5.6

OpenAI описує оновлення як одночасне здешевлення двох моделей і зміну режиму швидкого доступу до найпотужнішої моделі сімейства. Luna позиціонується як найшвидша й найдоступніша модель для роботи з інструментами та багатокрокових процесів у масштабі. Terra — як збалансована модель для повсякденної production-роботи. Sol залишається моделлю для найскладніших задач, але для неї з’явився окремий Fast mode в API.

Окрема деталь, якої не було в короткому пості: OpenAI порівнює Luna з моделями, які рік тому були frontier-class, і заявляє, що вона дає порівнювану продуктивність приблизно за 6 центів на долар за задачу та майже у 9 разів швидше. Це формулювання саме з розсилки; методика такого порівняння в тексті не розкрита.

  • Luna: $0.20 за мільйон вхідних токенів і $1.20 за мільйон вихідних.
  • Terra: $2 за мільйон вхідних токенів і $12 за мільйон вихідних.
  • Sol Fast mode: до 2.5× швидші відповіді, ніж Standard processing, за подвійну ціну.

Fast mode: не нова модель, а інший режим доступу

Для бізнес-користувачів API важлива не лише ціна моделі, а й затримка відповіді. Саме це зачіпає Fast mode для GPT-5.6 Sol. OpenAI прямо пише, що Fast mode не змінює рівень інтелекту моделі: йдеться про швидший режим обробки, а не про окрему якісно іншу версію Sol.

Fast mode замінює попередню пропозицію Priority Processing. Для сумісності старі запити, позначені priority, автоматично використовуватимуть Fast mode. Для нових запитів OpenAI вказує параметр service_tier="fast". Тобто командам, які вже використовували priority-мітки, не потрібно одразу перебудовувати всю інтеграцію лише для базової сумісності.

  • Доступ описано саме для API customers.
  • Fast mode стосується GPT-5.6 Sol.
  • Швидкість заявлена як up to 2.5×, тобто не гарантія для кожного запиту.
  • Ціна Fast mode — twice the price відносно Standard processing.

Практичне значення для компаній

Головний практичний висновок із розсилки — OpenAI сама підштовхує клієнтів не використовувати Sol за замовчуванням там, де не потрібен максимум інтелекту. У тексті прямо сказано: якщо зараз робота за замовчуванням іде через Sol, але не потребує максимальної складності, варто оцінити Terra.

Для фінансових, юридичних, HR- і операційних команд це означає не готову інструкцію “що саме автоматизувати”, а зміну економіки API-запитів. OpenAI описує Luna як модель для high-volume workflows, інструментів і багатокрокових процесів; Terra — для everyday production work; Sol — для hardest problems. Отже, практичне рішення для компанії лежить у маршрутизації задач між моделями, якщо така архітектура вже є в продукті або внутрішньому інструменті.

Якщо компанія не використовує API OpenAI напряму, застосувати це оновлення сьогодні може бути ніяк: у розсилці немає інформації про зміни в ChatGPT, корпоративних тарифах або сторонніх продуктах, які працюють поверх OpenAI.

Що залишається невідомим

У першоджерелі немає точної дати старту, окрім формулювання “today”. Також не наведено окремої таблиці всіх тарифів сімейства GPT-5.6 у самому тексті листа — є лише посилання на updated API pricing. Тому з цього джерела не можна робити ширших висновків про всі можливі конфігурації чи знижки.

  • Не пояснено, за яких умов Fast mode досягає максимальної швидкості до 2.5×.
  • Не наведено методики порівняння Luna з frontier-class моделями річної давнини.
  • Не сказано, чи змінюються ліміти, доступність за регіонами або умови для окремих типів акаунтів.
  • Не вказано, чи є наслідки для користувачів поза API.
Раніше в теміKimi K3 відкриває ваги й інфраструктуруПізніше в теміDeepseek здешевлює бюджетні AI-моделі
Читати в ТелеграміПрактика ШІ в бізнесі — щодня, без хайпу