GPT-5.6 став дешевшим для API
OpenAI знизила ціни на GPT-5.6 Luna на 80%: тепер модель коштує $0.20 за мільйон вхідних токенів і $1.20 за мільйон вихідних. Terra подешевшала на 20% — до $2 і $12 за мільйон токенів відповідно. Для GPT-5.6 Sol з’явився Fast mode: до 2.5× швидші відповіді за подвійну ціну без зміни рівня інтелекту.
Це робить сімейство GPT-5.6 більш розділеним за задачами: Sol — для найскладніших проблем, Terra — для щоденної production-роботи, Luna — для масових workflow з інструментами та багатокроковими процесами.
Що це означає для бізнесу: командам варто переглянути маршрутизацію запитів в API: не тримати все на Sol, тестувати Terra для типових задач і Luna — там, де важливі масштаб, швидкість і нижча ціна.
Що саме змінилося в лінійці GPT-5.6
OpenAI описує оновлення як одночасне здешевлення двох моделей і зміну режиму швидкого доступу до найпотужнішої моделі сімейства. Luna позиціонується як найшвидша й найдоступніша модель для роботи з інструментами та багатокрокових процесів у масштабі. Terra — як збалансована модель для повсякденної production-роботи. Sol залишається моделлю для найскладніших задач, але для неї з’явився окремий Fast mode в API.
Окрема деталь, якої не було в короткому пості: OpenAI порівнює Luna з моделями, які рік тому були frontier-class, і заявляє, що вона дає порівнювану продуктивність приблизно за 6 центів на долар за задачу та майже у 9 разів швидше. Це формулювання саме з розсилки; методика такого порівняння в тексті не розкрита.
- Luna: $0.20 за мільйон вхідних токенів і $1.20 за мільйон вихідних.
- Terra: $2 за мільйон вхідних токенів і $12 за мільйон вихідних.
- Sol Fast mode: до 2.5× швидші відповіді, ніж Standard processing, за подвійну ціну.
Fast mode: не нова модель, а інший режим доступу
Для бізнес-користувачів API важлива не лише ціна моделі, а й затримка відповіді. Саме це зачіпає Fast mode для GPT-5.6 Sol. OpenAI прямо пише, що Fast mode не змінює рівень інтелекту моделі: йдеться про швидший режим обробки, а не про окрему якісно іншу версію Sol.
Fast mode замінює попередню пропозицію Priority Processing. Для сумісності старі запити, позначені priority, автоматично використовуватимуть Fast mode. Для нових запитів OpenAI вказує параметр service_tier="fast". Тобто командам, які вже використовували priority-мітки, не потрібно одразу перебудовувати всю інтеграцію лише для базової сумісності.
- Доступ описано саме для API customers.
- Fast mode стосується GPT-5.6 Sol.
- Швидкість заявлена як up to 2.5×, тобто не гарантія для кожного запиту.
- Ціна Fast mode — twice the price відносно Standard processing.
Практичне значення для компаній
Головний практичний висновок із розсилки — OpenAI сама підштовхує клієнтів не використовувати Sol за замовчуванням там, де не потрібен максимум інтелекту. У тексті прямо сказано: якщо зараз робота за замовчуванням іде через Sol, але не потребує максимальної складності, варто оцінити Terra.
Для фінансових, юридичних, HR- і операційних команд це означає не готову інструкцію “що саме автоматизувати”, а зміну економіки API-запитів. OpenAI описує Luna як модель для high-volume workflows, інструментів і багатокрокових процесів; Terra — для everyday production work; Sol — для hardest problems. Отже, практичне рішення для компанії лежить у маршрутизації задач між моделями, якщо така архітектура вже є в продукті або внутрішньому інструменті.
Якщо компанія не використовує API OpenAI напряму, застосувати це оновлення сьогодні може бути ніяк: у розсилці немає інформації про зміни в ChatGPT, корпоративних тарифах або сторонніх продуктах, які працюють поверх OpenAI.
Що залишається невідомим
У першоджерелі немає точної дати старту, окрім формулювання “today”. Також не наведено окремої таблиці всіх тарифів сімейства GPT-5.6 у самому тексті листа — є лише посилання на updated API pricing. Тому з цього джерела не можна робити ширших висновків про всі можливі конфігурації чи знижки.
- Не пояснено, за яких умов Fast mode досягає максимальної швидкості до 2.5×.
- Не наведено методики порівняння Luna з frontier-class моделями річної давнини.
- Не сказано, чи змінюються ліміти, доступність за регіонами або умови для окремих типів акаунтів.
- Не вказано, чи є наслідки для користувачів поза API.