OpenAI випустила дешевші моделі GPT-6 Sol і Luna
OpenAI додала до лінійки GPT-6 моделі Sol і Luna — дешевші та швидші за флагманську Astra, з цінами в API на 50% нижчими за GPT-5.6. На AutomationBench Sol (xhigh) обходить Claude Opus 5 за 9% її вартості за завдання, а на DeepSWE v1.1 набирає 68,8% — майже як найкращий результат Claude Fable 5 (69,9%), але майже на 80% дешевше.
OpenAI конкурує не лише якістю, а й ціною: результати на рівні або краще за моделі Anthropic за частку вартості. Кешування промптів тепер дає знижку 90% на повторні токени контексту.
Чому дешевші моделі з'явилися саме зараз
На початку вересня OpenAI випустила GPT-6 Astra — найпотужнішу й найбільш узгоджену модель лінійки, призначену для найскладніших і найважливіших проєктів. Але компанія визнає: не вся робота потребує такої глибини, тож вирішила розширити лінійку GPT-6 моделями Sol і Luna, навченими за схожими з Astra методами. Це означає, що частина покращень Astra у фактологічній точності, кодуванні, роботі з комп'ютером і узгодженості дісталася й дешевшим моделям.
API-ціни на Sol і Luna знижено на 50% порівняно з промопрайсом GPT-5.6. За словами OpenAI, це стало можливим завдяки покращенням у кешуванні та інференсі, а заощадження компанія передає напряму клієнтам.
Що показали тести
На AutomationBench — тесті бізнес-процесів у різних застосунках — Sol у режимі xhigh перевершує Claude Opus 5 на максимальному режимі за лише 9% вартості задачі конкурента. Luna на високому режимі покращила показник попередниці на 5,4 відсоткового пункту за задачу, що на 58% дешевше. На Agents' Last Exam, який оцінює агентів на складних професійних завданнях, Sol на максимальному режимі набрав 56,4% — вище за найкращий результат Opus 5 у цьому тесті, і на 60% дешевше за задачу.
У фактологічній точності Sol помиляється приблизно вдвічі рідше за попередницю GPT-5.6 Sol, підбираючись за надійністю до рівня Astra, але коштуючи значно менше. На DeepSWE v1.1 (складні завдання з реальними кодовими базами) Sol за максимального режиму набрав 68,8% — лише на 1,1 п.п. менше за найкращий результат Claude Fable 5 (69,9%), але приблизно на 80% дешевше за задачу. Luna на максимальному режимі набрала 66,6%, що порівнянно з результатами Opus 5 і Fable 5 на середньому режимі, — за задачу Luna коштує на 93% менше за Opus 5 і на 96% менше за Fable 5.
Що це означає для кодових агентів і команд
За даними OpenAI, внутрішнє використання кодових агентів у компанії зростає експоненційно: за цінами API денне споживання токенів у медіанного дослідника перевищує $600, а у 90-го перцентиля — $7000. Саме тому вартість довгих, витратних сесій роботи агента стає критичною: дешевші Sol і Luna, за словами компанії, дають командам «більше простору для ітерацій» і впевненість ставити агентам (зокрема Codex) амбітніші завдання без різкого зростання рахунків.
Крім цього, OpenAI покращила кешування промптів для GPT-6: за замовчуванням зросла частота влучень у кеш, що дозволяє агентам повторно використовувати більше контексту, швидше відповідати й отримувати знижку 90% на повторні токени контексту. Розробники також отримали явні точки розриву (breakpoints), щоб контролювати, які частини промпту кешуються.
Доступність
- Sol і Luna доступні в ChatGPT Work і Codex від сьогодні для планів Plus, Pro, Business, Enterprise і Edu
- Користувачі Free і Go можуть отримати доступ до Luna в десктоп-застосунку
- У Chat моделі ще не доступні
- В API — як
gpt-6-solіgpt-6-luna - Розгортання в ChatGPT відбувається поступово протягом дня
У матеріалі не уточнено конкретні ціни за токен для Sol і Luna — лише розмір знижки (50%) відносно промотарифів GPT-5.6.