Google випустила третю бюджетну Gemini за шість тижнів
Gemini 3.8 Flash стартувала за $0,75 за мільйон вхідних токенів і $3,75 за мільйон вихідних — як 3.7 Flash. За даними Google, модель набрала 73,7% у DeepSWE v1.1 проти 65,3% у попередниці та 74% у Claude Opus 5.
Низький тариф не гарантує меншого рахунку: 3.8 Flash робить більше кроків міркування й витрачає більше токенів. Artificial Analysis оцінила завдання у $0,58 проти $0,40 для 3.7 Flash, хоча ціна токена не змінилася. Отже, ринок бюджетних моделей зміщується від тарифу за токен до повної вартості виконаного завдання.
Що стоїть за приростом результатів
Gemini 3.8 Flash з’явилася через три тижні після 3.7 Flash і стала третім релізом лінійки Flash за шість тижнів. Паралельно frontier-моделі Gemini 3.5 Pro і Gemini 4 у матеріалі названі такими, що досі не вийшли. Новий керівник DeepMind Корай Кавукчуоглу заявив, що Google прагне лідерства не лише у співвідношенні ціни та продуктивності, а й у максимальних можливостях моделей.
За тестами Google, у DeepSWE v1.1 для тривалих завдань із розробки модель отримала 73,7%. Для порівняння: Claude Opus 5 — 74,0%, GPT-5.6 Sol — 72,7%, Claude Sonnet 5 — 53,8%, а Gemini 3.7 Flash — 65,3%. Google також повідомляє про покращення 3D-генерації: показаний компанією приклад гри було створено з одного запиту в Antigravity, а текстури — за допомогою Nano Banana.
Artificial Analysis оцінила 3.8 Flash у 59 балів Intelligence Index проти 56 у попередниці. Такий самий результат у її вимірюванні мають GPT-5.6 Sol із рівнем міркування xhigh та Grok 4.6 із medium. Основний внесок у приріст, за оцінкою платформи, дали агентні тести — використання інструментів і програмування.
Ціна токена і фактична вартість роботи
Початковий тариф становить $0,75 за мільйон вхідних і $3,75 за мільйон вихідних токенів. Із січня 2027 року ціни мають зрости до $1,50 та $7,50. У матеріалі для порівняння наведено тарифи Claude Opus 5 — $5 і $25, а GPT-5.6 Sol — $4 і $20 відповідно.
Однакова ставка з 3.7 Flash не означає однакових витрат. Нова модель робить додаткові кроки міркування на складних завданнях та ітеративно викликає інструменти. За даними The Decoder, вона використовує приблизно на 30% більше вихідних токенів на завдання. Artificial Analysis оцінила середню вартість завдання у $0,58 проти $0,40 для 3.7 Flash — приблизно на 40% більше. Водночас $0,58 є найнижчою вартістю серед моделей її рівня інтелекту в оцінці платформи.
Для навантажень, де головне — обчислювальна ефективність, Google рекомендує зменшувати рівень міркування або залишатися на підтримуваній 3.7 Flash. На високому рівні міркування 3.8 Flash генерує близько 300 вихідних токенів за секунду, а середній час завдання становить 2,5 хвилини; на низькому — близько 48 секунд.
Кому доступні дві версії
За даними VentureBeat, розробники можуть працювати зі стандартною Gemini 3.8 Flash через Gemini API у Google AI Studio, Antigravity, Android Studio і Stitch, а бізнес — через Gemini Enterprise. The Decoder також повідомляє про доступ у застосунку Gemini та AI Mode у Google Search, а для платних передплатників — у Google Sheets.
За даними VentureBeat, Google анонсувала й спеціалізовану Flash Cyber для виявлення та усунення вразливостей. The Decoder пише, що вона публічно недоступна: Google поширює модель через Fairwind Program серед державних установ, операторів критичної інфраструктури та розробників, які підтримують програмне забезпечення. Її налаштування безпеки менш обмежувальні, оскільки модель призначена для захисної роботи.
- За даними VentureBeat, Flash Cyber отримала 86,2% у CyberGym і 47,2% Pass@1 у CWE-Bench.
- За даними The Decoder, у Gray Swan IPI частка успішних атак через prompt injection становила 5,5%; у Claude Opus 5 — 4,8%.
Матеріал не уточнює регіональні обмеження, точний перелік платних планів із доступом у Sheets та критерії відбору до Fairwind Program. Тому стандартна і Cyber-версії мають різні сценарії доступу: перша представлена в продуктах Google, друга залишається контрольованим інструментом для перевірених захисників.