Grok 4.7: дешево, але сильно відстає в кодуванні
xAI випустила Grok 4.7 за $2/$6 за мільйон токенів вхід/вихід — рівень цін китайських моделей. За даними The Decoder, на Artificial Analysis Intelligence Index модель набрала 46 балів проти 53 у Claude Fable 5.1 і GPT-6.
В агентному кодуванні розрив ще більший: на Terminal-Bench 4.0 Grok 4.7 — 26%, GPT-6 Astra — 60%, Claude Fable 5.1 — 55%, а навіть дешевша DeepSeek V4.1 Flash — 27%. Доступна через Grok API, Cursor і Grok Build.
Що це означає для бізнесу: якщо для агентного кодування в Cursor ви розглядаєте Grok — за цими бенчмарками він суттєво слабший за Claude і GPT-6. Обирайте Grok 4.7 лише для дешевих текстових задач, не для складного кодування.
Що змінилося у Grok 4.7
За даними The Decoder, xAI побудувала Grok 4.7 на більшій базовій моделі, тренувала її довше методом навчання з підкріпленням і додала механізми, які мають краще перевіряти власні відповіді моделі. Це чергова ітерація лінійки Grok: модель покращена порівняно з попередніми версіями компанії, хоча за незалежними бенчмарками все одно помітно відстає від провідних моделей ринку.
Ціна на рівні китайських конкурентів
Grok 4.7 коштує $2 за мільйон вхідних токенів і $6 за мільйон вихідних. За даними The Decoder, це рівень цін, ближчий до китайських моделей, ніж до західних флагманів, — і, найімовірніше, не випадково: у матеріалі Grok 4.7 порівнюють саме з дешевою DeepSeek V4.1 Flash. Для бізнесу це означає появу ще одного дешевого варіанта в тому самому ціновому сегменті, де вже конкурують китайські постачальники моделей.
У незалежному рейтингу Artificial Analysis Intelligence Index (версія 4.3.2), який об'єднує десять бенчмарків, Grok 4.7 набрала 46 балів — за даними The Decoder. Claude Fable 5.1 і GPT-6 отримали по 53 бали кожна.
Розрив в агентному кодуванні
За даними The Decoder, на бенчмарку Terminal-Bench 4.0, який оцінює здатність моделі самостійно виконувати задачі в терміналі без покрокових підказок людини, Grok 4.7 набрала лише 26%. GPT-6 Astra показала 60%, Claude Fable 5.1 — 55%. Навіть дешевша DeepSeek V4.1 Flash обійшла Grok 4.7 з результатом 27% — тобто низька ціна Grok 4.7 не супроводжується перевагою навіть над іншими бюджетними моделями в цій задачі.
- Artificial Analysis Intelligence Index: Grok 4.7 — 46 балів, Claude Fable 5.1 і GPT-6 — по 53
- Terminal-Bench 4.0: Grok 4.7 — 26%, GPT-6 Astra — 60%, Claude Fable 5.1 — 55%, DeepSeek V4.1 Flash — 27%
Де доступна модель
Grok 4.7 доступна через Grok API, у Cursor та у Grok Build. Це означає, що компанії, які вже мають налаштовану роботу з моделями через API чи Cursor, можуть підключити Grok 4.7 як альтернативу без додаткової інтеграції — питання лише в тому, для яких задач її ціна виправдовує різницю в якості.