AI Фактор

Grok 4.7: дешево, але сильно відстає в кодуванні

Новина 22.09.2026
Grok 4.7: дешево, але сильно відстає в кодуванні

xAI випустила Grok 4.7 за $2/$6 за мільйон токенів вхід/вихід — рівень цін китайських моделей. За даними The Decoder, на Artificial Analysis Intelligence Index модель набрала 46 балів проти 53 у Claude Fable 5.1 і GPT-6.

В агентному кодуванні розрив ще більший: на Terminal-Bench 4.0 Grok 4.7 — 26%, GPT-6 Astra — 60%, Claude Fable 5.1 — 55%, а навіть дешевша DeepSeek V4.1 Flash — 27%. Доступна через Grok API, Cursor і Grok Build.

Що це означає для бізнесу: якщо для агентного кодування в Cursor ви розглядаєте Grok — за цими бенчмарками він суттєво слабший за Claude і GPT-6. Обирайте Grok 4.7 лише для дешевих текстових задач, не для складного кодування.

Що змінилося у Grok 4.7

За даними The Decoder, xAI побудувала Grok 4.7 на більшій базовій моделі, тренувала її довше методом навчання з підкріпленням і додала механізми, які мають краще перевіряти власні відповіді моделі. Це чергова ітерація лінійки Grok: модель покращена порівняно з попередніми версіями компанії, хоча за незалежними бенчмарками все одно помітно відстає від провідних моделей ринку.

Ціна на рівні китайських конкурентів

Grok 4.7 коштує $2 за мільйон вхідних токенів і $6 за мільйон вихідних. За даними The Decoder, це рівень цін, ближчий до китайських моделей, ніж до західних флагманів, — і, найімовірніше, не випадково: у матеріалі Grok 4.7 порівнюють саме з дешевою DeepSeek V4.1 Flash. Для бізнесу це означає появу ще одного дешевого варіанта в тому самому ціновому сегменті, де вже конкурують китайські постачальники моделей.

У незалежному рейтингу Artificial Analysis Intelligence Index (версія 4.3.2), який об'єднує десять бенчмарків, Grok 4.7 набрала 46 балів — за даними The Decoder. Claude Fable 5.1 і GPT-6 отримали по 53 бали кожна.

Розрив в агентному кодуванні

За даними The Decoder, на бенчмарку Terminal-Bench 4.0, який оцінює здатність моделі самостійно виконувати задачі в терміналі без покрокових підказок людини, Grok 4.7 набрала лише 26%. GPT-6 Astra показала 60%, Claude Fable 5.1 — 55%. Навіть дешевша DeepSeek V4.1 Flash обійшла Grok 4.7 з результатом 27% — тобто низька ціна Grok 4.7 не супроводжується перевагою навіть над іншими бюджетними моделями в цій задачі.

  • Artificial Analysis Intelligence Index: Grok 4.7 — 46 балів, Claude Fable 5.1 і GPT-6 — по 53
  • Terminal-Bench 4.0: Grok 4.7 — 26%, GPT-6 Astra — 60%, Claude Fable 5.1 — 55%, DeepSeek V4.1 Flash — 27%

Де доступна модель

Grok 4.7 доступна через Grok API, у Cursor та у Grok Build. Це означає, що компанії, які вже мають налаштовану роботу з моделями через API чи Cursor, можуть підключити Grok 4.7 як альтернативу без додаткової інтеграції — питання лише в тому, для яких задач її ціна виправдовує різницю в якості.

Раніше в теміКоли ШІ-агент звітує успіх, а стан губитьсяПізніше в теміЧому AI-агенти не завжди окупаються
Читати в ТелеграміПрактика ШІ в бізнесі — щодня, без хайпу