AI ФАКТОР

Claude Fable 5.1 очолила прикладний рейтинг

Новина 05.09.2026
Claude Fable 5.1 очолила прикладний рейтинг

Anthropic представила Claude Fable 5.1. Модель посіла перше місце в індексі Vals AI, який оцінює виконання складних реальних завдань у фінансах, програмуванні та праві; попередні Opus 5 і Fable 5 стали другою та третьою. За даними SCMP, Fable 5.1 також набрала 66 балів в Intelligence Index від Artificial Analysis.

Результати підсилюють перевагу американських frontier-моделей у складних тестах, але водночас оголюють інший розрив: китайські open-weight моделі дешевші в експлуатації й уже набирають комерційної популярності у світі. Ринок розходиться між максимальною якістю та нижчою вартістю використання.

Що саме показують результати тестів

Vals AI оцінює здатність моделей виконувати складні прикладні завдання у фінансах, програмуванні та праві. У цьому індексі Fable 5.1 посіла перше місце, а дві попередні моделі Anthropic, Opus 5 і Fable 5, опинилися відповідно на другій та третій позиціях. Отже, верхню частину рейтингу зайняли три моделі одного розробника.

За даними SCMP, стандартна версія Fable 5.1 також отримала 66 балів в Artificial Analysis Intelligence Index. Видання трактує сукупність цих результатів як збільшення відриву Fable 5.1 від китайських конкурентів у тестах продуктивності. Водночас наведені оцінки стосуються саме бенчмарків і не є порівнянням вартості експлуатації моделей.

У релізі є ще одна модель

Разом із Claude Fable 5.1 Anthropic представила Mythos 5.1. Компанія позиціонує обидві моделі як свої найпередовіші рішення для програмування та складної інтелектуальної роботи. Вони використовують однакову базову систему, але відрізняються механізмами безпеки.

  • Claude Fable 5.1 доступна широкому загалу.
  • Mythos 5.1 має обмежений доступ.
  • За даними джерела Bing Anthropic, Mythos 5.1 надають обраним клієнтам через програми верифікації Anthropic.

Таким чином, результати Fable 5.1 можна розглядати як показник публічно доступної моделі, тоді як використання Mythos 5.1 залежить від проходження окремої процедури доступу.

Чому лідерство не закриває питання вибору

Реакція галузі зосередилася не лише на місцях у рейтингах. Співробітник Databricks Юйчень Цзінь назвав стрибок можливостей Fable 5.1 надзвичайним, а частина спостерігачів побачила в результатах заперечення тези, що китайські розробники моделей із відкритими вагами вже наздогнали frontier-моделі.

Проте SCMP окремо вказує на значний ціновий розрив. Китайські бюджетні моделі з відкритими вагами, за даними видання, набувають комерційної популярності у світі. Через це ринок порівнює не одного безумовного переможця, а два різні підходи: вищі результати у складних тестах з одного боку та нижчу вартість експлуатації й відкриті ваги з іншого.

Що це означає для бізнес-користувачів

Для фінансових, юридичних і програмних завдань рейтинг Vals AI дає додатковий сигнал щодо здатності Fable 5.1 працювати зі складними реальними сценаріями. Але джерело не наводить окремих результатів для бухгалтерів, HR або конкретних бізнес-процесів, тому переносити загальне місце в індексі на кожен корпоративний сценарій без додаткової перевірки не можна.

Практичний вибір, описаний у матеріалі, зводиться до співвідношення якості та витрат: американські frontier-моделі демонструють сильніші результати в наведених тестах, тоді як китайські open-weight альтернативи приваблюють нижчою вартістю експлуатації. Точних цін і дати початку широкого доступу в матеріалах немає.

Раніше в теміGoogle випустила третю бюджетну Gemini за шість тижнівПізніше в теміChatGPT навчиться писати вашим голосом
Читати в ТелеграміПрактика ШІ в бізнесі — щодня, без хайпу