2 хв читання

Claude Fable 5.1 безкоштовно тестують в Arena

Claude Fable 5.1Arena AIязыковые модели

Claude Fable 5.1 можна безкоштовно тестувати напряму в Arena Direct Mode до 5 вересня, 8:00 PT. Коротке вікно дає розробникам змогу явно вибрати модель і перевірити її на власних завданнях. Потім вона лишиться в Battle Mode та Agent Mode, але спосіб оцінювання буде іншим.

Що саме відкрила Arena

Ось що тут справді корисно: Claude Fable 5.1 можна безкоштовно вибрати в Direct Mode і прогнати на власних запитах. В анонсі Arena зазначено, що прямий доступ відкритий до 5 вересня, 8:00 PT. На момент публікації він ще діє, але це дуже коротке вікно.

Після завершення акції модель не зникне з платформи. Вона залишиться в Battle Mode та Agent Mode, однак прямий вибір моделі більше не гарантується. Це суттєва різниця: Direct Mode підходить для контрольованого порівняння, тоді як Battle Mode призначений для анонімного зіставлення відповідей.

Arena також повідомляє про доступність Claude Fable 5.1 в аренах для програмування та мультимодальних завдань. Тож безкоштовне вікно цікаве не лише для звичайного чату: можна перевірити генерацію коду, роботу з візуальним введенням і поведінку в прикладних сценаріях.

Картка моделі Anthropic додає технічний контекст. Claude Fable 5.1 випущено 1 вересня 2026 року, він підтримує контекст до 1 млн токенів і максимальний вивід до 128 тисяч токенів. Адаптивне мислення увімкнене постійно.

На час анонсу Anthropic вказувала ціну 10 доларів за мільйон вхідних токенів і 50 доларів за мільйон вихідних. Читання з кешу оцінювалося у 0,25 долара за мільйон токенів. Безкоштовний запуск в Arena дає змогу оцінити відповіді, але сам по собі не показує, наскільки виправдана така економіка API.

Цифри бенчмарків виглядають серйозно: у матеріалах Anthropic заявлено 52,6% на SciBench Science 0.1 і 55,8% на Terminal-Bench 4.0. Arena окремо повідомляла про перше місце Fable 5.1 Max у Code Arena: WebDev із 1765 балами та перевагою у 77 балів.

Чому кілька безкоштовних днів мають значення

Це не просто промо: прямий доступ дає рідкісну можливість перевірити дорогу модель без оплати й без сліпого режиму. Насамперед я б дивився на стабільність довгого контексту, якість складних правок коду та на те, чи допомагає адаптивне мислення у завданнях, де коротка відповідь легко приховує помилку.

Розробники отримують тимчасовий спосіб зіставити модель із конкурентами на однакових промптах. Arena отримує більше реальних порівнянь, а Anthropic демонструє модель поза власними презентаціями. Після закриття Direct Mode повторюваність таких перевірок погіршиться, навіть якщо Battle Mode залишиться.

Високе місце в рейтингу та сильні офіційні оцінки дають привід придивитися, але не замінюють тестування на власному наборі завдань. Головна інтрига не в рекорді, а в тому, чи витримає Fable 5.1 довгі робочі ланцюжки без накопичення тихих помилок.

Раніше ми розглядали крок Anthropic щодо відновлення прозорості поведінки моделей Claude після занепокоєння через непомітні погіршення. Цей контекст важливий для оцінки нового релізу Claude через безкоштовне публічне тестування в Arena AI.