3 min de lecture

Claude Fable 5.1 est testé gratuitement sur Arena

Claude Fable 5.1Arena AIязыковые модели

Claude Fable 5.1 est disponible en test direct gratuit dans Arena Direct Mode jusqu'au 5 septembre à 8 h PT. Cette courte fenêtre permet aux développeurs de choisir explicitement le modèle et de l'essayer sur leurs tâches. Il restera ensuite dans Battle Mode et Agent Mode, avec une évaluation différente.

Ce qu'Arena a ouvert

Voici ce qui est réellement utile : Claude Fable 5.1 peut être sélectionné gratuitement dans Direct Mode et testé avec vos propres prompts. L'annonce d'Arena précise que l'accès direct est ouvert jusqu'au 5 septembre à 8 h PT. Au moment de la publication, l'offre est encore active, mais la fenêtre est très courte.

Le modèle ne disparaîtra pas de la plateforme à la fin de l'opération. Il restera dans Battle Mode et Agent Mode, mais le choix direct du modèle ne sera plus garanti. La différence est importante : Direct Mode permet des comparaisons contrôlées, tandis que Battle Mode est conçu pour comparer anonymement les réponses.

Arena indique également que Claude Fable 5.1 est disponible dans les arènes de programmation et de tâches multimodales. La fenêtre gratuite ne concerne donc pas seulement le chat courant : elle permet de tester la génération de code, le traitement d'entrées visuelles et le comportement dans des scénarios concrets.

La fiche modèle d'Anthropic apporte du contexte technique. Claude Fable 5.1 est sorti le 1er septembre 2026, prend en charge jusqu'à 1 million de tokens de contexte et une sortie maximale de 128 000 tokens. La réflexion adaptative est activée en permanence.

Lors de l'annonce, Anthropic affichait un tarif de 10 dollars par million de tokens en entrée et de 50 dollars par million en sortie. La lecture depuis le cache était facturée 0,25 dollar par million de tokens. Un essai gratuit sur Arena aide à évaluer les réponses, mais ne montre pas à lui seul si cette économie d'API est justifiée.

Les résultats de benchmarks paraissent solides : Anthropic a annoncé 52,6 % sur SciBench Science 0.1 et 55,8 % sur Terminal-Bench 4.0. Arena a aussi indiqué que Fable 5.1 Max était premier de Code Arena: WebDev avec 1765 points, soit 77 points d'avance.

Pourquoi quelques jours gratuits comptent

Ce n'est pas une simple promotion : l'accès direct offre une occasion rare d'essayer un modèle coûteux sans payer ni travailler en mode aveugle. Je regarderais d'abord la stabilité du contexte long, la qualité des modifications complexes de code et l'utilité de la réflexion adaptative sur des tâches où une réponse courte peut facilement masquer une erreur.

Les développeurs disposent temporairement d'un moyen de comparer le modèle à ses concurrents avec les mêmes prompts. Arena obtient davantage de comparaisons réelles, et Anthropic montre le modèle au-delà de ses propres démonstrations. Après la fermeture de Direct Mode, ces vérifications seront moins reproductibles, même si Battle Mode demeure.

Un bon classement et de solides résultats officiels justifient un examen attentif, mais ne remplacent pas les essais sur son propre jeu de tâches. La vraie question n'est pas le record, mais la capacité de Fable 5.1 à tenir de longues chaînes de travail sans accumuler d'erreurs silencieuses.

Nous avions précédemment couvert la démarche d’Anthropic pour rétablir la transparence sur le comportement des modèles Claude après des inquiétudes liées à des dégradations silencieuses. Ce contexte compte pour évaluer une nouvelle version de Claude via les tests publics gratuits d’Arena AI.