Claude Fable 5.1 est testé gratuitement sur Arena
Claude Fable 5.1Arena AIязыковые модели
Ce qu'Arena a ouvert
Voici ce qui est réellement utile : Claude Fable 5.1 peut être sélectionné gratuitement dans Direct Mode et testé avec vos propres prompts. L'annonce d'Arena précise que l'accès direct est ouvert jusqu'au 5 septembre à 8 h PT. Au moment de la publication, l'offre est encore active, mais la fenêtre est très courte.
Le modèle ne disparaîtra pas de la plateforme à la fin de l'opération. Il restera dans Battle Mode et Agent Mode, mais le choix direct du modèle ne sera plus garanti. La différence est importante : Direct Mode permet des comparaisons contrôlées, tandis que Battle Mode est conçu pour comparer anonymement les réponses.
Arena indique également que Claude Fable 5.1 est disponible dans les arènes de programmation et de tâches multimodales. La fenêtre gratuite ne concerne donc pas seulement le chat courant : elle permet de tester la génération de code, le traitement d'entrées visuelles et le comportement dans des scénarios concrets.
La fiche modèle d'Anthropic apporte du contexte technique. Claude Fable 5.1 est sorti le 1er septembre 2026, prend en charge jusqu'à 1 million de tokens de contexte et une sortie maximale de 128 000 tokens. La réflexion adaptative est activée en permanence.
Lors de l'annonce, Anthropic affichait un tarif de 10 dollars par million de tokens en entrée et de 50 dollars par million en sortie. La lecture depuis le cache était facturée 0,25 dollar par million de tokens. Un essai gratuit sur Arena aide à évaluer les réponses, mais ne montre pas à lui seul si cette économie d'API est justifiée.
Les résultats de benchmarks paraissent solides : Anthropic a annoncé 52,6 % sur SciBench Science 0.1 et 55,8 % sur Terminal-Bench 4.0. Arena a aussi indiqué que Fable 5.1 Max était premier de Code Arena: WebDev avec 1765 points, soit 77 points d'avance.
Pourquoi quelques jours gratuits comptent
Ce n'est pas une simple promotion : l'accès direct offre une occasion rare d'essayer un modèle coûteux sans payer ni travailler en mode aveugle. Je regarderais d'abord la stabilité du contexte long, la qualité des modifications complexes de code et l'utilité de la réflexion adaptative sur des tâches où une réponse courte peut facilement masquer une erreur.
Les développeurs disposent temporairement d'un moyen de comparer le modèle à ses concurrents avec les mêmes prompts. Arena obtient davantage de comparaisons réelles, et Anthropic montre le modèle au-delà de ses propres démonstrations. Après la fermeture de Direct Mode, ces vérifications seront moins reproductibles, même si Battle Mode demeure.
Un bon classement et de solides résultats officiels justifient un examen attentif, mais ne remplacent pas les essais sur son propre jeu de tâches. La vraie question n'est pas le record, mais la capacité de Fable 5.1 à tenir de longues chaînes de travail sans accumuler d'erreurs silencieuses.