Claude Opus 5.5 gagne en autonomie pour le code
Claude Opus 5.5Claude Codeагентное программирование
Ce qui change avec Claude Opus 5.5
En regardant Claude Opus 5.5, je n'y vois pas une simple mise à jour cosmétique, mais une tentative de rendre le modèle plus fiable lors de longues exécutions autonomes. Anthropic l'a présenté le 22 septembre 2026 comme un modèle destiné aux tâches agentiques prolongées, en programmation comme dans le travail sur les connaissances.
L'annonce d'Anthropic mentionne une fenêtre de contexte d'un million de tokens, une sortie maximale de 128 000 tokens et une réflexion adaptative activée par défaut. Le modèle est disponible dans Claude, Claude Code, Claude Platform et chez les principaux fournisseurs cloud. Les notes de version de Claude Code 2.1.280 le présentent aussi comme le modèle Opus standard, ce qui explique son arrivée immédiate dans les usages en CLI.
Au lancement, le tarif était de 4 $ par million de tokens en entrée et de 20 $ par million de tokens en sortie. Opus 5 coûtait respectivement 5 $ et 25 $, tandis que la lecture du cache dans Claude Code était facturée 0,20 $ par million de tokens. Pour un agent qui travaille longtemps, cet écart compte davantage qu'un joli score de benchmark ponctuel : le coût s'accumule à chaque cycle de lecture, de raisonnement et de correction.
Anthropic annonce une sortie plus de 30 % plus rapide et un coût habituel par tâche inférieur d'environ 40 % à celui d'Opus 5. Les résultats publiés incluent 66,4 % sur Terminal-Bench 4.0, 54,4 % sur FrontierCode v1.1 et 57,8 % sur CursorBench 4.0. Ce sont des chiffres issus des supports de lancement, et non un remplacement des tests sur votre propre dépôt.
Le détail le plus intéressant vient d'un retour utilisateur : le modèle a terminé une tâche importante en trois heures, généré un code plus lisible et consommé son quota moins vite. Il a aussi ajouté de lui-même des console.log() conditionnels pour le débogage, sans instruction explicite. On est déjà moins dans l'autocomplétion accélérée que dans le choix de la prochaine action d'ingénierie.
Pourquoi l'autonomie compte davantage que la vitesse
Pour les tâches longues, le changement majeur est la moindre nécessité de guider constamment le modèle à la main. Si l'agent diagnostique un problème, ajoute de l'observabilité et poursuit le travail, il réduit non seulement le temps de génération, mais aussi le nombre d'interventions humaines.
Un grand contexte aide à conserver dans un même processus le codebase, l'historique des décisions et les résultats des outils. Une consommation plus économe des quotas rend ce cycle plus réaliste, surtout avec les limites de cinq heures étendues pour les offres Pro, Max et Team annoncées au lancement.
Je ne transformerais toutefois pas une exécution réussie sur un projet en conclusion universelle. Une sortie de débogage ajoutée automatiquement peut être une bonne décision, mais aussi encombrer le code ou exposer des données superflues. Il faut vérifier non seulement le résultat final, mais également les actions intermédiaires de l'agent.
Opus 5.5 semble être une avancée réelle si l'autonomie annoncée se reproduit sur différents dépôts. La question principale n'est plus de savoir si le modèle peut écrire du code, mais combien de temps on peut le laisser travailler sans intervenir.