Codex 6 Sol : le raisonnement Ultra arrive dans la CLI
Codex 6 SolCodex CLIreasoning models
Ultra dans la CLI ne se résume pas à un raisonnement renforcé
Ce qui retient l’attention n’est pas un simple commutateur de plus, mais un changement de mécanique : Codex 6 Sol propose désormais six niveaux de raisonnement directement dans la CLI. La documentation officielle d’OpenAI pour GPT-6 Sol liste Low, Medium, High, Extra high, Max et Ultra. Au 23 septembre 2026, Medium est indiqué comme valeur par défaut.
La documentation d’OpenAI sur l’API de raisonnement distingue explicitement le mode de raisonnement du reasoning effort. Choisir un modèle ne signifie donc pas automatiquement obtenir la profondeur maximale de traitement, tandis que l’absence de réglage explicite conserve un niveau moyen. C’est important pour la configuration et la reproductibilité : une même requête adressée au même modèle peut s’exécuter avec un budget de raisonnement différent.
Le changement le plus intéressant commence avec Ultra. Ce niveau est décrit comme un raisonnement maximal avec délégation automatique de tâches ; il ne s’agit donc plus seulement d’une recherche interne plus longue pour produire une réponse. Dans son principe, cela se rapproche d’une boucle multiagent intégrée, où le modèle principal peut distribuer le travail entre plusieurs sous-tâches.
Le premier signal de cette fonction est venu d’observations d’utilisateurs de Codex CLI, tandis que la documentation explique ce qui se cache derrière la nouvelle option d’interface. Elle ne dévoile toutefois pas les détails de l’orchestration : combien de sous-tâches sont créées, comment le contexte circule entre elles, ni comment le résultat final est assemblé.
Les tâches complexes transforment le flux de travail
Le changement concret est simple : le développeur choisit désormais non seulement le modèle, mais aussi la forme de calcul appliquée à la tâche. Medium semble être le mode de base pour le code quotidien, tandis que High, Max et Ultra ciblent le débogage plus difficile et le travail en plusieurs étapes dans un dépôt.
Je regarderais d’abord non pas le nom Ultra, mais le coût de coordination. La délégation automatique peut améliorer la décomposition, tout en apportant du travail redondant, une consommation accrue de contexte et des erreurs lors de l’assemblage de résultats partiels. Sans traçabilité transparente, il est difficile de savoir si le modèle a réparti la tâche intelligemment ou s’il a simplement généré davantage de calcul.
Ce n’est pas une mise à jour cosmétique : le raisonnement devient progressivement une composante de l’interface habituelle du développeur plutôt qu’un paramètre d’API caché. Mais la valeur réelle d’Ultra dépendra moins de la profondeur maximale que de la fiabilité avec laquelle Codex coordonne ses propres sous-tâches. C’est là que se situe la frontière entre un mode agentique utile et une coûteuse illusion d’activité.