3 min de lecture

Codex 6 Sol : le raisonnement Ultra arrive dans la CLI

Codex 6 SolCodex CLIreasoning models

Codex 6 Sol permet désormais de choisir dans la CLI une profondeur de raisonnement allant de Low à Ultra, Medium restant la valeur par défaut. Ultra est important car il ajoute la délégation automatique de tâches, au-delà d’un effort de raisonnement supérieur, et esquisse un processus multiagent interne pour le code complexe.

Ultra dans la CLI ne se résume pas à un raisonnement renforcé

Ce qui retient l’attention n’est pas un simple commutateur de plus, mais un changement de mécanique : Codex 6 Sol propose désormais six niveaux de raisonnement directement dans la CLI. La documentation officielle d’OpenAI pour GPT-6 Sol liste Low, Medium, High, Extra high, Max et Ultra. Au 23 septembre 2026, Medium est indiqué comme valeur par défaut.

La documentation d’OpenAI sur l’API de raisonnement distingue explicitement le mode de raisonnement du reasoning effort. Choisir un modèle ne signifie donc pas automatiquement obtenir la profondeur maximale de traitement, tandis que l’absence de réglage explicite conserve un niveau moyen. C’est important pour la configuration et la reproductibilité : une même requête adressée au même modèle peut s’exécuter avec un budget de raisonnement différent.

Le changement le plus intéressant commence avec Ultra. Ce niveau est décrit comme un raisonnement maximal avec délégation automatique de tâches ; il ne s’agit donc plus seulement d’une recherche interne plus longue pour produire une réponse. Dans son principe, cela se rapproche d’une boucle multiagent intégrée, où le modèle principal peut distribuer le travail entre plusieurs sous-tâches.

Le premier signal de cette fonction est venu d’observations d’utilisateurs de Codex CLI, tandis que la documentation explique ce qui se cache derrière la nouvelle option d’interface. Elle ne dévoile toutefois pas les détails de l’orchestration : combien de sous-tâches sont créées, comment le contexte circule entre elles, ni comment le résultat final est assemblé.

Les tâches complexes transforment le flux de travail

Le changement concret est simple : le développeur choisit désormais non seulement le modèle, mais aussi la forme de calcul appliquée à la tâche. Medium semble être le mode de base pour le code quotidien, tandis que High, Max et Ultra ciblent le débogage plus difficile et le travail en plusieurs étapes dans un dépôt.

Je regarderais d’abord non pas le nom Ultra, mais le coût de coordination. La délégation automatique peut améliorer la décomposition, tout en apportant du travail redondant, une consommation accrue de contexte et des erreurs lors de l’assemblage de résultats partiels. Sans traçabilité transparente, il est difficile de savoir si le modèle a réparti la tâche intelligemment ou s’il a simplement généré davantage de calcul.

Ce n’est pas une mise à jour cosmétique : le raisonnement devient progressivement une composante de l’interface habituelle du développeur plutôt qu’un paramètre d’API caché. Mais la valeur réelle d’Ultra dépendra moins de la profondeur maximale que de la fiabilité avec laquelle Codex coordonne ses propres sous-tâches. C’est là que se situe la frontière entre un mode agentique utile et une coûteuse illusion d’activité.

Nous avons précédemment couvert le déploiement de Codex dans ChatGPT pour Android et ce qu’il implique pour les équipes de développement à distance. Ce contexte aide à comprendre comment un nouveau mode de raisonnement pourrait modifier le rôle concret de Codex dans les workflows d’ingénierie.