3 min de lecture

Codex : Chat-to-Work et le coûteux Fast Mode

CodexChatGPT WorkFast Mode

Chat-to-Work permet de poursuivre une conversation classique dans Work avec les fichiers, les tâches et le contexte du projet. ChatGPT Work et Codex partagent un même pool, tandis que Fast Mode échange du quota contre de la vitesse : la documentation annonce environ 1,5 fois plus de rapidité pour 2 ou 2,5 fois plus de crédits selon le modèle.

Ce qui a réellement changé dans Codex

À mes yeux, le changement majeur n'est pas Fast Mode, mais le passage d'un chat classique à Work sans perdre le fil de l'échange. La documentation officielle de ChatGPT Work et Codex décrit un sélecteur supérieur entre Chat et Work, ainsi que la possibilité de créer une nouvelle conversation ou d'ouvrir un projet existant. C'est, en pratique, le chat-to-work : une discussion devient une tâche dotée d'un contexte de travail.

Dans Work, il est possible d'utiliser le contexte du projet, d'ouvrir des dossiers locaux et de poursuivre les précisions dans le même chat. Cela ressemble à une petite évolution d'interface, mais elle élimine sur le plan architectural une rupture pénible entre la formulation d'une idée et le moment où l'agent travaille déjà avec des fichiers et des contraintes. Moins de transferts manuels de contexte, donc moins de risques d'oublier une réserve importante.

À la date de publication, le 23 août 2026, ChatGPT Work et Codex utilisent un pool commun de limites, de prix et de crédits. Fast Mode apporte environ 1,5 fois plus de vitesse, mais consomme davantage de crédits : le résumé actuel de la documentation mentionne un multiplicateur de 2× pour GPT-5.4 et de 2,5× pour GPT-5.5 et GPT-5.6. La documentation indique aussi les commandes /fast on, /fast off et /fast status ; la configuration est accessible via config.toml.

Un signal de la communauté illustre bien le côté subjectif de ce calcul. Un utilisateur a indiqué avoir dépensé 15 % du quota d'une offre 20x en une journée avec Fast, puis environ 10 % sur deux jours en mode normal ; un autre message évoquait des réinitialisations de quota. Ce n'est ni un test contrôlé ni une mesure officielle : je le considère donc seulement comme un avertissement sur la visibilité de cette consommation.

La vitesse se heurte à l'économie du quota

Fast Mode n'a de sens que lorsque la latence des réponses bloque réellement le travail. Avec un gain annoncé d'environ 1,5 fois et une consommation multipliée par 2 ou 2,5, la vitesse progresse moins vite que l'usage du quota. Pour les longues tâches agentiques, l'échange peut coûter cher, surtout si le temps part dans les outils, les fichiers et les vérifications plutôt que dans la génération.

Je regarderais d'abord deux indicateurs : le quota consommé par tâche terminée et le temps total nécessaire pour obtenir un résultat exploitable. Si Fast affiche simplement les étapes intermédiaires plus tôt sans raccourcir le cycle complet, il devient difficile de justifier une consommation doublée ou supérieure. Le modèle compte aussi, puisque le multiplicateur en dépend.

Chat-to-Work semble être l'amélioration la plus fondamentale. Il préserve le contexte entre la conversation et l'exécution, alors que Fast Mode achète surtout moins de latence sur le quota commun. Le constat est simple : cette transition fluide restera utile, mais Fast devra sans cesse prouver sa valeur sur des tâches réelles.

Nous avons précédemment couvert le déploiement en préversion de Codex dans ChatGPT sur Android et ses conséquences pour les équipes de développement à distance. Ce lancement apporte un contexte utile sur l'évolution du travail avec Codex via le chat dans l'ensemble du produit.