3 min de lecture

Codex épuise-t-il l'usage plus vite ?

CodexAI-агентылимиты подписки

Des utilisateurs de Codex signalent que leur usage s'épuise deux à trois fois plus vite depuis deux jours, et qu'un petit site aurait consommé 12 % d'un quota. Cela ne prouve pas une modification des limites, mais illustre le coût des cycles autonomes d'un agent de code.

Ce que les utilisateurs ont constaté

Je ne qualifierais pas encore cela de réduction silencieuse des limites de Codex : les informations disponibles ne comportent aucune confirmation officielle. Le signal utilisateur reste néanmoins assez précis : l'usage serait consommé deux à trois fois plus vite, et ce changement aurait été observé au cours des deux derniers jours.

La source première n'est ni une fiche de modèle ni un changelog, mais une discussion entre utilisateurs de Codex accessible le 21 septembre 2026. Un participant a décrit une consommation accélérée, un autre l'a reliée en plaisantant au passage d'un abonnement à 20 vers un abonnement à 100, et un troisième a indiqué que 12 % étaient partis pour un site de quelques pages.

Ces témoignages ne constituent pas une preuve de modification des quotas. On ignore le modèle choisi, la longueur du contexte, le nombre de requêtes, le volume des fichiers et le nombre d'actions réalisées par l'agent. Même la mention des 12 % ne précise pas quelle limite était affichée dans l'interface.

Le mécanisme général est toutefois crédible. Un agent de code autonome ne consomme pas des ressources uniquement pour sa réponse finale : il lit plusieurs fichiers, appelle des outils, modifie le code, lance des builds ou des tests, puis recommence le cycle après une erreur. Un résultat final réduit ne signifie pas forcément un faible volume de calcul.

Une pression semblable sur les quotas est visible au-delà de Codex. Dans une mise à jour des limites de Claude Code, Anthropic a annoncé le doublement des limites sur cinq heures et la suppression des restrictions aux heures de pointe pour les offres payantes. Cela n'explique pas ce cas précis, mais confirme que la programmation agentique se heurte régulièrement aux cadres d'abonnement.

Le quota devient un élément de l'architecture de travail

Pour établir un budget, la conclusion est simple : compter seulement les tâches n'a plus de sens. Un cycle multi-fichiers avec compilations, tests et corrections répétés peut être plus lourd que des dizaines de requêtes courtes, même si l'utilisateur ne voit qu'une seule tâche confiée.

Je comparerais d'abord non pas les impressions, mais le mode du modèle, la longueur du prompt, le volume de contexte joint et le nombre de cycles d'outils. Si la consommation a réellement augmenté à scénario identique, l'hypothèse d'un changement de comptabilisation ou de limites devient plus solide. Pour l'instant, les données restent insuffisantes.

Le changement essentiel a déjà eu lieu : l'usage n'est plus un simple chiffre en arrière-plan de l'interface. Pour les agents IA autonomes, c'est une ressource limitée au même titre que le temps de build ou le budget de calcul, sauf que son coût réel n'apparaît souvent qu'après le lancement du cycle.

Nous avons déjà expliqué comment les limites de contexte de Claude, le raisonnement étendu et les configurations de modèles entraînent des coûts d'usage plus élevés. Cette analyse aide à comprendre pourquoi les assistants de programmation peuvent consommer des tokens plus vite que les équipes ne l'anticipent.