Codex épuise-t-il l'usage plus vite ?
CodexAI-агентылимиты подписки
Ce que les utilisateurs ont constaté
Je ne qualifierais pas encore cela de réduction silencieuse des limites de Codex : les informations disponibles ne comportent aucune confirmation officielle. Le signal utilisateur reste néanmoins assez précis : l'usage serait consommé deux à trois fois plus vite, et ce changement aurait été observé au cours des deux derniers jours.
La source première n'est ni une fiche de modèle ni un changelog, mais une discussion entre utilisateurs de Codex accessible le 21 septembre 2026. Un participant a décrit une consommation accélérée, un autre l'a reliée en plaisantant au passage d'un abonnement à 20 vers un abonnement à 100, et un troisième a indiqué que 12 % étaient partis pour un site de quelques pages.
Ces témoignages ne constituent pas une preuve de modification des quotas. On ignore le modèle choisi, la longueur du contexte, le nombre de requêtes, le volume des fichiers et le nombre d'actions réalisées par l'agent. Même la mention des 12 % ne précise pas quelle limite était affichée dans l'interface.
Le mécanisme général est toutefois crédible. Un agent de code autonome ne consomme pas des ressources uniquement pour sa réponse finale : il lit plusieurs fichiers, appelle des outils, modifie le code, lance des builds ou des tests, puis recommence le cycle après une erreur. Un résultat final réduit ne signifie pas forcément un faible volume de calcul.
Une pression semblable sur les quotas est visible au-delà de Codex. Dans une mise à jour des limites de Claude Code, Anthropic a annoncé le doublement des limites sur cinq heures et la suppression des restrictions aux heures de pointe pour les offres payantes. Cela n'explique pas ce cas précis, mais confirme que la programmation agentique se heurte régulièrement aux cadres d'abonnement.
Le quota devient un élément de l'architecture de travail
Pour établir un budget, la conclusion est simple : compter seulement les tâches n'a plus de sens. Un cycle multi-fichiers avec compilations, tests et corrections répétés peut être plus lourd que des dizaines de requêtes courtes, même si l'utilisateur ne voit qu'une seule tâche confiée.
Je comparerais d'abord non pas les impressions, mais le mode du modèle, la longueur du prompt, le volume de contexte joint et le nombre de cycles d'outils. Si la consommation a réellement augmenté à scénario identique, l'hypothèse d'un changement de comptabilisation ou de limites devient plus solide. Pour l'instant, les données restent insuffisantes.
Le changement essentiel a déjà eu lieu : l'usage n'est plus un simple chiffre en arrière-plan de l'interface. Pour les agents IA autonomes, c'est une ressource limitée au même titre que le temps de build ou le budget de calcul, sauf que son coût réel n'apparaît souvent qu'après le lancement du cycle.