3 min de lectura

Codex ya puede buscar en el historial de sesiones largas

Codexуправление контекстомавтономные агенты

Codex incorporó un modo experimental de gestión de contexto que sustituye la compresión repetida del diálogo por notas estructuradas, búsqueda en el historial y la herramienta new_context. Es relevante porque los agentes de larga duración pueden conservar requisitos y resultados de herramientas entre distintas ventanas de contexto.

Codex cambia su forma de trabajar con contextos largos

Lo interesante no es la palabra compact en sí, sino el cambio en el mecanismo de memoria: Codex recibió un modo experimental con notas estructuradas y búsqueda en el historial anterior de la sesión. El registro de cambios de ChatGPT/Codex y la referencia de configuración de OpenAI indican que el modo conserva detalles acumulados entre ventanas de contexto e incorpora la herramienta new_context. En vez de generar otro resumen de toda la conversación, el agente puede abrir una ventana nueva y recuperar mensajes anteriores o resultados de herramientas cuando los necesite.

En un mensaje de usuario, el modo se activa con el comando codex features enable context_management.experimental_mode. La opción documentada de configuración establece features.context_management.experimental_mode en true. A fecha del 5 de septiembre de 2026, la función está desactivada por defecto y solo está disponible para sesiones elegibles de ChatGPT Plus, Pro y Pro Lite en el backend de Codex, no para sesiones con clave de API ni proveedores externos.

La lógica tiene sentido. Las notas guardan los hechos estables, mientras que la búsqueda devuelve detalles que no llegaron a ellas: un requisito anterior, una decisión del plan o la conclusión de una herramienta. Para la programación autónoma, resulta más práctico que el ciclo de comprimir, olvidar una parte y continuar, especialmente cuando la tarea atraviesa varias ventanas de contexto.

Un usuario inició una ejecución nocturna para probar el modo con un contexto largo. Otro destacó por separado que el texto se volvió bastante más legible: ahora se pueden revisar planes de investigación y resúmenes complejos sin habilidades adicionales. Aun así, no hay cifras oficiales sobre la calidad del modo experimental, por lo que de momento es una idea de diseño sólida y una señal temprana de UX, no una mejora demostrada en benchmarks.

Las tareas largas de agentes obtienen una memoria más estable

El cambio principal es sencillo: el agente ya no tiene que meter todo el historial útil en un único resumen que se reescribe constantemente. Esto reduce el riesgo de perder una decisión, una restricción o el resultado de una herramienta solo porque no sobrevivieron a la siguiente compresión. Los refactors extensos, las tareas de investigación y los ciclos de depuración con planes cambiantes serán los mayores beneficiados.

Primero miraría la precisión de la búsqueda y la calidad de las propias notas. Si el agente guarda ruido o recupera un fragmento formalmente parecido pero obsoleto, la memoria larga puede convertirse rápidamente en confusión larga. Otra cuestión es cuán predeciblemente decide el modelo cuándo llamar a new_context y qué hechos debe trasladar adelante.

No es una ventana de contexto infinita y mágica. Más bien, Codex obtuvo una forma más técnica de convivir con una ventana finita sin fingir que un único resumen siempre basta. La pregunta pendiente ya no es si el agente puede recordar, sino con qué precisión entiende qué merece ser recordado.

Antes analizamos cómo las interfaces de mapas de código mejoran la inyección de contexto y la navegación en el desarrollo asistido por IA. Esos mismos retos de selección de contexto están en el centro del modo experimental de Codex para agentes de larga ejecución.