3 min de lectura

GPT-6.1 Sol: Ultrafast cambia la economía de Codex

GPT-6.1 SolCodexUltrafast

OpenAI presentó GPT-6.1 Sol, el nivel de velocidad Ultrafast, Decisions API y un harness de Codex de código abierto. Ultrafast promete hasta 300 tokens por segundo y mayor rapidez en Codex, pero cuesta seis veces más que la tarifa API estándar, tendrá acceso inicial limitado y no confirma una rebaja del 95%.

Qué añadió OpenAI a GPT-6.1 Sol y Codex

No reduciría este lanzamiento a otra mejora de velocidad del modelo. En su resumen de DevDay 2026 y en los materiales de referencia de ChatGPT Learn, OpenAI describe varios cambios relacionados: GPT-6.1 Sol, los niveles Fast y Ultrafast, Decisions API y un harness de Codex de código abierto.

La cifra clave de Ultrafast es de hasta 300 tokens por segundo y una generación hasta ocho veces más rápida en Codex. Para la API se anuncia una aceleración de hasta seis veces. Sin embargo, se trata de rendimiento de generación, no de la promesa de terminar una tarea completa en el mismo múltiplo de tiempo.

El precio tampoco parece una oferta agresiva. En el lanzamiento, Ultrafast costaba seis veces la tarifa estándar de la API. Por eso, la afirmación repetida en algunos debates sobre una reducción del 95% no está respaldada por los materiales oficiales de OpenAI.

La disponibilidad tiene un matiz importante. GPT-6.1 Sol se anuncia para usuarios Plus, Pro, Business, Enterprise y Edu en ChatGPT Work y Codex, pero el soporte Ultrafast para Sol llegará más tarde. Al inicio, Ultrafast estaba dirigido a suscriptores Pro de 500 dólares y a espacios Enterprise y Edu aptos, según los permisos del administrador.

Decisions API resuelve una tarea más concreta: recibe una pregunta, un conjunto limitado de opciones y contexto, y luego elige una respuesta. Es una interfaz para enrutamiento, clasificación y selección del siguiente paso sin generación abierta innecesaria. El harness abierto de Codex permite, por su parte, examinar y modificar la capa que conecta el modelo con flujos de trabajo e integraciones.

Por qué más velocidad no implica desarrollo más barato

Ultrafast sí cambia la ecuación cuando la latencia importa más que el precio. La programación interactiva, los ciclos cortos de corrección y las tareas paralelas de agentes pueden beneficiarse de una entrega de tokens más rápida, aunque cada solicitud cueste más.

Lo primero que compararía no son los tokens por segundo, sino el tiempo total para completar la tarea. La planificación, las llamadas a herramientas, las pruebas y los reintentos no desaparecen. Si la generación ocupa solo una parte del ciclo, una mejora anunciada de ocho veces puede convertirse fácilmente en una ganancia final mucho menor.

Decisions API parece menos espectacular, pero desde la ingeniería puede resultar más práctica. Un conjunto de respuestas limitado es más fácil de validar e integrar en un flujo determinista. Hay menos magia, pero un contrato más claro y puntos de fallo más visibles.

La estrategia de OpenAI se entiende bien: segmentar un mismo modelo por clase de latencia y cobrar una prima por la urgencia. La prueba real de Ultrafast llegará cuando la velocidad de generación se encuentre con herramientas lentas, ciclos largos de agentes y el coste real de una tarea terminada.

Anteriormente analizamos el lanzamiento de Codex de OpenAI en ChatGPT para Android y lo que supone para los flujos de desarrollo remoto. Ese contexto ayuda a entender el impacto práctico de las últimas mejoras de rendimiento y precios de Codex.