3 min de lectura

Astra y Sol: dónde sube realmente el coste de los tokens

AstraSolцены API

Los precios publicados sitúan a Astra en $10 por millón de tokens de entrada y $50 de salida, frente a $5 y $30 para Sol en modo estándar. Fast suele duplicar las tarifas aplicables. El multiplicador de gasto de 6,25 no está respaldado por los precios oficiales, aunque el contexto largo y la salida elevada encarecen la factura.

Qué muestran los precios y los límites

No incluiría en el presupuesto el supuesto aumento de gasto de 6,25 veces: los precios publicados no lo respaldan. A fecha de 6 de septiembre de 2026, la documentación de OpenAI y la página oficial de precios indican para Astra tarifas estándar de $10 por millón de tokens de entrada, $1 por millón de entrada en caché, $12,50 por millón de escrituras en caché y $50 por millón de tokens de salida.

El modo Fast de Astra duplica las tarifas aplicables. Para solicitudes de más de 272.000 tokens de entrada, se recalcula toda la petición: la entrada sube a $20 por millón y la salida a $75. No es un recargo marginal solo sobre el exceso, sino un nuevo precio para toda la solicitud; por eso, cruzar el umbral por accidente puede distorsionar mucho la factura.

Los materiales de precios recopilados para Sol indican $5 por millón de tokens de entrada y $30 por millón de tokens de salida en modo estándar. Fast o Priority cuestan $10 y $60 respectivamente: el multiplicador es dos, no 2,5. Estas tarifas tampoco producen un gasto 6,25 veces mayor.

Los límites son un asunto distinto. La documentación de Astra muestra un aumento desde 500 solicitudes por minuto y 500.000 tokens por minuto en Tier 1 hasta 15.000 solicitudes y 40 millones de tokens por minuto en Tier 5. Con alta frecuencia, los tokens por minuto suelen alcanzar el techo antes que el número de solicitudes.

Además, algunos usuarios informan de una reducción del límite disponible de aproximadamente un 20% en nueve horas y un 13% en una hora al trabajar en dos hilos. No puede convertirse esa observación directamente en un multiplicador de precio sin datos sobre longitud del contexto, salida, caché y modo elegido. Para Fable, las fuentes recopiladas ni siquiera incluyen una tabla oficial de precios y límites, por lo que aún no es posible una comparación numérica honesta.

Cómo cambia el cálculo del presupuesto

El riesgo principal no es el precio base, sino la combinación de salida cara, modo Fast y contexto largo. Calcularía por separado los tokens de entrada y salida, duplicaría después el resultado para Fast y modelaría aparte las solicitudes que puedan superar el umbral de 272.000 tokens de Astra.

Los prompts repetidos cambian de forma notable la economía de Astra: la entrada en caché cuesta $1 por millón, frente a $10 para la entrada normal. Sin embargo, la caché no resuelve el coste de la salida, y un gran rendimiento no elimina los límites de TPM. Por eso, un coste medio por solicitud es casi inútil sin una distribución de longitudes.

En resumen, las tarifas oficiales muestran un encarecimiento de Fast de dos veces, no de 6,25. Hasta que se aclare el mecanismo de los límites de usuario y se publiquen datos de Fable, la diferencia entre la tabla tarifaria y los cargos observados seguirá siendo la principal incógnita.

Antes analizamos cómo el coste del contexto y los ajustes de Claude Opus 4.6 afectan al gasto total al trabajar con el modelo. Ese análisis ayuda a comparar el enfoque de Astra sobre tokens y recargos con otros modelos.