Astra y Sol: dónde sube realmente el coste de los tokens
AstraSolцены API
Qué muestran los precios y los límites
No incluiría en el presupuesto el supuesto aumento de gasto de 6,25 veces: los precios publicados no lo respaldan. A fecha de 6 de septiembre de 2026, la documentación de OpenAI y la página oficial de precios indican para Astra tarifas estándar de $10 por millón de tokens de entrada, $1 por millón de entrada en caché, $12,50 por millón de escrituras en caché y $50 por millón de tokens de salida.
El modo Fast de Astra duplica las tarifas aplicables. Para solicitudes de más de 272.000 tokens de entrada, se recalcula toda la petición: la entrada sube a $20 por millón y la salida a $75. No es un recargo marginal solo sobre el exceso, sino un nuevo precio para toda la solicitud; por eso, cruzar el umbral por accidente puede distorsionar mucho la factura.
Los materiales de precios recopilados para Sol indican $5 por millón de tokens de entrada y $30 por millón de tokens de salida en modo estándar. Fast o Priority cuestan $10 y $60 respectivamente: el multiplicador es dos, no 2,5. Estas tarifas tampoco producen un gasto 6,25 veces mayor.
Los límites son un asunto distinto. La documentación de Astra muestra un aumento desde 500 solicitudes por minuto y 500.000 tokens por minuto en Tier 1 hasta 15.000 solicitudes y 40 millones de tokens por minuto en Tier 5. Con alta frecuencia, los tokens por minuto suelen alcanzar el techo antes que el número de solicitudes.
Además, algunos usuarios informan de una reducción del límite disponible de aproximadamente un 20% en nueve horas y un 13% en una hora al trabajar en dos hilos. No puede convertirse esa observación directamente en un multiplicador de precio sin datos sobre longitud del contexto, salida, caché y modo elegido. Para Fable, las fuentes recopiladas ni siquiera incluyen una tabla oficial de precios y límites, por lo que aún no es posible una comparación numérica honesta.
Cómo cambia el cálculo del presupuesto
El riesgo principal no es el precio base, sino la combinación de salida cara, modo Fast y contexto largo. Calcularía por separado los tokens de entrada y salida, duplicaría después el resultado para Fast y modelaría aparte las solicitudes que puedan superar el umbral de 272.000 tokens de Astra.
Los prompts repetidos cambian de forma notable la economía de Astra: la entrada en caché cuesta $1 por millón, frente a $10 para la entrada normal. Sin embargo, la caché no resuelve el coste de la salida, y un gran rendimiento no elimina los límites de TPM. Por eso, un coste medio por solicitud es casi inútil sin una distribución de longitudes.
En resumen, las tarifas oficiales muestran un encarecimiento de Fast de dos veces, no de 6,25. Hasta que se aclare el mecanismo de los límites de usuario y se publiquen datos de Fable, la diferencia entre la tabla tarifaria y los cargos observados seguirá siendo la principal incógnita.