Precios de GPT-6 Astra: costes de la API, tokens y límites

gpt-6-astra-pricing-hero

Respuesta rápida: Precios del GPT-6 Astra $10 por cada millón de tokens de entrada, $1 por cada millón de tokens de entrada almacenados en caché, $12,50 por cada millón de tokens de escritura en caché, y $50 por cada millón de tokens emitidos a tarifas estándar, siempre que el prompt tenga 272 000 tokens de entrada o menos. Por encima de 272 000, la solicitud completa pasa a aplicarse la tarifa de contexto largo: $20 de entrada, $2 de entrada en caché, $25 de escrituras en caché y $75 de salida por cada 1 millón de tokens. OpenAI especifica una ventana de contexto de 1,05 millones de tokens y una salida máxima de 128 000.

Esas cifras hacen que Astra sea potente, pero lo suficientemente cara como para que sea necesario planificar su uso. Una solicitud repetida puede resultar mucho más barata cuando el almacenamiento en caché funciona, mientras que una solicitud que apenas supere los 272 000 tokens de entrada puede resultar considerablemente más cara. Esta guía distingue entre los precios oficiales, los ejemplos calculados y las seis tareas prácticas que realizaremos cuando Astra llegue a nuestro entorno de pruebas.

gpt-6 astra en globalgpt

Precios de la API de GPT-6 Astra

OpenAI divide los precios estándar en contexto corto y largo. El umbral se basa en fichas de entrada, y no la suma total de la entrada y la salida. El contexto corto abarca entradas de hasta 272 000 tokens; el contexto largo se aplica a partir de esa cifra.

Pruebas oficiales del modeloDirectorio de modelos para desarrolladores OpenAI que muestra GPT-6 Astra
OpenAI presenta GPT-6 Astra como su modelo estrella para el razonamiento complejo y la programación. Fuente: Desarrolladores de OpenAI, consultado el 4 de septiembre de 2026.
Tarifas estándar de la API

Coste por cada millón de tokens

Consultado el 4 de septiembre de 2026
ENTRADA SIN ALMACENAR EN LA MEMORIA CACHÉ$10breve contexto
ENTRADA ALMACENADA EN LA MEMORIA CACHÉ$1breve contexto
ESCRITURA EN LA CACHÉ$12.50breve contexto
RESULTADO$50breve contexto
Contexto breve: entrada de 272 000 o menosEntrada $10 | Almacenada en caché $1 | Escritura $12,50 | Salida $50
Contexto extenso: más de 272 000 entradasEntrada $20 | En caché $2 | Escritura $25 | Salida $75

El tramo superior se aplica a toda la solicitud. Los precios indicados son por cada millón de tokens.

Documentación oficial sobre preciosPrecios de la API de GPT-6 Astra para contextos cortos y largos
Precios de GPT-6 Astra de OpenAI por cada millón de tokens, consultados el 4 de septiembre de 2026.

Lo más importante es que al superar los 272K no se genera una factura con tarifas mixtas. Según Documentación sobre precios de la API de OpenAI, las tarifas más elevadas se aplican a toda la solicitud cuando la entrada supera el umbral. Por lo tanto, los equipos que comparen Astra con un producto estrella anterior deberían mirar más allá del precio de entrada que aparece en los titulares; nuestro Guía de precios de GPT-5.6 ofrece un contexto útil para ese debate sobre el presupuesto.

El almacenamiento en caché de las entradas puede reducir considerablemente los costes de las entradas repetidas, pero la creación de la caché tiene un coste. Una escritura en caché cuesta 1,25 veces la tarifa de entrada sin caché aplicable. El procesamiento por lotes y Flex cuestan 50% de Standard, mientras que Fast cuesta el doble de la tarifa aplicable. El procesamiento regional elegible añade 10%, y Fast no está disponible para Astra con residencia de datos en la UE.

¿Cuánto cuesta una llamada a la API de Astra con GPT-6?

En el caso de una solicitud estándar, calcula cada categoría de tokens facturados por separado y, a continuación, suma los resultados:

Coste total = coste de entrada sin caché + coste de entrada con caché + coste de escritura en caché + coste de salida.

12 500 de entrada + 2 000 de salida(0,0125 × $10) + (0,002 × $50)$0.225
100 000 sin almacenar en caché + 5 000 de salida(0,1 × $10) + (0,005 × $50)$1.25
100 000 en caché + 5 000 de salida(0,1 × $1) + (0,005 × $50)$0.35
300 000 de contexto + 10 000 de salida(0,3 × $20) + (0,01 × $75)$6.75

Las estimaciones con tarifas estándar no incluyen herramientas, recargos regionales ni otros servicios que se facturan por separado.

Los 100 000 ejemplos muestran por qué son importantes los prefijos reutilizables: la estimación de «modelo-token» desciende de $1,25 a $0,35 cuando todas las entradas cumplen los requisitos para ser almacenadas en caché. Se trata de un ejemplo de fijación de precios, no de una promesa de que cada prompt repetido vaya a generar un acierto en la caché. Para una estimación presupuestaria multimodelo más amplia, compara los supuestos del flujo de trabajo en nuestro Guía de modelos de IA «todo en uno».

Tokens de GPT-6 Astra, ventana de contexto y límites de salida

En página oficial del modelo GPT-6 Astra documenta un Ventana contextual de 1.050.000 fichas y un Producción máxima de 128 000 tokens. Su fecha límite de conocimientos es el 30 de abril de 2026. Acepta entradas de texto e imágenes, devuelve texto y admite los ajustes de nivel de razonamiento. bajo, medio, alto, xalto, y máx..

Especificaciones oficialesEspecificaciones del modelo GPT-6 Astra en la documentación para desarrolladores OpenAI
GPT-6 Astra admite una ventana de contexto de 1,05 millones y hasta 128 000 tokens de salida. Fuente: OpenAI Developers.

Una ventana de contexto amplia es una capacidad, no una recomendación para satisfacer todas las solicitudes. La recuperación, la selección de documentos, la síntesis y la estructura de las indicaciones pueden mantener la entrada por debajo del límite de 272K. La elección del modelo también es importante: los desarrolladores centrados en la programación pueden comparar las ventajas e inconvenientes en nuestro mejor modelo de IA para codificación realizar un análisis, en lugar de dar por sentado que el modelo con la ventana más amplia es automáticamente el que mejor se ajusta.

Seis tareas prácticas para probar la API de GPT-6 Astra

Estado de las pruebas: Nuestro entorno de pruebas actual aún no incluye GPT-6 Astra, por lo que los siguientes datos son protocolos de prueba y no resultados de pruebas de rendimiento declarados. Las tablas oficiales de precios y límites nos permiten calcular el comportamiento de facturación previsto; el uso medido, la latencia, las cabeceras y las capturas de pantalla se añadirán una vez que la ruta del modelo esté disponible.

Cola de pruebas editoriales

Seis comprobaciones, un criterio probatorio

Ruta de API pendiente
01CONTABILIDAD

Comprobar la contabilidad de tokens

Solicita un cálculo de costes en formato JSON utilizando 12 500 tokens de entrada sin almacenar en caché y 2 000 tokens de salida.

Devuelve un JSON que contenga únicamente las claves «input_cost», «output_cost» y «total_cost».

Cálculo previsto: $0,125 + $0,10 = $0.225.

02CACHE

Almacenamiento en caché de las indicaciones de medición

Envía dos veces el mismo prefijo de factura sintética y cambia únicamente la consulta final. Registra el total de entradas, las entradas almacenadas en caché, los tokens de escritura en caché, las salidas y los tiempos.

Descuento publicado: 90% para entradas almacenadas en caché con contexto breve. No se da por hecho que se produzca una coincidencia real en la caché.
03LÍMITE DE COSTES

Entrada Cross 272K

Compara conjuntos sintéticos equivalentes ligeramente por debajo y por encima de 272K. Recoge datos sobre los tokens reales, el rango de tarifas, el estado, la latencia y el coste total.

Puerta de salida: requiere autorización previa a su ejecución, ya que la tarifa más elevada se aplica al importe total de la solicitud.
04RAZONAMIENTO

Comparar el mínimo con el máximo

Ejecuta el mismo problema sobre el coste mensual de la API en bajo y máx.. Compara la corrección, el resultado visible, los tokens de razonamiento, el tiempo transcurrido y el coste estimado.

BAJOMAX
05LÍMITE MÁXIMO DE SALIDA

Comprueba el límite de 128K

Establecer max_output_tokens hasta 128 001 con un pequeño mensaje que diga “Responder solo con OK”, y luego repite el proceso con el límite máximo legal.

Validación de pruebas sin necesidad de adquirir una respuesta de 128K.

06ENCABECADOS + MODOS

Consultar los límites en tiempo real

Registra los encabezados y los reinicios de RPM/TPM procedentes de llamadas normales. Compara los tipos «Estándar», «Por lotes», «Flex» y «Rápido» únicamente en aquellos casos en que la cuenta y la región los admitan.

EstándarLoteFlexRápido

No se publica ningún resultado de pruebas de rendimiento, afirmación sobre la latencia, acierto en la caché ni consumo facturado hasta que se disponga de respuestas válidas y capturas de pantalla.

Límites de uso de la API de GPT-6 Astra

GPT-6 Astra no está disponible en el nivel gratuito. Los límites publicados aumentan según el nivel de uso, pero los encabezados de los proyectos activos siguen siendo la fuente más práctica para conocer la capacidad restante y los plazos de restablecimiento.

Niveles de uso publicados

La capacidad aumenta considerablemente en el Nivel 5

El plan gratuito no es compatible
T1
T2
T3
T4
T5
NivelSolicitudes/minFichas/minCola de lotes
Nivel 1500 rpm500 000 TPM1,5 millones de tokens
Nivel 25.000 rpm1 millón de TPMFichas de 3M
Nivel 35.000 rpm2M TPM100 millones de tokens
Nivel 410 000 rpm4M TPM200 millones de tokens
Nivel 515 000 rpm40 millones de TPM15B fichas

La altura de la barra es orientativa. Los valores exactos de RPM, TPM y la cola de lotes son los que determinan el control.

Pruebas oficiales sobre el límite de tasasTabla de límites de velocidad de OpenAI GPT-6 Astra, que muestra desde el plan gratuito hasta el nivel 5
OpenAI ha publicado los límites de RPM, TPM y colas de lotes de GPT-6 Astra. La captura de pantalla está recortada ajustada a la tabla oficial completa.

Las modalidades «Batch» o «Flex» pueden reducir a la mitad las tarifas por token del modelo cuando no se necesitan respuestas inmediatas. La modalidad «Fast» puede ser adecuada para tareas en las que la latencia es un factor importante, pero duplica el precio aplicable y no está disponible con la residencia de datos en la UE para Astra. Antes de implementar una carga de trabajo en producción, compara el coste del modelo con los gastos asociados a la plataforma; nuestro Guía de precios de Codex ilustra por qué no se deben mezclar las suscripciones a productos y la facturación de las API.

Lo que revelan las primeras reseñas

El creador independiente Matt Wolfe ha publicado un primer vídeo de avance en el que se muestran demostraciones de programación, uso de ordenadores, Blender y Unreal Engine. Estos ejemplos resultan útiles para comprender el tipo de flujos de trabajo que están explorando los revisores, pero no constituyen pruebas de rendimiento controladas y no sustituyen a las pruebas de API mencionadas anteriormente. Comparaciones más amplias, como ChatGPT frente a Claude frente a Gemini Asimismo, debe interpretarse como una orientación específica para cada carga de trabajo, y no como una clasificación universal.

Primer vistazo independientePágina del vídeo de la reseña del Astra de Matt Wolfe GPT-6
Matt Wolfe ha publicado un primer análisis práctico de GPT-6 Astra. Fuente: YouTube.

¿Quién debería utilizar GPT-6 Astra?

Astra resulta una opción plausible para tareas de programación complejas, flujos de trabajo basados en agentes, análisis de documentos extensos y trabajos multimodales en los que un razonamiento más sólido o una ventana de contexto muy amplia puedan compensar un coste elevado por token. Los equipos deberían probarla en una tarea concreta y cuantificable, y comparar la relación calidad-precio, no solo la calidad del resultado. Nuestra Resumen de los mejores modelos de IA ofrece un marco de selección más amplio.

  • Utiliza Astra cuando: la tarea es compleja, los errores salen caros, se necesita un contexto extenso o el modelo puede sustituir a varias pasadas menos potentes.
  • Utiliza un modelo más barato cuando: El trabajo consiste en tareas rutinarias de clasificación, extracción, reescritura o generación de grandes volúmenes de contenido, con requisitos de calidad sencillos.
  • Optimiza primero cuando: las solicitudes superan repetidamente los 272 000, los prefijos estáticos de gran tamaño se pueden almacenar en caché, o la latencia no requiere un procesamiento estándar o rápido.

Para los lectores que estén comparando opciones premium similares, el Comparación entre GPT-5.6, Fable 5 y GPT-5.5 ofrece otra perspectiva sobre el coste, la capacidad y la adecuación a la carga de trabajo. GlobalGPT cuenta ahora con una Página de inicio de GPT-6 Astra. Esa ruta del producto es independiente de nuestro entorno de pruebas de la API, que sigue sin incluir Astra en las seis pruebas analizadas en este artículo.

Preguntas frecuentes sobre los precios de GPT-6 Astra

¿Cuánto cuesta GPT-6 Astra por cada millón de tokens?

Con las tarifas estándar para un máximo de 272 000 tokens de entrada, GPT-6 Astra cuesta $10 por cada millón de tokens de entrada sin almacenar en caché, $1 por cada millón de tokens de entrada almacenados en caché, 1 TP41T12,50 por cada millón de tokens de escritura en caché y 1 TP41T50 por cada millón de tokens de salida.

¿Qué ocurre cuando una consulta de GPT-6 Astra supera los 272 000 tokens?

Cuando la entrada supera los 272 000 tokens, toda la solicitud se factura según las tarifas de contexto largo: 1 TP, 41 T y 20 de entrada; 1 TP, 41 T y 2 de entrada en caché; 1 TP, 41 T y 25 de escrituras en caché; y 1 TP, 41 T y 75 de salida por cada millón de tokens, según la tarifa estándar.

¿Qué es la ventana de contexto de GPT-6 Astra?

OpenAI especifica una ventana de contexto de 1 050 000 tokens y una salida máxima de 128 000 tokens para GPT-6 Astra. La capacidad de contexto no elimina el umbral de precios de 272K.

¿Son las modalidades «Batch» y «Flex» más baratas que la «Standard»?

Sí. Los precios de OpenAI para Batch y Flex se fijan en 50% de las tarifas estándar por token del modelo. Son adecuados para cargas de trabajo que puedan adaptarse a sus condiciones de procesamiento; no deben considerarse sustitutos idénticos de las solicitudes sincrónicas del modelo Standard.

¿Está disponible GPT-6 Astra en el nivel gratuito de la API?

En la tabla de límites de tasa publicada por el n.º OpenAI, el nivel gratuito aparece como «no compatible». Los niveles de uso de pago comienzan con los límites del Nivel 1: 500 RPM, 500 000 TPM y una cola de lotes de 1,5 millones de tokens.

¿Ha completado GlobalGPT las pruebas prácticas de GPT-6 Astra?

Todavía no. El entorno de pruebas actual no ofrece una ruta verificada de GPT-6 Astra. Las seis tareas que se describen en este artículo son protocolos publicados, y los resultados de las mediciones solo se añadirán una vez que se puedan documentar solicitudes que hayan tenido éxito.

Veredicto final

GPT-6 Astra combina una ventana de contexto de 1,05 millones de tokens y una salida máxima de 128.000 con una tarifa premium. Su tarifa «Standard» para contextos cortos parte de $10 por cada millón de tokens de entrada y de $50 por cada millón de tokens de salida, pero el límite de 272 000, los tokens de razonamiento, las escrituras en caché, el modo de procesamiento y el recargo regional pueden modificar sustancialmente el coste. Calcula el número de tokens antes de enviar solicitudes extensas, comprueba el almacenamiento en caché a partir de los datos de uso y evalúa Astra en función del valor de la tarea completada, en lugar de basarte únicamente en el precio nominal.

Comparte el post:

Entradas relacionadas