Respuesta rápida: Los precios de la API GPT-5.5 empiezan en $5 por cada millón de tokens de entrada, $0,50 por cada millón de tokens de entrada almacenados en caché, y $30 por cada millón de tokens emitidos. El modelo admite una ventana de contexto de 1 050 000 tokens y hasta 128 000 tokens de salida. La clave es que las solicitudes que superen los 272 000 tokens de entrada provocan un aumento de las tasas durante toda la sesión.
GPT-5.5 está diseñado para tareas exigentes de programación y trabajo profesional, pero su precio no es una cantidad mensual fija. El coste real depende de cómo se acceda al servicio, del número de tokens que se envíen y reciban, de si las entradas repetidas pueden almacenarse en caché y de si una solicitud supera el umbral de precios para contextos largos.
Esta guía desglosa cada uno de estos aspectos. Explica las tarifas de los tokens de API, los precios en función del contexto extenso, las opciones «Batch» y «Flex», ejemplos prácticos de costes y la diferencia entre pagar por un plan de chat y pagar por el uso de la API.
Si quieres utilizar GPT-5.5 sin configurar la facturación ni el código para una cuenta API directa, GPT-5.5 sobre GlobalGPT ofrece una forma más sencilla de seleccionar modelos. Además, permite mantener otros modelos de IA en la misma plataforma, lo cual resulta útil cuando basta con un modelo más económico para una parte del trabajo.
Índice
¿Cuánto cuesta GPT-5.5?
En OpenAI se indican los precios de los tokens de texto de GPT-5.5 por cada millón de tokens. El página oficial del modelo GPT-5.5 muestra las siguientes tasas básicas:
Tarifas básicas de la API GPT-5.5
Fuente: Documentación de los modelos OpenAI y GPT-5.5, consultada el 3 de agosto de 2026. Las instrucciones largas y el procesamiento regional pueden modificar la tasa efectiva.
| Tipo de token | Precio base por cada millón de tokens | Qué incluye |
|---|---|---|
| Entrada | $5.00 | Tu solicitud, las instrucciones del sistema, el historial de conversaciones, los documentos, los resultados de las herramientas y las imágenes introducidas tras la tokenización. |
| Entrada almacenada en caché | $0.50 | Contenido repetido de las indicaciones que cumple los requisitos y que OpenAI reconoce mediante el almacenamiento en caché de las indicaciones. |
| Salida | $30.00 | Los tokens de respuesta visibles, más los tokens de razonamiento generados por el modelo, se facturan como salida. |
La salida es seis veces superior a la tarifa básica de entrada, por lo que las respuestas largas pueden encarecer considerablemente la factura. Un flujo de trabajo que envíe un documento extenso pero solicite una clasificación breve puede resultar más económico que una solicitud breve que genere un informe muy extenso.
No confundas los precios de la API con una suscripción. Las cifras anteriores corresponden a las tarifas de la API según el consumo. Esto no significa que el plan GPT-5.5 cueste $5 al mes, ni que una suscripción al plan ChatGPT incluya automáticamente créditos de la API.
Planos y rutas de acceso de la línea GPT-5.5
“La ”tarificación GPT-5.5» puede referirse a tres modalidades de compra diferentes. Elige la modalidad antes de comparar las cifras, ya que cada una mide el consumo de forma distinta.
| Ruta de acceso | Formas de pago | Lo mejor para | Limitación principal |
|---|---|---|---|
| API de OpenAI | Uso de tokens medido, más los cargos aplicables por el uso de las herramientas | Aplicaciones, automatizaciones, agentes, sistemas de producción y desarrolladores que necesitan controlar el uso | Requiere la configuración de la API, la facturación y el seguimiento de los costes |
| Plan ChatGPT | Suscripción con límites de acceso y uso específicos del plan | Personas que buscan una interfaz de chat ya preparada | La disponibilidad y las limitaciones pueden depender del plan actual, la cuenta, la región y la fase de implantación. |
| GlobalGPT | Plan de plataforma o créditos según las condiciones actuales de GlobalGPT | Personas que desean disponer de GPT-5.5 y otros modelos en una única interfaz sin necesidad de configurar directamente la API | Los créditos son una medida propia de la plataforma y no deben considerarse como dólares de la API OpenAI. |
Procesamiento estándar de la API
El procesamiento estándar es la referencia para la mayoría de las estimaciones de costes de la API. Utiliza las tarifas de entrada $5, de entrada en caché $0,50 y de salida $30, a menos que tu solicitud cumpla los requisitos para un nivel de procesamiento diferente o supere el umbral de contexto largo.
API por lotes
La API por lotes de OpenAI está diseñada para tareas asíncronas que no requieren una respuesta inmediata. La página oficial de precios de la API muestra las tarifas reducidas por token para los trabajos por lotes que cumplen los requisitos. Puede resultar una buena opción para evaluaciones a gran escala fuera de línea, el etiquetado de documentos, el enriquecimiento de datos o el procesamiento nocturno, en los que el plazo de entrega es flexible.
Procesamiento Flex
El procesamiento «Flex» sacrifica la consistencia en los tiempos de respuesta y la disponibilidad a cambio de un precio más bajo. Es adecuado para trabajos que no sean de producción o de baja prioridad y que puedan tolerar un procesamiento más lento o, en ocasiones, la indisponibilidad del servicio.
Tramitación prioritaria y regional
El procesamiento prioritario tiene un coste adicional a cambio de un nivel de servicio de mayor prioridad. OpenAI también establece que los puntos finales de procesamiento regionales conllevan un recargo de 10% por GPT-5.5.
Cómo influyen los tokens en tu factura GPT-5.5
Un token es un fragmento de texto u otra entrada del modelo. No es lo mismo que una palabra. El texto en inglés suele tener, de media, más de un token por palabra una vez que se incluyen los signos de puntuación, el formato, el código, las tablas y los caracteres especiales.
coste = (tokens de entrada / 1 000 000 × tasa de entrada) + (tokens de salida / 1 000 000 × tasa de salida)
La entrada almacenada en caché se calcula según una tarifa independiente. Las llamadas a herramientas pueden añadir sus propios cargos, por lo que el cálculo de los tokens por sí solo puede no coincidir con el coste final de la solicitud cuando se trata de búsquedas en la web, uso de ordenadores u otras herramientas de pago.
¿Qué se considera entrada y qué se considera salida?
- Los datos de entrada incluyen indicaciones, instrucciones del sistema, historial, documentos, resultados de herramientas, datos estructurados e imágenes tras la tokenización.
- El resultado incluye la respuesta generada y los tokens de razonamiento facturables.
- La entrada almacenada en caché incluye el contenido repetido de las indicaciones que cumple los requisitos y que se ha reconocido mediante el almacenamiento en caché de las indicaciones.
La ventana de contexto GPT-5.5 y el umbral de precios de 272K
GPT-5.5 admite un Ventana contextual de 1.050.000 fichas y hasta 128 000 tokens de salida. La ventana de contexto es el espacio de trabajo total disponible para la solicitud, incluyendo la entrada, el historial relevante, los resultados de las herramientas y la salida generada.
Cuando una solicitud GPT-5.5 contiene más de 272 000 tokens de entrada, la sesión completa se factura a El doble de la frecuencia de entrada normal y 1,5 veces el caudal normal. A las tasas básicas, eso equivale a $10 por cada millón de tokens de entrada y a $45 por cada millón de tokens de salida.
Advertencia práctica: Mide la solicitud final ya montada, incluyendo el contenido recuperado y el historial, en lugar del tamaño del archivo con el que empezaste.
Ejemplos de costes del GPT-5.5
Estos ejemplos utilizan las tarifas básicas de la API y no incluyen las llamadas a herramientas de pago, los recargos regionales ni los multiplicadores de contexto extenso, salvo que se indique lo contrario.
Calculadora de costes por tarea GPT-5.5
Elige una carga de trabajo habitual y, a continuación, mueve uno de los controles deslizantes. La calculadora aplica automáticamente un perfil de tokens representativo por tarea.
Estimación por tarea: 4.000 tokens de entrada + 2.000 tokens de salida.
100 tareas × ($0,02 de entrada GPT-5.5 + $0,06 de salida GPT-5.5) = $8,00
Los perfiles de tokens de carga de trabajo son estimaciones editoriales, no garantías fijas de uso de OpenAI.
| Ejemplo | Entrada | Salida | Coste estimado |
|---|---|---|---|
| Respuesta breve y profesional | 10,000 | 2,000 | $0.11 |
| Revisión de documentos de gran volumen | 100,000 | 10,000 | $0.80 |
| Entrada repetida de 100 000 con acierto total en la caché | 100 000 almacenados en caché | 10,000 | $0.35 |
| Sesión de contexto largo superior a 272K | 300,000 | 20,000 | $3.90 |
Cómo reducir los costes del GPT-5.5
- Derivar el trabajo sencillo a un modelo más económico.
- Siempre que sea posible, mantén las solicitudes por debajo de los 272K.
- Reutiliza los prefijos de prompt estables.
- Establece un límite de salida.
- Utiliza «Batch» para los trabajos asíncronos.
- Realiza un seguimiento de los tokens por tarea.
- Costes de herramientas por separado.
Con GlobalGPT, puedes reservar el GPT-5.5 para trabajos exigentes y elegir otro modelo cuando la velocidad o un menor consumo sean más importantes.
¿Quién debería utilizar el GPT-5.5?
La opción GPT-5.5 resulta más adecuada cuando el coste de una respuesta menos completa es superior al precio del token adicional. Algunos ejemplos son los cambios complejos en el código, los análisis técnicos extensos, la redacción profesional complicada, el uso de herramientas en varios pasos y el trabajo con documentos de gran volumen.
Puede que no sea necesario para clasificaciones sencillas, reescrituras básicas, resúmenes breves o tareas de gran volumen con reglas predecibles.
Preguntas frecuentes
¿A cuánto equivale 1 TP20T por cada millón de tokens?
El precio base de la API es de $5 por cada millón de tokens de entrada, $0,50 por cada millón de tokens de entrada almacenados en caché y $30 por cada millón de tokens de salida.
¿Se incluye GPT-5.5 en ChatGPT Plus?
Los límites de acceso y uso de los modelos pueden variar según el plan, la cuenta, la región y la fase de implementación. Consulta la página de planes actualizada y tu selector de modelos. Las suscripciones ChatGPT y la facturación de la API son independientes.
¿Qué es la ventana contextual GPT-5.5?
OpenAI especifica una ventana de contexto de 1 050 000 tokens y una salida máxima de 128 000 tokens.
¿Por qué el GPT-5.5 cuesta más a partir de los 272 000 tokens?
La entrada se cobra al doble y la salida a 1,5 veces durante toda la sesión, ya que el procesamiento de contextos muy grandes requiere más recursos de cálculo.
¿La suscripción ChatGPT incluye tokens de API?
Las suscripciones al n.º ChatGPT y el uso de la API se facturan por separado.
¿Los créditos GlobalGPT son lo mismo que los dólares API OpenAI?
Los créditos del n.º GlobalGPT se rigen por el plan y las normas de uso propios del GlobalGPT.




