Tout savoir sur la tarification de GPT-5.5 : formules, jetons et contexte

GPT-5.5 La tarification expliquée : Plans, jetons, contexte

Réponse rapide : Les tarifs de l'API GPT-5.5 commencent à $5 par million de jetons d'entrée, $0,50 par million de jetons d'entrée mis en cache, et $30 par million de jetons émis. Le modèle prend en charge une fenêtre de contexte de 1 050 000 tokens et jusqu’à 128 000 tokens en sortie. Il est important de noter que les requêtes comportant plus de 272 000 tokens en entrée entraînent une augmentation des tarifs pour l’ensemble de la session.

GPT-5.5 est conçu pour les tâches de codage exigeantes et les travaux professionnels, mais son prix ne correspond pas à un montant mensuel fixe. Votre coût réel dépend de la manière dont vous y accédez, du nombre de jetons que vous envoyez et recevez, de la possibilité de mettre en cache les entrées répétées, et du fait que la requête dépasse ou non le seuil de tarification lié au contexte long.

Ce guide passe en revue ces différents éléments. Il explique les tarifs des jetons API, la tarification en fonction de la longueur du contexte, les options « Batch » et « Flex », donne des exemples concrets de coûts et présente la différence entre le paiement d'un forfait de chat et celui de l'utilisation de l'API.

Si vous souhaitez utiliser GPT-5.5 sans configurer la facturation ni le code pour un compte API direct, GPT-5.5 sur GlobalGPT offre une approche plus simple pour la sélection des modèles. Elle permet également de conserver d'autres modèles d'IA sur la même plateforme, ce qui s'avère utile lorsqu'un modèle moins coûteux suffit pour une partie de la tâche.

Combien coûte GPT-5.5 ?

Le tarif OpenAI correspond au prix du service de traitement de texte GPT-5.5, exprimé par million de tokens. Le page officielle du modèle GPT-5.5 indique les taux de base suivants :

Taux de base de l'API GPT-5.5

Jetons d'entrée$5.00par million de jetons
Entrée mise en cache$0.50par million de jetons
Jetons de sortie$30.00par million de jetons

Source : documentation des modèles OpenAI et GPT-5.5, consultée le 3 août 2026. Les invites longues et le traitement régional peuvent modifier le taux effectif.

Type de jetonPrix de base pour 1 million de jetonsCe qu'il couvre
Entrée$5.00Votre invite, les instructions du système, l'historique des conversations, les documents, les résultats des outils et les images saisies après la tokenisation.
Entrée mise en cache$0.50Contenu de prompt répété éligible que OpenAI reconnaît grâce à la mise en cache des prompts.
Sortie$30.00Les jetons de réponse visibles ainsi que les jetons de raisonnement générés par le modèle sont facturés en tant que sortie.

Le volume de sortie est six fois supérieur au tarif de base, ce qui fait que les réponses longues peuvent alourdir la facture. Un flux de travail qui envoie un document volumineux mais ne nécessite qu'une classification succincte peut s'avérer moins coûteux qu'une requête brève générant un rapport très long.

Ne confondez pas les tarifs de l'API avec un abonnement. Les chiffres ci-dessus correspondent aux tarifs API facturés à l'utilisation. Cela ne signifie pas qu'un forfait GPT-5.5 coûte $5 par mois, ni qu'un abonnement ChatGPT inclut automatiquement des crédits API.

Plans et itinéraires d'accès GPT-5.5

“La ” tarification GPT-5.5 » peut désigner trois modes d'achat différents. Choisissez le mode d'achat avant de comparer les chiffres, car chacun d'entre eux mesure la consommation différemment.

Itinéraire d'accèsModes de paiementMeilleur pourPrincipale limitation
API OpenAIUtilisation des jetons facturée au compteur, majorée des frais d'outillage applicablesApplications, automatisations, agents, systèmes de production et développeurs nécessitant un contrôle de l'utilisationNécessite la configuration de l'API, la facturation et le suivi des coûts
Plan ChatGPTAbonnement avec des limites d'accès et d'utilisation spécifiques à chaque formuleLes personnes qui souhaitent disposer d'une interface de chat toute prêteLa disponibilité et les restrictions peuvent varier en fonction du forfait, du compte, de la région et du calendrier de déploiement.
GlobalGPTPlan de plateforme ou crédits selon les conditions actuelles du GlobalGPTLes personnes qui souhaitent disposer des modèles GPT-5.5 et autres au sein d'une même interface sans avoir à configurer directement l'APILes crédits constituent une unité de mesure propre à la plateforme et ne doivent pas être considérés comme des dollars de l'API OpenAI.

Traitement standard via l'API

Le traitement standard sert de référence pour la plupart des estimations de coûts des API. Utilisez les taux suivants : $5 pour les entrées, $0,50 pour les entrées mises en cache et $30 pour les sorties, sauf si votre requête relève d'un niveau de traitement différent ou dépasse le seuil de contexte long.

API par lots

L'API Batch de OpenAI est conçue pour les tâches asynchrones qui ne nécessitent pas de réponse immédiate. L' page officielle des tarifs de l'API présente les tarifs réduits applicables aux tâches par lots éligibles. Cette option peut s'avérer pertinente pour les évaluations hors ligne de grande envergure, l'étiquetage de documents, l'enrichissement des données ou les traitements nocturnes, lorsque les délais d'exécution sont flexibles.

Traitement Flex

Le traitement « Flex » privilégie les coûts réduits au détriment de la régularité des temps de réponse et de la disponibilité. Il convient aux tâches hors production ou à faible priorité qui peuvent tolérer un traitement plus lent ou occasionnellement indisponible.

Traitement prioritaire et régional

Le traitement prioritaire entraîne des coûts supplémentaires en contrepartie d'un niveau de service plus élevé. Le document OpenAI précise également que les points de terminaison de traitement régionaux font l'objet d'une majoration de 10% pour le GPT-5.5.

Comment les jetons influencent votre facture GPT-5.5

Un « token » est un élément de texte ou toute autre donnée d'entrée d'un modèle. Il ne s'agit pas d'un mot. En anglais, un mot correspond souvent à plus d'un « token » en moyenne, une fois pris en compte la ponctuation, la mise en forme, le code, les tableaux et les caractères spéciaux.

coût = (jetons d'entrée / 1 000 000 × taux d'entrée) + (jetons de sortie / 1 000 000 × taux de sortie)

Les données mises en cache sont facturées selon un tarif distinct. Les appels vers des outils peuvent entraîner des frais supplémentaires ; par conséquent, le calcul basé uniquement sur les jetons peut ne pas correspondre au coût final de la requête lorsque celle-ci implique une recherche sur Internet, l'utilisation d'un ordinateur ou un autre outil payant.

Qu'est-ce qui est considéré comme une entrée et une sortie ?

  • Les données d'entrée comprennent les invites, les instructions système, l'historique, les documents, les résultats des outils, les données structurées et les images après tokenisation.
  • La sortie comprend la réponse générée et les jetons de justification facturables.
  • Les données mises en cache couvrent le contenu répétitif éligible des invites, identifié grâce à la mise en cache des invites.

Fenêtre de contexte GPT-5.5 et seuil tarifaire de 272K

GPT-5.5 prend en charge un Fenêtre contextuelle de 1 050 000 jetons et jusqu'à 128 000 jetons émis. La fenêtre de contexte correspond à l'ensemble de l'espace de travail dont dispose la requête, comprenant les données d'entrée, l'historique pertinent, les résultats des outils et les données de sortie générées.

Lorsqu'une requête GPT-5.5 contient plus de 272 000 tokens d'entrée, la session complète est facturée à 2 fois le débit d'entrée normal et 1,5 fois le débit normal. Aux taux de base, cela correspond à $10 par million de jetons d'entrée et à $45 par million de jetons de sortie.

Remarque pratique : Mesurez la requête finale une fois assemblée, y compris le contenu récupéré et l'historique, plutôt que la taille du fichier de départ.

Exemples de coûts pour le modèle GPT-5.5

Ces exemples se basent sur les tarifs de base de l'API et n'incluent pas les appels vers des outils payants, les majorations régionales ni les multiplicateurs de contexte long, sauf indication contraire.

Calculateur de coûts par tâche GPT-5.5

Choisissez une charge de travail courante, puis déplacez l'un des curseurs. Le calculateur applique automatiquement un profil de jetons représentatif par tâche.

Rédaction ou réécriture d'un texte
Estimation par tâche : 4 000 tokens en entrée + 2 000 tokens en sortie.
Coût par tâche$0.08
Volume total de jetons600 000
Coût total estimé$8.00

100 tâches × ($0,02 GPT-5.5 en entrée + $0,06 GPT-5.5 en sortie) = $8,00

Les profils de jetons de charge de travail constituent des estimations éditoriales et ne constituent pas des garanties d'utilisation fixes de OpenAI.

ExempleEntréeSortieCoût estimé
Réponse professionnelle concise10,0002,000$0.11
Analyse de documents volumineux100,00010,000$0.80
Entrée répétée de 100 000 avec accès complet au cache100 000 en cache10,000$0.35
Session à contexte long supérieure à 272 Ko300,00020,000$3.90

Comment réduire les coûts liés au GPT-5.5

  1. Confier les tâches simples à un prestataire moins cher.
  2. Dans la mesure du possible, veillez à ce que la taille des requêtes ne dépasse pas 272 Ko.
  3. Réutiliser des préfixes de prompt stables.
  4. Définissez une limite de sortie.
  5. Utilisez « Batch » pour les tâches asynchrones.
  6. Suivre les jetons par tâche.
  7. Coûts des outils à traiter séparément.

Avec GlobalGPT, vous pouvez réserver le GPT-5.5 pour les tâches exigeantes et opter pour un autre modèle lorsque la vitesse ou une utilisation moins intensive sont prioritaires.

À qui s'adresse le GPT-5.5 ?

La formule GPT-5.5 s'avère particulièrement pertinente lorsque le coût d'une réponse moins aboutie est supérieur au prix d'un jeton supplémentaire. Parmi les exemples, on peut citer les modifications de code complexes, les analyses techniques approfondies, la rédaction de textes spécialisés complexes, l'utilisation d'outils en plusieurs étapes et le traitement de documents volumineux.

Cela peut s'avérer inutile pour un simple classement, une réécriture basique, de courts résumés ou des tâches à grand volume obéissant à des règles prévisibles.

Questions fréquemment posées

À combien correspond 1 TP20T pour 1 million de jetons ?

Le prix de base de l'API est de $5 par million de jetons d'entrée, de $0,50 par million de jetons d'entrée mis en cache et de $30 par million de jetons de sortie.

Le modèle GPT-5.5 est-il inclus dans la gamme ChatGPT Plus ?

Les limites d'accès et d'utilisation des modèles peuvent varier selon le forfait, le compte, la région et la phase de déploiement. Consultez la page des forfaits en ligne et votre sélecteur de modèles. Les abonnements ChatGPT et la facturation des API sont distincts.

Qu'est-ce que la fenêtre contextuelle GPT-5.5 ?

OpenAI spécifie une fenêtre de contexte de 1 050 000 tokens et une sortie maximale de 128 000 tokens.

Pourquoi le prix du GPT-5.5 augmente-t-il au-delà de 272 000 jetons ?

L'entrée est facturée au double et la sortie à 1,5 fois le tarif normal pendant toute la session, car le traitement de contextes très volumineux nécessite davantage de puissance de calcul.

L'abonnement ChatGPT comprend-il des jetons API ?

Les abonnements au forfait n° ChatGPT et l'utilisation de l'API sont facturés séparément.

Les crédits GlobalGPT correspondent-ils aux dollars API OpenAI ?

Les crédits n° GlobalGPT sont soumis au plan et aux règles d'utilisation propres à GlobalGPT.

Partager l'article :

Articles connexes