Cotation actuelle de l'API (4 août 2026) : Google Page officielle des tarifs de l'API pour développeurs Gemini indique que le modèle Gemini 3.1 Pro Preview nécessite $2 par million de jetons d'entrée et $12 par million de jetons de sortie (y compris les jetons de réflexion) pour les invites ne dépassant pas 200 000 jetons. Au-delà de 200 000, les tarifs indiqués sont de $4 en entrée et $18 en sortie par million de tokens. Gemini 3 Pro Image (Nano Banana Pro) utilise la même tarification pour le texte que Gemini 3.1 Pro et facture séparément la sortie d’images.
Si vous cherchez Tarifs de l'API Gemini 3 Pro, la principale nouveauté est que la version originale Le modèle API « Gemini 3 Pro Preview » n'est plus le modèle de référence sur lequel s'appuyer.
Selon Google, Page sur la dépréciation de l'API Gemini, gemini-3-pro-aperçu a été fermé le 9 mars 2026, et le remplacement recommandé est gemini-3.1-pro-preview.
Cela signifie que les anciens tutoriels, tableaux de tarifs ou exemples d'API relatifs à Gemini 3 Pro peuvent être obsolètes. Si vous envisagez de lancer un nouveau projet, nous vous recommandons de consulter la liste actuelle des modèles Gemini et d'utiliser les versions les plus récentes Tarifs de Gemini 3.1 Pro comme référence principale.

Capacités principales de Gemini 3
Présentation du Gemini 3 Pro :
Lancé le 18 novembre 2025, Gemini 3 Pro est le modèle d'IA le plus avancé de Google à ce jour. Il excelle dans raisonnement, compréhension multimodale et génération de code, ce qui le rend adapté aux flux de travail professionnels, à la résolution de problèmes complexes et aux projets créatifs basés sur l'IA.
- Raisonnement profond – Gemini 3 Pro dispose de la fonctionnalité innovante “ Deep Think ”, qui permet une réflexion approfondie semblable à celle d'un être humain en évaluant plusieurs possibilités et en vérifiant sa propre logique avant de répondre à des questions complexes.
- Multimodal natif – Le modèle est fondamentalement conçu pour comprendre et traiter de manière transparente du texte, des images, de l'audio, de la vidéo et du code.
- Fenêtre de contexte étendue – Prend en charge jusqu'à 1 million de tokens en entrée et 64 000 tokens en sortie, ce qui est idéal pour traiter des documents longs et des conversations complexes.
- Flux de travail agentique – Spécialement optimisé pour les agents de codage autonomes et les tâches complexes sans apprentissage préalable. Grâce aux nouveaux outils Bash, il peut naviguer dans les systèmes de fichiers et piloter les processus de développement.
- “ Vibe Coding ” – Permet de générer des applications complètes à partir de descriptions en langage naturel sans syntaxe de programmation traditionnelle.

Tarifs de l'API Gemini 3 Pro
| Taille de la ligne de commande | Données d'entrée / 1 million de jetons | Résultat / 1 million de jetons |
|---|---|---|
| Jusqu'à 200 000 jetons | $2 | $12, jetons de réflexion compris |
| Plus de 200 000 jetons | $4 | $18, jetons de réflexion compris |
Il s'agit des chiffres standard relatifs aux formules payantes, issus de la page des tarifs de Google et consultés le 4 août 2026. Les noms et les prix des modèles en avant-première sont susceptibles de changer ; il est donc recommandé de se référer au tableau officiel pour établir les budgets de production.
Explication du mécanisme de tarification de l'API Gemini 3 Pro
La tarification de l'API Gemini 3 Pro s'articule autour de deux dimensions clés : quantité de jetons et longueur de la fenêtre contextuelle.
- Unité de facturation principale : jetons
Comme la plupart des grands modèles linguistiques (LLM), Gemini 3 Pro facture séparément les jetons d'entrée et les jetons de sortie, mesurés par million de jetons (par 1 million de jetons).
- Entrée Jetons (prix d'entrée): Le volume de données envoyées au modèle : vos invites, documents, code, etc.
- Jetons de sortie (prix de sortie): Le volume des réponses, résumés, codes, etc., générés par le modèle, y compris les jetons utilisés pour “ réfléchir ”.”

- Niveaux de coûts : l'importance du contexte Windows
Une caractéristique remarquable de Gemini 3 Pro est sa fenêtre contextuelle extrêmement longue (jusqu'à 1 million de jetons). Afin de refléter le coût informatique lié au traitement de contextes ultra-longs, Google a introduit une tarification échelonnée :
| Plage de longueur du contexte | Cas d'utilisation | Tarif |
| Contexte standard (≤ 200 000 jetons) | Discussion courante, résumés succincts, tâches standard | Taux inférieur |
| Contexte long (> 200 000 tokens) | Analyse de documents juridiques, recherche approfondie, compréhension de bases de code complexes | Taux plus élevé |
Les tâches à contexte long ont des prix d'entrée/sortie deux fois plus élevés que ceux des contextes standard, ce qui reflète leur grande valeur dans les scénarios complexes.
Exemples d'estimation des coûts : comment les développeurs peuvent établir leur budget
Comprendre les coûts réels des cas d'utilisation aide les entreprises et les développeurs à planifier leurs budgets avec précision. Voici plusieurs estimations de coûts basées sur les tarifs actuels en avant-première :
Exemple 1 : Chatbot standard pour le service client (contexte faible)
Hypothèses :
- Entrée : 5 000 jetons
- Sortie : 1 000 jetons
- Contexte : 5 000 jetons (≤ 200 000)
| Type de coût | Calcul | Coût (USD) |
| Entrée | 5 000 × $2,00 / 1M | 0.01 |
| Sortie | 1 000 × $12,00 / 1M | 0.012 |
| Demande unique Total | =$0.022 |
Exemple 2 : Analyse et résumé de documents (contexte moyen à long)
Hypothèses :
- Entrée : 150 000 jetons (analyse d'un long rapport)
- Résultat : 8 000 jetons (génération du résumé)
- Contexte : 150 000 jetons (≤ 200 000)
| Type de coût | Calcul | Coût (USD) |
| Entrée | 150 000 × $2,00 / 1M | 0.3 |
| Sortie | 8 000 × $12,00 / 1M | 0.096 |
| Demande unique Total | =$0.4 |
Exemple 3 : Tâche de recherche approfondie (contexte ultra-long)
Hypothèses :
- Entrée : 350 000 jetons (analyse de plusieurs documents)
- Résultat : 15 000 jetons (génération d'un rapport détaillé)
- Contexte : 350 000 jetons (> 200 000, un tarif plus élevé s'applique)
| Type de coût | Calcul | Coût (USD) |
| Entrée | 350 000 × $4,00 / 1M | 1.4 |
| Sortie | 15 000 × $18,00 / 1M | 0.27 |
| Demande unique Total | =$1.67 |
Comparaison des prix entre le Gemini 3 Pro et le Gemini 3.1 Pro
Il est facile de confondre Gemini 3 Pro et Gemini 3.1 Pro car leurs noms sont très proches, mais ils ne s'adressent plus aux mêmes segments de marché en termes de tarification des API.
Les plus âgés gemini-3-pro-aperçu Ce modèle a été abandonné ; les développeurs ne doivent donc pas s'en servir comme référence principale pour la tarification des nouveaux projets. Il est aujourd'hui plus pertinent de comparer les anciennes prévisions tarifaires du Gemini 3 Pro avec la structure tarifaire actuelle du Gemini 3.1 Pro.
| Modèle | État actuel de l'API | Prix des intrants | Prix à la production | Ce que cela signifie |
|---|---|---|---|---|
| Aperçu du Gemini 3 Pro | Arrêt | Ce n'est plus d'actualité | Ce n'est plus d'actualité | Ne basez pas les nouveaux budgets consacrés aux API sur les anciens gemini-3-pro-aperçu exemples. |
| Aperçu de Gemini 3.1 Pro : prend en charge jusqu’à 200 000 tokens | Chemin de remplacement actuel | $2,00 / 1 million de jetons | $12,00 / 1 million de jetons | Référence principale concernant la tarification avancée de l'API Gemini. |
| Aperçu de Gemini 3.1 Pro : plus de 200 000 tokens générés | Chemin de remplacement actuel | 1 TP4T4,00 / 1 million de jetons | 1 TP4T18,00 / 1 million de jetons | Utilisez cette option lorsque vous travaillez avec des fenêtres de contexte très volumineuses. |
| Aperçu de Gemini 3.1 Pro : traitement par lots/flexible jusqu’à 200 000 jetons | Option de traitement moins coûteuse | $1,00 / 1 million de jetons | 1 TP4T6,00 / 1 million de jetons | Utile pour les charges de travail asynchrones qui ne nécessitent pas de réponses immédiates de priorité standard. |
Le point essentiel : « Gemini 3 Pro » est désormais principalement un terme obsolète utilisé pour les tarifs des API, tandis que « Gemini 3.1 Pro » constitue la meilleure référence actuelle en matière de tarification.
Si vous souhaitez obtenir le détail complet des coûts, consultez notre Guide des tarifs et des prix de Gemini 3.1 Pro. Si vous souhaitez comprendre les différences entre les modèles, consultez notre comparatif de Gemini 3.1 Pro vs Gemini 3 Pro.
Conclusion
La question du prix du Gemini 3 Pro ne se résume plus à “ combien coûte le Gemini 3 Pro ? ”. La question la plus importante est quel modèle Gemini vous utilisez actuellement.
Si vous faites référence à l'ancien identifiant de modèle de l'API gemini-3-pro-aperçu, il a été désactivé. Pour les projets de développement en cours, Gemini 3.1 Pro Preview constitue la référence tarifaire la plus sûre, en particulier pour le raisonnement avancé, le codage, l'analyse de contextes longs et les flux de travail multimodaux.
Avant de créer ou d'établir un budget à l'aide de l'API Gemini, vérifiez trois points :
- Si l'identifiant du modèle est toujours actif.
- Que votre charge de travail soit adaptée à Pro, Flash ou Flash-Lite.
- Savoir si la tarification standard, par lots, flexible ou mise en cache offre le meilleur rapport qualité-prix.
Pour la plupart des utilisateurs, la démarche pratique est simple : utiliser Gemini 3.1 Pro pour les tâches complexes, recourir à des modèles Gemini plus légers pour les tâches courantes à grand volume, et comparer des alternatives telles que GPT, Claude et Perplexity lorsque la qualité, le coût ou la flexibilité du flux de travail sont des critères importants. Si vous souhaitez tester plusieurs modèles de pointe en un seul et même endroit, GlobalGPT peut vous aider à comparer les flux de travail de type Gemini avec d’autres outils d’IA sans avoir à passer d’une plateforme à l’autre.
FAQ
Comment puis-je estimer le montant mensuel de ma facture API Gemini 3.1 Pro ?
Ajoutez le coût des jetons d'entrée à celui des jetons de sortie pour chaque requête, puis multipliez le résultat par le volume de requêtes prévu. Pour les invites ne dépassant pas 200 000 tokens, les tarifs Standard indiqués sont de $2 par million de tokens d'entrée et de $12 par million de tokens de sortie. Les invites plus longues sont facturées aux tarifs supérieurs de $4 pour l'entrée et de $18 pour la sortie.
Les jetons « thinking » sont-ils inclus dans le prix de vente du Gemini 3.1 Pro ?
Oui. Google inclut les jetons de réflexion dans le calcul du débit de sortie ; le raisonnement peut donc faire augmenter la facture même lorsque la réponse visible est courte. Évaluez votre budget en fonction de l'utilisation mesurée de l'API plutôt qu'en vous basant uniquement sur le nombre de mots visibles.
Puis-je utiliser Gemini 3.1 Pro Preview dans le cadre du niveau d'API gratuit ?
Le tableau des tarifs de Google, consulté le 4 août 2026, indique que le niveau gratuit « Gemini 3.1 Pro Preview » n'est pas disponible. La disponibilité des versions préliminaires, les quotas et les noms des modèles peuvent évoluer ; il est donc recommandé de vérifier le tableau officiel avant de déployer une charge de travail en production.
La formule tarifaire « Gemini 3.1 Pro » pour le texte inclut-elle la production d'images « Nano Banana Pro » ?
La version Gemini 3 Pro Image utilise les mêmes débits d'entrée et de sortie de texte que la version Gemini 3.1 Pro, mais les images générées font l'objet d'une facturation distincte. Le tableau vérifié par Google indique un coût de sortie d'images de $120 par million de jetons de sortie d'images, avec des exemples équivalents d'environ $0,134 pour une image 1K/2K et $0,24 pour une image 4K.
La version « Gemini 3 Pro Preview » est-elle toujours disponible dans l'API ?
La page de Google consacrée à la dépréciation de l'API Gemini répertorie gemini-3-pro-aperçu comme étant à l'arrêt, avec gemini-3.1-pro-preview comme solution de remplacement recommandée. Les développeurs sont invités à consulter la liste actuelle des modèles avant d'utiliser d'anciens exemples d'API Gemini 3 Pro.
Quel est le prix actuel de l'API Gemini 3.1 Pro ?
Dans la formule standard payante, Gemini 3.1 Pro Preview est proposé à partir de $2,00 par million de jetons d'entrée et de $12,00 par million de jetons de sortie pour les invites ne dépassant pas 200 000 jetons. Les invites de plus de 200 000 jetons sont facturées plus cher.
Le tarif « Gemini 3.1 Pro » est-il plus avantageux avec la tarification par lot ou la tarification flexible ?
Oui. Les tarifs de l'API Gemini de Google indiquent des prix par lot et des tarifs flexibles inférieurs pour la version « Gemini 3.1 Pro Preview » par rapport au niveau standard. Ces modes peuvent s'avérer utiles pour les charges de travail qui ne nécessitent pas de réponses immédiates en priorité standard.



