Réponse courte : Au 23 juillet 2026, aucun des deux modèles API d'origine n'est à jour. xAI a retiré le modèle Grok 4.1 Fast le 15 mai 2026 et redirige ses anciens slugs « reasoning » et « non-reasoning » vers Grok 4.3. Google a mis fin à la version « Gemini 3 Pro Preview » le 9 mars 2026 et invite les développeurs à migrer vers la version Gemini 3.1 Pro Preview.
Pour un nouveau projet, la comparaison la plus pertinente est la suivante : Grok 4,5 vs Gemini 3,1 Pro. Gemini publie un ensemble d'entrées multimédia plus large et une limite d'entrée de 1 048 576 tokens. La version Grok 4.5 propose un contexte de 500 000 tokens, une tarification réduite des tokens de sortie pour les invites de moins de 200 000 tokens, ainsi que les outils de recherche Web et X Search propriétaires. Le choix approprié dépend de vos fichiers, de vos outils, de votre objectif de latence et du coût par résultat accepté.
GlobalGPT regroupe plusieurs itinéraires types en un seul endroit, notamment les références Grok 4.1 Fast, Grok 4.3, Gemini 3 Pro et Gemini 3.1 Pro figurant dans sa liste actuelle de modèles. GlobalGPT est une plateforme tierce ; ses désignations de modèles, ses limites et sa facturation relèvent donc de ses propres conditions d’utilisation ; elle ne maintient pas en activité les points de terminaison xAI ou Google API retirés.
Statut officiel du modèle, vérifié le 23 juillet 2026 : appels vers
grok-4-1-raisonnement-rapidesont désormais desservis pargrok-4.3nécessitant peu de réflexion, tandis que les appels àgrok-4-1-rapide-sans-raisonnementsont desservis pargrok-4.3sans aucun effort de réflexion. Google répertoriegemini-3-pro-aperçucomme étant hors service et invite les développeurs à passer àgemini-3.1-pro-preview. Les nouvelles intégrations doivent utiliser un identifiant de modèle actuel explicite et refaire les tests de qualité, de latence, d'utilisation des outils et de coût.
Comparaison des caractéristiques techniques : Grok 4.1 vs Gemini 3 Pro aujourd'hui

Plate-forme d'IA tout-en-un pour l'écriture, la génération d'images et de vidéos avec GPT-5, Nano Banana, etc.
Les noms des modèles d'origine restent utiles pour les recherches liées à la migration, mais ils ne correspondent plus à deux points de terminaison API officiels actifs. Le tableau ci-dessous distingue les modèles retirés des modèles actuels qu'un développeur peut sélectionner délibérément.
| Spécification | Parcours actuel en matière d'IA autonome (xAI) | Itinéraire actuel de Google |
|---|---|---|
| Statut « hérité » | Grok 4.1 Retiré le 15 mai 2026 ; les anciens liens redirigent vers Grok 4.3 | La version « Gemini 3 Pro Preview » sera arrêtée le 9 mars 2026 ; Google exige une migration |
| Comparaison avec le modèle actuel | grok-4.5 | gemini-3.1-pro-preview |
| Limite de contexte ou de jetons publiés | Contexte de 500 000 jetons | 1 048 576 jetons d'entrée ; 65 536 jetons de sortie |
| Portée des données d'entrée publiées | La présentation du Grok 4.5 de xAI est axée sur le texte, les outils, le code et le travail agentique ; la génération de contenus multimédias et l'utilisation de la voix font l'objet d'API xAI distinctes. | Saisie de texte, d'images, de vidéos, de fichiers audio et de PDF ; sortie sous forme de texte |
| Raisonnement | Faible, moyen ou élevé ; « élevé » est la valeur par défaut | Réflexion guidée |
| Principaux outils | Appel de fonction, recherche sur le Web, recherche X, exécution de code | Appel de fonctions, exécution de code, recherche de fichiers dans AI Studio, recherche Google, Google Maps, contexte d'URL, sorties structurées |
| Taux d'API inférieur à 200 000 jetons de prompt | 1 entrée $2, 1 entrée mise en cache $0.30, 1 sortie $6 par million de tokens | 1 entrée $2, 1 entrée mise en cache $0.20, 1 sortie $12 par million de tokens |
| Taux d'API égal ou supérieur à 200 000 tokens de prompt | 1 entrée $4, 1 entrée mise en cache $0,60, 1 sortie $12 par million de tokens | 1 entrée $4, 1 entrée mise en cache $0,40, 1 sortie $18 par million de tokens |
xAI recommande tout particulièrement le modèle Grok 4.3 comme cible de migration pour les charges de travail « Fast » du modèle Grok 4.1, désormais retiré, tandis que le Grok 4.5 est son modèle phare actuel pour le code et les tâches agentiques plus générales. Google recommande directement le modèle Gemini 3.1 Pro Preview pour remplacer le Gemini 3 Pro Preview. Étant donné que l’un des modèles de remplacement est en version preview et que les deux fournisseurs peuvent modifier le routage, notez soigneusement l’ID exact du modèle figurant dans vos journaux.
Le modèle Gemini présente un avantage plus manifeste en termes de traitement des entrées multimédias et des invites longues. Le modèle Grok affiche quant à lui un taux de production plus faible, inférieur à 200 000 tokens d'invite, et dispose d'un outil dédié, X Search. Aucun de ces avantages ne garantit toutefois une meilleure qualité des réponses pour toutes les tâches.
Capacités multimodales : les successeurs actuels
Portée multimodale publiée de la version Gemini 3.1 Pro Preview

- Données d'entrée : texte, images, vidéo, audio et PDF ; le type de fichier publié est du texte.
- Limites de jetons : 1 048 576 jetons d'entrée et 65 536 jetons de sortie.
- Outils de traitement de documents : exécution de code, contexte URL, sortie structurée, ancrage Google et recherche de fichiers dans AI Studio.
Ces données publiées font de Gemini 3.1 Pro Preview le choix documenté le plus sûr lorsqu'il s'agit de comparer un rapport, des graphiques, des captures d'écran, des fichiers audio et vidéo. Une fenêtre de contexte plus grande augmente la capacité, mais pas la fiabilité ; il reste donc nécessaire de citer ses sources et de vérifier les résultats pour toute affirmation importante.
Périmètre documenté de la version Grok 4.5

- Modèle de base : xAI positionne Grok 4.5 pour le codage, le chat, l'appel d'outils, les tâches agentiques et le travail intellectuel.
- Contexte : Le catalogue actuel des modèles xAI recense 500 000 tokens.
- Itinéraires médias distincts : xAI permet de générer des images et des vidéos via les API Imagine, ainsi que des contenus vocaux via l'API Voice.
La capture d'écran d'origine illustre une réponse ponctuelle et ne constitue pas un test de performance reproductible. Comparez les deux modèles actuels en utilisant les mêmes documents, les mêmes autorisations d'accès aux outils, la même consigne, la même grille d'évaluation et le même nombre d'essais avant de choisir une voie de production.
Intégration dans l'écosystème : X Search face à Google Grounding
Grok avec X Search

La documentation de xAI indique que Grok ne prend pas en charge les événements en temps réel, sauf si les outils de recherche sont activés. La version 4.5 de Grok prend en charge Web Search et X Search, et Page actuelle des tarifs de xAI indique un coût de $5 par 1 000 appels, en dollars américains. X Search permet d'effectuer des recherches dans les publications, les profils et les fils de discussion ; il s'agit d'un outil payant, et non d'une base de connaissances en temps réel intégrée à chaque réponse.
Gemini avec les outils « Grounding » et « File » de Google
Gemini 3.1 Pro Preview prend en charge l'ancrage dans la recherche Google, l'ancrage dans Google Maps, le contexte des URL, l'exécution de code et la recherche de fichiers dans AI Studio. Sur Niveau d'accès payant aux API de Google, les 5 000 premières requêtes traitées par mois sont incluses gratuitement sur les trois modèles Gemini, puis facturées à raison de $14 par 1 000 requêtes de recherche. Une même requête pouvant générer plusieurs requêtes de recherche, la facturation doit être calculée à partir des journaux d'activité réels.
Lequel choisir ?
- Choisissez Grok avec X Search lorsque les publications, les profils et les fils de discussion de X constituent des éléments de preuve à part entière.
- Choisissez Gemini lorsque les fichiers multimédias, les bases de données Web, les cartes, les URL et les recherches liées à Google occupent une place centrale.
- Pour les missions à enjeux élevés, enregistrez les références, les horodatages, les appels d'outils et les affirmations non étayées avant d'utiliser le résultat.
Tests de performances : comment comparer les modèles actuels
Les anciens classements et les tests ponctuels de temps de réponse ne déterminent plus le résultat de cette comparaison. Les critères d'évaluation d'origine ne sont plus d'actualité, et les scores varient en fonction de la version du modèle, du niveau de raisonnement, de la consigne, de l'accès aux outils, des paramètres d'échantillonnage et de la date d'évaluation.
- Épingler
grok-4.5etgemini-3.1-pro-preview, et consigner le modèle et la date renvoyés. - Attribuez aux deux modèles les mêmes tâches, fichiers, outils, délai et critères d'acceptation.
- Distinguer les tests de raisonnement « à livre fermé » des tests de recherche fondée sur des données concrètes.
- Effectuez suffisamment d'essais pour rendre compte de la variabilité, plutôt que de vous contenter d'un seul résultat favorable.
- Mesurer la précision, le soutien en matière de citations, la latence, le délai d'examen, l'utilisation des jetons, les appels aux outils et le coût total par résultat accepté.
Pour obtenir une liste de sélection plus complète, comparez les options proposées par GlobalGPT dans ses Guide des meilleurs modèles d'IA. Le gagnant concret est le modèle qui satisfait à votre propre test d'acceptation au coût le plus bas, une fois pris en compte les ajustements liés à la révision.
Outils de développement : Grok ou Gemini pour le codage
Grok 4.5 : Codage et travail agentique

xAI présente Grok 4.5 comme son modèle phare pour la génération de code et les tâches d'agentique au sens large. Il prend en charge le raisonnement configurable, l'appel de fonctions, la recherche et l'exécution de code via les API « Responses » et « Chat Completions ». Cela en fait un candidat de choix pour la correction itérative de code et les workflows pilotés par des outils.
Aperçu de Gemini 3.1 Pro pour l'ingénierie logicielle

Google présente Gemini 3.1 Pro Preview comme un outil destiné à l'ingénierie logicielle, à l'utilisation précise d'outils et à l'exécution de tâches en plusieurs étapes. Il offre également gemini-3.1-pro-preview-customtools pour les workflows combinant Bash et des outils personnalisés, tout en précisant que la qualité peut varier pour les tâches qui ne bénéficient pas de ces outils. Pour plus d'informations sur les outils associés, consultez la section Guide Google sur l'antigravité.
Lequel les développeurs devraient-ils choisir ?
- Commencez par Grok 4,5 pour les boucles d'agents axées sur le codage, les outils tenant compte de X et des coûts de production réduits pour les contextes courts.
- Commencez avec Gemini 3.1 Pro Preview pour les référentiels associant des fichiers PDF, des images, des vidéos, des fichiers audio, des URL ou des liens vers Google Grounding.
- Ne pas expédier avant d'avoir effectué les tests : Les captures d'écran générées et le code plausible ne remplacent pas la réussite des tests ni la vérification humaine.
Expérience utilisateur : réponses conversationnelles ou structurées
Le modèle Grok est généralement choisi pour un style plus conversationnel, tandis que le modèle Gemini est souvent privilégié pour des recherches structurées et des résultats à vocation professionnelle. Le ton n'est pas une capacité technique figée : les instructions du système, les paramètres de raisonnement, les politiques de sécurité et les interfaces du produit peuvent modifier la manière dont chacun de ces modèles réagit.
- Flux de travail créatifs et sociaux : vérifier si le style de Grok permet de réduire le temps de révision sans compromettre la fiabilité des informations.
- Flux de travail dans la recherche et l'entreprise : vérifier si la structure Gemini permet d'améliorer les évaluations, les citations et la réutilisation.
- Utilisation en contact avec la clientèle : appliquer les mêmes mesures de sécurité, de gestion des escalades, de protection de la vie privée et de contrôle de la qualité aux deux modèles.
Formules tarifaires : coûts actuels vérifiés

Au 23 juillet 2026, xAI et Google publient les tarifs basés sur l'utilisation suivants dans USD par million de jetons. Il s'agit de tarifs d'API, et non d'abonnements mensuels. Aucune des deux pages de tarification destinées aux développeurs ne précise que la TVA est incluse ; la TVA applicable et le taux de conversion dépendent du compte de facturation et de la juridiction du client.
| Route API | Taille de la ligne de commande | Entrée | Entrée mise en cache | Sortie | Condition importante |
|---|---|---|---|---|---|
| Le Grok 4.1 Fast Slug a été retiré du service ; il est désormais remplacé par le Grok 4.3 | Moins de 200 000 | $1.25 | $0.20 | $2.50 | Une limace âgée capable de raisonner obtient un faible score de raisonnement ; une limace âgée incapable de raisonner n'obtient aucun score de raisonnement |
| Le Grok 4.1 Fast Slug a été retiré du service ; il est désormais remplacé par le Grok 4.3 | 200 000 ou plus | $2.50 | $0.40 | $5.00 | xAI applique des taux de contexte long à tous les tokens dès que la requête atteint 200 000 |
| Grok 4,5 | Moins de 200 000 | $2.00 | $0.30 | $6.00 | Les outils de recherche et d'exécution de code sont facturés séparément |
| Grok 4,5 | 200 000 ou plus | $4.00 | $0.60 | $12.00 | 500 000 au total |
| Gemini 3.1 Pro Preview | Jusqu'à 200 000 | $2.00 | $0.20 | $12.00 | Le prix de vente inclut les « thinking tokens » ; aucun niveau d'API gratuit n'est proposé |
| Gemini 3.1 Pro Preview | Plus de 200 000 | $4.00 | $0.40 | $18.00 | Le stockage du cache contextuel est facturé séparément au tarif de $4,50 par million de jetons par heure. |
Grok 4.5 présente un débit de sortie inférieur au seuil de contexte long. Gemini est plus coûteux en termes de sortie, mais sa limite publiée d’un million de tokens en entrée et sa prise en charge des médias mixtes pourraient réduire la nécessité d’un pipeline de fichiers distinct. Comparez le coût total par résultat accepté, en incluant les appels d’outils, les tentatives de rattrapage et la révision humaine.
Les abonnements grand public sont distincts
Sur Google, Page d'abonnement à Gemini aux États-Unis, la version gratuite coûte $0 par mois, Google AI Plus coûte $4,99 par mois, Google AI Pro coûte $19,99 par mois, et Google AI Ultra est proposé à partir de $99,99 par mois pour une utilisation équivalente à 5 fois celle de la formule Pro, ou à $199,99 par mois pour une utilisation équivalente à 20 fois celle-ci. La page présente une facturation mensuelle, et l’accès varie en fonction du forfait, du pays, de l’âge et de la langue. La page ne précise pas si les prix affichés en dollars américains incluent les taxes.
L'accès grand public à Grok est facturé séparément de l'API xAI. La page publique de xAI consacrée aux tarifs pour les développeurs indique les tarifs exacts de l'API et des outils, mais ne publie pas de tarif mensuel unique pour l'abonnement à Grok.com valable pour tous les comptes et toutes les régions. L'image ci-dessus, qui présente l'historique des tarifs grand public, ne doit pas être utilisée pour établir un devis correspondant à une offre actuelle.
Tarifs et fonctionnalités actuels du modèle GlobalGPT
Au 23 juillet 2026, le Page de commande de GlobalGPT propose le forfait « Basic » à $11,90 par mois (abonnement mensuel) ou à $5,80 par mois (facturation annuelle), « Pro » à $19,90 par mois (abonnement mensuel) ou $10,80 par mois (facturation annuelle), et « Illimité » à $49,90 par mois (abonnement mensuel) ou $25,00 par mois (facturation annuelle). Les montants annuels s’élèvent respectivement à $69,60, $129,60 et $300,00. La page utilise le signe dollar mais n’indique pas le code ISO de la devise ni si la TVA est incluse ; les équivalents mensuels à tarif réduit nécessitent le paiement d’une année complète.
- Itinéraires à modèles multiples: La liste actuelle comprend les modèles Grok 4.1 Fast, Grok 4.3, Gemini 3 Pro, Gemini 3.1 Pro, ainsi que d'autres gammes de modèles.
- Un témoignage : comparer les outils de chat, de recherche, d'images, de vidéos et de recherche sans avoir à souscrire un abonnement distinct pour chaque fournisseur.
- Conditions générales des tiers : GlobalGPT gère lui-même son acheminement, ses limites, ses quotas et sa facturation ; la documentation de l'API du fournisseur reste la source de référence pour connaître l'état officiel des points de terminaison.
Réflexions finales
Ne lancez pas de nouvelle intégration API officielle sur Grok 4.1 Fast ou Gemini 3 Pro Preview. Utilisez Grok 4.3 si vous avez besoin d’une cible de migration xAI explicite, ou évaluez Grok 4.5, qui est actuellement le produit phare de xAI. Utilisez la version Gemini 3.1 Pro Preview lorsque la prise en charge native des entrées multimédias, une limite d'entrée publiée de 1 048 576 tokens et l'ancrage Google sont des critères déterminants.
Optez pour Grok 4.5 pour les flux de travail axés sur le codage, des tarifs réduits pour les sorties à contexte court ou X Search. Choisissez Gemini 3.1 Pro Preview pour les entrées longues de type multimédia et les outils Google. Si vous souhaitez comparer les offres des différents fournisseurs depuis une seule interface, GlobalGPT propose un workflow multimodèle, avec ses propres limites et tarifs.
FAQ : Grok 4.1 vs Gemini 3 Pro
La version Grok 4.1 est-elle toujours disponible via l'API xAI ?
Ce n'est plus le modèle d'origine. xAI a retiré de la circulation les modèles API Grok 4.1 « Fast reasoning » et « non-reasoning » le 15 mai 2026. Les anciennes URL redirigent désormais vers le modèle Grok 4.3, avec un effort de raisonnement faible ou nul, et sont facturées aux tarifs du modèle Grok 4.3.
Le modèle Gemini 3 Pro est-il toujours disponible via l'API Gemini ?
Non. Google indique que la version « Gemini 3 Pro Preview » sera supprimée le 9 mars 2026 et recommande aux développeurs de migrer vers la version « Gemini 3.1 Pro Preview ». La page de Google ne garantit pas que l'ancien identifiant de modèle continuera à fonctionner comme alias.
Quel modèle actuel un nouveau projet devrait-il utiliser ?
Évaluez les versions Grok 4.5 et Gemini 3.1 Pro Preview à l'aide d'identifiants de modèle explicites. La version Grok 4.5 est adaptée aux workflows de codage, d'agentique et de recherche X ; la version Gemini 3.1 Pro Preview est adaptée aux entrées multimédias volumineuses et à la recherche ancrée sur Google.
Quel modèle dispose de la fenêtre de contexte la plus grande ?
La version « Pro Preview » de Gemini 3.1 indique une limite d'entrée de 1 048 576 tokens et une limite de sortie de 65 536 tokens. xAI indique un contexte de 500 000 tokens pour la version Grok 4.5 et un contexte d’un million de tokens pour la version Grok 4.3.
Combien coûtent les API de remplacement actuelles ?
En dessous de 200 000 tokens de prompt, le modèle Grok 4.5 correspond à une entrée de $2 et une sortie de $6 par million de tokens ; le modèle Gemini 3.1 Pro Preview correspond à une entrée de $2 et une sortie de $12. Au niveau des contextes longs, le Grok correspond à $4/$12 et le Gemini à $4/$18 en USD.
Le modèle Grok intègre-t-il automatiquement les données X en temps réel ?
Non. Selon xAI, le code Grok ne donne pas accès aux événements en temps réel, sauf si les outils de recherche sont activés. « Web Search » et « X Search » sont des outils optionnels, facturés chacun au tarif de $5 pour 1 000 appels.
Le code GlobalGPT permet-il d'afficher à la fois les anciennes désignations et leurs équivalents actuels ?
Oui. La liste actuelle de GlobalGPT comprend les modèles Grok 4.1 Fast, Grok 4.3, Gemini 3 Pro et Gemini 3.1 Pro. Il s'agit d'itinéraires GlobalGPT régis par ses propres conditions d'utilisation et qui n'ont aucune incidence sur les retraits officiels des points de terminaison xAI ou Google.
En 2026, quelle est la meilleure option : Grok ou Gemini ?
La version Grok 4.5 constitue le point de départ le plus solide pour les travaux axés sur la recherche X et le codage. La version Gemini 3.1 Pro Preview est l'option la plus performante, selon la documentation, pour les entrées longues en formats mixtes et les outils Google. Testez les deux versions en fonction de vos propres critères d'acceptation.

