Optez pour Gemma 4 pour les déploiements locaux, hors ligne ou personnalisés. Optez pour Gemini pour la recherche gérée, l'analyse de documents volumineux et l'accès aux outils d'images et de vidéos de Google. La principale différence réside dans la part du système que vous souhaitez gérer vous-même.
- Gemma 4 : poids téléchargeables ; cinq tailles ; contexte de 128K à 256K ; sortie texte.
- Gémeaux : modèles hébergés ; jusqu’à 1 million de tokens d’entrée pour les modèles comparés ici ; outils gérés et modèles multimédias distincts.
- Utilisez les deux : Effectuez l'extraction des données sensibles en local, puis envoyez les données validées vers le cloud à des fins de recherche ou de production.
Le Fiche produit du modèle Gemma 4 définit la famille de modèles locale. Pour un point de départ géré, essayez Gemini 3.1 Pro sur GlobalGPT.
- Choisissez en fonction du flux de travail
- Gemma 4 vs Gemini : aperçu général
- Gemma 4 : modèles et mémoire
- Quel modèle Gemini convient ?
- Maîtrise ou facilité d'utilisation ?
- Contexte et soutien des médias
- Confidentialité : comparez les niveaux de service
- Coûts : matériel local vs API
- Comment interpréter les résultats des tests de performance
- Documents, codage et supports
- Dix cas d'utilisation concrets
- Deux suggestions à essayer
- Quand utiliser les deux ?
- Cinq erreurs à éviter
- Lequel choisir ?
- Avant de vous engager
- Questions fréquemment posées
Choisissez en fonction du flux de travail
Commencez par définir vos exigences non négociables. Un modèle de référence ne peut pas déterminer où vos fichiers sont autorisés à être stockés ni qui sera chargé de la maintenance du système.
- Faut-il pouvoir travailler hors ligne ? Gemma 4 peut être exécuté une fois les fichiers de poids et le fichier d'exécution installés.
- Vous souhaitez contrôler les poids, le matériel et les réglages ? Gemma 4 vous offre cette maîtrise… ainsi que la gestion opérationnelle.
- Vous voulez obtenir des résultats cette semaine sans trop de préparatifs ? Gemini élimine une grande partie du travail lié à la mise en service et à la mise à l'échelle.
- Vous avez besoin d'images ou de vidéos finalisées ? Utilisez des modèles d'images dédiés ou le modèle Veo dans l'environnement hébergé par Google. Un modèle de texte seul ne permet pas de générer ces ressources.
Pour découvrir davantage de modèles au même endroit, GlobalGPT offre un accès à 100 modèles d'IA, avec des forfaits à partir de moins de $10 par mois.

Gemma 4 vs Gemini : aperçu général
| Catégorie | Gemma 4 | Gémeaux |
|---|---|---|
| Qu'est-ce que c'est ? | Famille de modèles à poids ouvert de Google | Modèle de nuage géré et écosystème de services de Google |
| Comment y accéder | Télécharger les poids et les exécuter à l'aide de runtimes ou de plates-formes partenaires prises en charge. | API Gemini, Google AI Studio, projets Google AI, Vertex AI, application Gemini |
| Style de déploiement | Inférence auto-hébergée, marginale, locale d'abord, hébergée par un partenaire | Hébergé par Google |
| Utilisation hors ligne | Oui, en fonction de votre propre configuration | Non, pas dans le même sens |
| Fenêtre de contexte | 128 Ko sur E2B/E4B ; 256 Ko sur 12B Unified, 31B et 26B A4B | Jusqu'à 1 million de jetons sur les modèles de développement actuels de Gemini 3 |
| Types d'entrées | Texte et image sur toutes les variantes ; audio d'origine sur les modèles E2B, E4B et 12B Unified | Texte, images, vidéo, audio, documents et flux de travail médiatisés par des outils, selon le modèle. |
| Types de sorties | Texte | Texte en gros, plus génération d'images et de vidéos grâce à la pile de modèles hébergés de Google |
| Outillage | Appel de fonction et support de codage au niveau du modèle, mais l'orchestration est votre travail. | Recherche, contexte URL, exécution de code, appel de fonction, sorties structurées, API médias |
| Limite de confidentialité | Déterminé par vos choix d'infrastructure et de déploiement | Déterminé par le niveau de service et les conditions de Google |
| Modèle de coût | Téléchargement du modèle plus les coûts de matériel, de stockage, de réglage et d'exploitation | Tarification en nuage basée sur des jetons ou sur des supports, ainsi que des niveaux gratuits et payants |
| Meilleure adéquation | IA locale, déploiements privés, flux de travail personnalisés, utilisation périphérique | Recherche gérée, analyse de contextes longs, travail multimodal en nuage, flux d'images et de vidéos |
| Mauvaise adaptation | Génération de médias clés en main ou facilité d'utilisation de l'informatique en nuage en mode zéro. | Contrôle en ligne d'abord ou contrôle approfondi de l'auto-hébergement |
Voici la comparaison : Documentation relative au déploiement de Gemma par Google ainsi que les spécifications du modèle pour développeurs Gemini ; les abonnements aux applications et l'accès aux API constituent des produits distincts.

Gemma 4 : modèles et mémoire
Gemma 4 a été lancé le 31 mars 2026. Le fiche technique du modèle actuel répertorie les versions E2B, E4B, 12B Unified, 26B A4B et 31B sous licence Apache 2.0. Toutes acceptent du texte et des images et renvoient du texte.
| Variante | Contexte | Entrée audio | Fonction type |
|---|---|---|---|
| E2B | 128 Ko | Oui | Point d'entrée pour les appareils soumis à des contraintes |
| E4B | 128 Ko | Oui | Une solution locale plus complète pour les environnements aux ressources limitées |
| 12B Unifié | 256K | Oui | Option intermédiaire avec entrées multimodales unifiées |
| 26B A4B | 256K | Non | Mélange d'experts ; environ 4 milliards de paramètres actifs |
| 31B | 256K | Non | Le plus grand modèle dense de cette famille |
- Compréhension : analyse de documents, OCR, écriture manuscrite, graphiques, interfaces, programmation et appel de fonctions.
- Limites audio/vidéo : Ce modèle permet d'enregistrer jusqu'à 30 secondes d'audio et 60 secondes de vidéo à raison d'une image par seconde. Date limite des données d'entraînement : janvier 2025.
- 12B Unifié : intègre des fragments d'images et des formes d'onde audio dans le modèle linguistique sans recourir à des encodeurs distincts.
- Déploiement : Parmi les environnements d'exécution, on trouve Hugging Face, Ollama, vLLM, llama.cpp, MLX et LM Studio. Choisissez l'environnement d'exécution compatible avec le modèle et le matériel que vous avez sélectionnés.
| Variante | Mémoire BF16 | Mémoire SFP8 | Mémoire Q4_0 |
|---|---|---|---|
| E2B | 11,4 Go | 5,7 Go | 2,9 Go |
| E4B | 17,9 Go | 8,9 Go | 4,5 Go |
| 12B Unifié | 26,7 Go | 13,4 Go | 6,7 Go |
| 26B A4B | 57,7 Go | 28,8 Go | 14,4 Go |
| 31B | 69,9 Go | 34,9 Go | 17,5 Go |
Gemma 4 : mémoire nécessaire pour charger le modèle
Estimations Q4_0 (4 bits). Plus les barres sont courtes, plus l'empreinte mémoire du modèle est réduite.
E2B · 2,9 Go
E4B · 4,5 Go
12B Unifié · 6,7 Go
26B A4B · 14,4 Go
31B · 17,5 Go
Échelle : 0 à 20 Go. Source : Table de mémoire Gemma de Google. Il s'agit d'estimations de chargement, et non des besoins en mémoire complets de l'application.
Le tableau de Google indique une surcharge de chargement de 20%. Prévoyez de la mémoire supplémentaire pour le cache de contexte, le runtime et la concurrence ; le réglage fin nécessite davantage de mémoire. Le modèle 26B A4B charge toujours l’ensemble de ses poids d’experts, même si seul un sous-ensemble est actif par token.
Gemma 4 s'appuie sur les recherches menées dans le cadre du projet Gemini 3 et propose plusieurs voies de déploiement : GPU grand public, serveurs locaux et appareils mobiles. La préversion pour développeurs d'Android AICore de Google ainsi que les projets concernant la prochaine génération de Gemini Nano sont décrits dans son Présentation de Gemma 4.
Pour une autre gamme de poids libre, comparez les prévisions de déploiement avec notre Test de la Kimi K3.
Quel modèle Gemini convient ?
Choisissez le modèle adapté à votre projet. Une version plus récente de Flash ne remplace pas la gamme Pro. Le Répertoire des modèles Gemini distingue les modèles de raisonnement, les modèles d'image et les modèles vidéo.
| Modèle ou produit | L'utiliser pour | Limite d'accès |
|---|---|---|
| Gemini 3.1 Pro Preview | Raisonnement complexe, programmation et analyse multimodale | Sortie de texte hébergée |
| Gemini 3,8 Flash | Flux de travail basés sur des agents et tâches générales de production | Sortie de texte hébergée |
| Gemini 3.5 Flash-Lite | Traduction de grands volumes et traitement simplifié | Sortie de texte hébergée |
| Nano Banana Pro / Nano Banana 2 | Création et retouche d'images | Modèles d'images dédiés |
| Veo 3.1 | Génération vidéo | Séparation entre le modèle vidéo et la facturation |
- Application Gemini + forfaits Google AI : accès des utilisateurs et droits d'accès aux applications.
- Google AI Studio : prototypage par les développeurs.
- API Gemini : Intégration de l'application au système de facturation des développeurs.
- Vertex AI : Déploiement sur Google Cloud et contrôles d'entreprise ; vérifiez sa disponibilité et ses conditions d'utilisation.
Pour accéder à l'application, consultez notre Guide d'accès libre Gemini Pro.
Maîtrise ou facilité d'utilisation ?

| Vous êtes responsable de… | Gemma 4 auto-hébergée | API Gemini |
|---|---|---|
| Service et évolutivité | Matériel, environnement d'exécution, capacité et mises à jour | Google gère la mise à disposition des modèles |
| Outils et recherche | Établir et entretenir les relations | Outils intégrés, le cas échéant ; configurez votre flux de travail |
| Fiabilité | Surveillance, solutions de secours, débit et quantification | Gérer les erreurs API, les quotas, les tentatives de réessai et les budgets |
| Données et sécurité | Contrôles d'accès, journaux et comportement des outils locaux | Choisissez le niveau de service et configurez le traitement sécurisé des données |
Gemma vous offre davantage de contrôle. Gemini permet de gagner du temps lors de la configuration. Dans les deux cas, il faut toutefois qu’une personne soit responsable de la fiabilité de l’application et de la qualité du résultat.
Contexte et soutien des médias
| Capacité | Gemma 4 | Pile de développement Gemini |
|---|---|---|
| Contexte de saisie | 128 Ko : E2B/E4B ; 256 Ko : 12B/26B/31B | 1 048 576 jetons d'entrée sur 3.1 Pro, 3.8 Flash et 3.5 Flash-Lite |
| Sortie texte | Oui ; extraction, résumés, code et données structurées | Oui ; jusqu'à 65 536 jetons de sortie sur ces trois modèles |
| Compréhension visuelle | Images, documents, graphiques, captures d'écran et extraits vidéo | Images, vidéos et fichiers PDF ; outils spécifiques à chaque modèle |
| Compréhension orale | E2B, E4B et 12B unifiées | Compatible avec les trois modèles ci-dessus |
| Génération d'images et de vidéos | Sortie non native | Modèles d'images dédiés et Veo ; ne proviennent pas des modèles de texte Pro/Flash |
Les limites proviennent de la Fiche de présentation de Gemma et les spécifications propres au modèle Gemini. Une fenêtre contextuelle plus grande ne garantit pas des réponses plus précises.
- Livrables de Gemma : fiches de facturation au format JSON, résumés de diapositives, transcriptions de discours, listes de tâches à partir de captures d'écran et plans de recherche.
- Gestion des documents Gemini : prise en charge native des fichiers PDF, y compris les graphiques et les tableaux ; jusqu'à 50 Mo ou 1 000 pages, la saisie combinée restant toutefois soumise aux contraintes du contexte du modèle.
- Production audiovisuelle : utilisez un modèle d'image ou de vidéo distinct après avoir rédigé le cahier des charges.
Les limites relatives aux fichiers et aux pages sont expliquées dans Documentation PDF de Google.
Confidentialité : comparez les niveaux de service
| Configuration | Que deviennent les données ? | Ce qu'il faut vérifier |
|---|---|---|
| Gemma 4 auto-hébergée | L'inférence peut rester sur le matériel que vous contrôlez | Outils d'accès à distance, télémétrie, journaux, autorisations et sauvegardes |
| Services non facturés de l'API Gemini | Les données fournies et les résultats obtenus peuvent contribuer à l'amélioration des produits Google ; un examen par des humains peut être effectué | Ne transmettez pas de données sensibles dans le cadre des présentes conditions ; des exceptions régionales s'appliquent. |
| Services payants de l'API Gemini | Les suggestions et les réponses ne sont pas utilisées pour améliorer les produits Google. | Les restrictions relatives à la conservation des journaux de sécurité et aux divulgations légales restent applicables |
| EEE, Suisse et Royaume-Uni | Les conditions d'utilisation des données applicables aux services payants s'appliquent également aux services gratuits dans ces régions | Les clients API proposés aux utilisateurs sur ce site doivent utiliser des services payants |
Cette distinction fait suite à la Conditions de l'API Gemini. AI Studio peut être considéré comme un service payant s'il est associé à un projet Cloud actif avec facturation ou à un compte Workspace d'entreprise, même si l'accès à Studio est en soi gratuit.
- « Local » ne signifie pas automatiquement « conforme » : Votre déploiement et vos contrôles d'accès définissent les limites de la confidentialité.
- Le fait que ce soit payant ne signifie pas pour autant qu’il n’y ait aucune fidélisation : examinez les registres, les lieux de traitement et les exigences de votre organisation.
- La prise en charge des régions est distincte : vérifier le régions prises en charge par l'API Gemini ainsi que le chemin d'accès Vertex AI correspondant, le cas échéant.
Les droits de diffusion constituent une question à part ; voir le Guide d'utilisation commerciale des images Gemini.
Coûts : matériel local vs API
| Poste de coûts | Gemma 4 en auto-hébergement | API Gemini |
|---|---|---|
| Utilisation du modèle | Poids téléchargeables ; pas de facture de jetons Google pour l'inférence locale | La consommation est facturée au tarif correspondant au forfait sélectionné |
| Infrastructure | Matériel, mémoire, stockage, alimentation et serveurs | Google gère la diffusion |
| Opérations | Installation, réglage, surveillance et maintenance | Intégration, tentatives de reprise, contrôles budgétaires et vérification des résultats |
| Fonctionnalités supplémentaires | Créez ou connectez vos propres services | Les frais liés aux outils, à la mise en cache/au stockage, aux images et aux vidéos peuvent être facturés séparément |
Pour une charge de travail réduite ou ponctuelle, le recours à une API peut s'avérer moins coûteux que le temps consacré à la mise en place d'une infrastructure locale. Les charges de travail régulières peuvent justifier l'auto-hébergement, mais cela dépend du taux d'utilisation et des coûts d'exploitation.
| Modèle API standard | Données d'entrée / 1 million de jetons | Résultat / 1 million de jetons |
|---|---|---|
| Gemini 3.1 Pro Preview | ≤ 200 000 caractères : $2 ; > 200 000 : $4 | ≤ 200 K : $12 ; > 200 K : $18 |
| Gemini 3,8 Flash | Jusqu'au 31 décembre 2026 : $0,75 ; puis $1,50 | Jusqu'au 31 décembre 2026 : $3,75 ; puis $7,50 |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 |
Combien coûteraient 100 tâches de saisie de texte ?
Par appel : 10 000 jetons d'entrée + 1 000 jetons de sortie facturables. Total : 1 million d'entrées + 100 000 sorties.
Gemini 3.1 Pro Preview · $3.20
Gemini 3,8 Flash · $1.125 (environ $1.13)
Gemini 3.5 Flash-Lite · $0,55
Échelle : 0 à 4 USD. Calculé à partir de Tarifs standard des API de Google; il s'agit d'un exemple de coût, et non d'un résultat de test.
- Calcul : taux d'entrée × 1 + taux de sortie × 0,1. Chaque requête reste en dessous du seuil de 200 000 fixé par Pro.
- La sortie comprend des jetons de réflexion. Le quota de 1 000 jetons correspond à la production totale facturable, et non pas uniquement à la réponse visible.
- Sont exclus : outils, mise en cache/stockage, tentatives de reconnexion, taxes et génération d'images/vidéos. Aucune remise sur les commandes groupées n'est appliquée.
- Offre flash : Le code $1.125 s'applique jusqu'au 31 décembre 2026. Aux tarifs en vigueur au 1er janvier 2027, la même charge de travail correspond au code $2.25.
- Achats séparés : Les forfaits des applications Google AI, l'utilisation de l'API Gemini et les abonnements GlobalGPT sont soumis à des modalités de facturation et à des droits d'accès différents.
Le forfait Veo est facturé en fonction de la durée des vidéos générées et du niveau/de la résolution sélectionnés. La génération d'images est également soumise à des tarifs différents ; comparez Nano Banana : quotas et coûts liés à l'API.
Comment interpréter les résultats des tests de performance
Utilisez des tests de performance pour présélectionner des modèles, puis testez-les sur la tâche qui vous intéresse réellement. Un système hébergé intégrant des outils et un modèle quantifié localement constituent deux configurations d’évaluation différentes.
- Gemma 4 : le fiche officielle du modèle présente les résultats en matière de raisonnement, de codage et d'approches multimodales, notamment pour les tests MMLU-Pro, AIME 2026, LiveCodeBench, GPQA Diamond, MMMU-Pro et MATH-Vision.
- Gemini 3.1 Pro : Google Page de référence « Pro » couvre des domaines complexes tels que les sciences, la programmation et les tâches des agents. Les résultats obtenus à l'aide d'outils de recherche ou de programmation permettent également d'évaluer le système assisté par des outils.
- Comparez de manière équitable : Il est préférable d'ajuster la version du modèle, les invites, les outils, le budget de réflexion et les paramètres d'inférence avant d'appeler un modèle.
| Ce que les tableaux de référence peuvent vous apprendre | Ce qu'ils ne peuvent pas vous dire |
|---|---|
| Une famille de modèles à poids ouvert comble-t-elle le fossé en matière de raisonnement difficile et de tâches multimodales ? | S'il est moins coûteux ou plus facile à déployer pour votre équipe |
| Le modèle de frontière hébergée est-il plus performant pour les tâches difficiles de codage, de science ou d'agent ? | Si cet avantage survit à vos contraintes spécifiques en matière de latence, de respect de la vie privée ou de budget |
| Une famille de modèles est-elle suffisamment solide pour être utilisée au niveau local ? | Si elle sera plus performante qu'un autre modèle dans le cadre d'une utilisation précise de l'appareil et de l'outil. |
| Le contexte long et le soutien multimodal sont-ils plus que des affirmations marketing ? | Que la qualité de sortie corresponde à vos normes en matière d'enseignement, de recherche ou de création |
Pour votre propre test, notez la qualité des réponses, le temps de latence et le coût total d'exploitation. Les scores publics ne permettent pas de déterminer quel déploiement est le plus économique ou le plus fiable pour votre équipe.
Documents, codage et supports

| Emploi | L'approche Gemma 4 | Approche Gemini |
|---|---|---|
| Documents | Générer des pages ou des flux d'images ; mettre en place des fonctions d'extraction locale et de reconnaissance optique de caractères (OCR), ainsi qu'une sortie structurée | Utiliser la prise en charge native des fichiers PDF pour les mises en page mixtes, les graphiques et les tableaux |
| Recherche | Connectez vos propres outils de recherche, de navigation et de vérification | Utiliser les fonctionnalités prises en charge : recherche par contexte, contexte d'URL et exécution de code |
| Codage | Intégrer le modèle dans les outils internes et les environnements de test contrôlés | Utiliser des méthodes de raisonnement guidées et des outils adaptés au codage en plusieurs étapes |
| Images | Définir les besoins, classer les ressources et rédiger le cahier des charges | Créer ou modifier à l'aide des modèles d'images Nano Banana |
| Vidéo | Analyser les images sélectionnées ; préparer les storyboards et les listes de plans | Générer la vidéo proprement dite avec Veo |
Pour découvrir une autre solution de gestion des flux de documents, comparez notre Flux de travail PDF ChatGPT.
Dix cas d'utilisation concrets
| Flux de travail réel | Meilleur ajustement | Pourquoi |
|---|---|---|
| Assistant de classe hors ligne sur un ordinateur portable de l'école | Gemma 4 | Le déploiement local et l'exécution hors ligne sont plus importants que les outils multimédias hébergés |
| Extraction sous contrat privé dans un environnement contrôlé | Gemma 4 | Le périmètre des données peut rester à l'intérieur de votre infrastructure |
| Analyse d'un dossier de recherche de 500 pages | Gémeaux | Le contexte 1M et la compréhension native des PDF réduisent les frictions dans le pipeline |
| Recherche concurrentielle fondée sur la recherche | Gémeaux | La recherche, le contexte URL et l'utilisation d'outils sont intégrés dans la pile hébergée. |
| Compréhension des captures d'écran locales et triage de l'interface utilisateur | Gemma 4 | La vision et la sortie de texte sont suffisantes, et l'utilisation locale peut être plus simple. |
| Génération et édition d'images marketing | Modèles d'image Gemini | La génération et l'édition d'images hébergées sont officiellement prises en charge |
| Du scénario à la vidéo finie | Gémeaux | Veo dans la pile d'API Gemini couvre la sortie vidéo directe |
| Assistant de codage interne personnalisé dans votre propre environnement | Gemma 4 | Une meilleure adéquation lorsque le contrôle du modèle et l'auto-hébergement sont importants |
| Résumés à haut volume et à faible coût à l'échelle | Gemini Flash ou Flash-Lite, ou Gemma 4 en fonction de la maturité des opérations | La tarification hébergée peut être moins chère pour les petites équipes, l'auto-hébergement peut l'emporter à grande échelle. |
| Expériences d'inférence mobile et périphérique | Gemma 4 | Google positionne explicitement Gemma 4 pour les GPU grand public, les serveurs "local-first" et les passerelles Android. |
- Élèves et enseignants : Les guides d'étude locaux, les résumés des diapositives de cours et les outils d'aide à l'enseignement hors ligne sont plus adaptés à Gemma ; les travaux écrits volumineux et les supports de présentation conviennent mieux aux outils hébergés de Gemini.
- Chercheurs : Conserver les corpus privés en local lorsque cela est nécessaire ; utiliser Gemini pour la synthèse de documents volumineux et les travaux basés sur le Web lorsque la politique en matière de données le permet.
- Professionnels du marketing et créateurs : Gemma peut organiser les briefs et les ressources ; des équipes spécialisées dans la gestion des médias se chargent ensuite de mener le projet jusqu'à la réalisation des images ou des vidéos finales.
Pour la partie vidéo, utilisez le Guide d'accès Veo 3.1.
Deux suggestions à essayer
Gemma 4 : extraction des factures privées. Ce flux de travail conserve les fichiers sources en local et génère du texte structuré.
Vous lisez un lot de pages de factures et de captures d'écran provenant du même dossier fournisseur.
Pour chaque page :
1. Extrayez le numéro de la facture, la date d'émission, la date d'échéance, les postes, le sous-total, la taxe et le total.
2. Marquez les champs à faible probabilité.
3. Si une valeur n'apparaît que dans une région de l'image, indiquez-le.
4. Renvoyer uniquement du JSON valide.
- Entrée : pages de factures et captures d'écran.
- Sortie : JSON, y compris les indicateurs de faible fiabilité.
- Votre mission : valider les champs et les totaux avant de les transmettre à un autre système.
Gemini : un workflow « du rapport à la campagne ». Utilisez des outils d'analyse de documents et d'URL, puis transmettez le brief ainsi obtenu au modèle média approprié.
Lisez ce rapport de marché de 300 pages et les pages de l'entreprise qui y sont liées.
Résumez les cinq changements les plus importants pour une équipe SaaS américaine.
Pour chaque changement, fournissez
- une explication en langage clair
- une citation ou un point de données étayé par des preuves
- une implication sur le produit
- une implication marketing
Transformez ensuite le résumé en
- un plan de présentation en six diapositives
- un résumé de l'infographie sociale
- un script vidéo de 45 secondes
- Entrée : un rapport de 300 pages et des fiches d'entreprise.
- Sortie : une analyse étayée par des données, un plan de présentation, une fiche descriptive d'image et un script vidéo.
- Prochaine étape : La génération de l'image ou de la vidéo nécessite l'appel d'un modèle distinct ; cette instruction génère les plans.
Pour l'étape relative à l'image, passez à la Guide d'utilisation rapide de Nano Banana Pro.
Quand utiliser les deux ?

- Privilégiez les produits locaux : extraction de données sensibles, tri des captures d'écran, classification des documents confidentiels et inférence en périphérie.
- Passez en revue le transfert : approuver ou expurger le contenu avant qu'il ne quitte l'environnement local.
- Envoyer vers le cloud : synthèse de documents volumineux, recherche sur le Web et production médiatique.
- Choisissez par type de livrable : Un fondateur pourrait utiliser Gemma Local pour l'analyse privée, Gemini pour la synthèse et un autre modèle pour l'édition de la voix de marque.
Le catalogue de GlobalGPT comprend les modèles Gemini 3.1 Pro, Gemini 3.8 Flash, Nano Banana Pro, Nano Banana 2 et Veo 3.1, ainsi que des modèles n’appartenant pas à Google. Un espace de travail regroupé permet de réduire les changements d’onglet entre la recherche, la rédaction, les images et la vidéo.
Cinq erreurs à éviter
- “ Des poids téléchargés, c'est la liberté de production. ” Prendre en compte le matériel, la mémoire, l'alimentation électrique, l'ingénierie et la maintenance.
- “ Tous les niveaux Gemini traitent les données de la même manière. ” Comparez les conditions générales de service et les conditions spécifiques à chaque région.
- “ Le terme ”multimodal” désigne la génération d’images et de vidéos. » Gemma comprend les données visuelles, mais renvoie du texte.
- “ Le cloud remplace tous les cas d'utilisation en local. ” L'exécution hors ligne et l'auto-hébergement nécessitent tout de même un chemin de déploiement local.
- “ C'est le meilleur résultat qui l'emporte. ” Votre prompt, vos outils, votre objectif de latence et vos limites de données peuvent influencer le résultat concret.
Lequel choisir ?

| Choisissez… | Quand ce sont là vos priorités |
|---|---|
| Gemma 4 | Accès hors ligne ; contrôle de la taille et de la durée d'exécution ; extraction locale de données sensibles ; déploiement en périphérie |
| Gémeaux | Moins de tâches de mise à disposition ; documents volumineux ; outils gérés ; accès à des modèles distincts pour les images et les vidéos |
| Les deux | Prétraitement privé en local, suivi d'une recherche ou d'une production validée dans le cloud |
Gemma 4 vous offre le contrôle. Gemini vous offre une plateforme gérée. Choisissez la configuration adaptée à votre charge de travail et à la capacité de travail de votre équipe.
Avant de vous engager
- Définissez le résultat : du texte au format JSON, une image, une vidéo ou une action dans un autre outil.
- Définir la limite des données : Quelles données d'entrée peuvent sortir de votre environnement ?
- Estimation de la charge de travail : les requêtes, les jetons, la concurrence et la disponibilité requise.
- Nommez l'opérateur : Qui est responsable des budgets et des défaillances liés aux serveurs locaux ou au cloud ?
- Essayez une tâche représentative : Évaluez la qualité, la latence et le coût total avant de passer à une échelle supérieure.
Questions fréquemment posées
Gemma 4 peut-il fonctionner hors ligne ?
Oui, à condition de disposer des poids téléchargés et d'un environnement d'exécution local adapté. La recherche externe, les outils distants et les téléchargements de modèles nécessitent toutefois une connexion distincte.
Quels modèles Gemma 4 prennent en charge l'audio ?
Les modèles E2B, E4B et 12B Unified prennent en charge l'audio. Les cinq tailles prennent en charge le texte et les images et génèrent du texte ; elles ne sont pas des générateurs natifs d'images ou de vidéos.
Le modèle Gemma 4 est-il moins cher que le Gemini ?
Cela dépend de l'utilisation et de l'infrastructure. Les pondérations locales répercutent les coûts sur le matériel et l'exploitation ; Gemini facture l'utilisation de l'API et tout outil supplémentaire.
L'abonnement Gemini comprend-il des crédits API ?
Les forfaits Google AI destinés aux particuliers et la facturation de l'API Gemini font l'objet d'achats distincts. Consultez les conditions d'utilisation spécifiques à l'application ou la grille tarifaire pour développeurs correspondant à votre flux de travail.
Puis-je utiliser les modèles allant du Gemini au GlobalGPT ?
GlobalGPT propose des itinéraires du modèle Gemini, ainsi que d'autres familles de modèles et outils multimédias. Sa facturation et ses contrôles sont distincts des applications natives de Google et des comptes API.



