Kosten van Gemini 3.1 Pro Preview $2 per miljoen invoertokens en $12 per miljoen uitvoertokens op het standaard Gemini API-niveau voor prompts van maximaal 200.000 tokens. Boven die drempel gelden de tarieven $4 en $18. Bij de facturering van de output worden ook ‘thinking tokens’ meegerekend. Voor de Gemini-app is Google AI Pro een afzonderlijke $19,99 maandelijks abonnement in de Verenigde Staten.
Het bedrag dat je moet begroten, hangt af van waar je het model voor gebruikt. Voor een app-abonnement, een API-project en een werkruimte met meerdere modellen gelden verschillende factureringsregels. Een lang document, een uitgebreide gespreksgeschiedenis of een groot denkbudget kunnen de API-factuur beïnvloeden, zelfs als het aantal verzoeken gelijk blijft.
Voor werk dat zich uitstrekt van onderzoek en schrijven tot programmeren en het maken van media, GlobalGPT brengt Gemini, Claude, GPT en andere modellen samen in één abonnement en één werkruimte. Het is een praktische manier om een bredere AI-workflow te organiseren en de abonnementskosten te beheren zonder voor elke tool een aparte account aan te maken. GlobalGPT publiceert deze gids; de onderstaande prijzen van de aanbieder zijn afkomstig van hun officiële pagina’s.

Wat is Gemini 3.1 Pro? Model en contextvenster
Google heeft op 19 februari 2026 de Gemini 3.1 Pro aangekondigd. Het API-model dat hier wordt behandeld, is gemini-3.1-pro-preview. Het officiële modelspecificatie vermeldt een invoerlimiet van 1.048.576 tokens en een uitvoerlimiet van 65.536 tokens. Het accepteert tekst, afbeeldingen, video, audio en PDF’s, en genereert tekst. Deze invoermogelijkheden maken het geen model voor het genereren van afbeeldingen of video’s.
Voor gebruikers die de Gemini Pro-tokenlimiet, capaciteit en kosten geven antwoord op verschillende vragen: het model kan weliswaar een groot bestand verwerken, maar een prompt van meer dan 200.000 tokens valt in de hogere prijsklasse. Ook de volledige conversatie en herhaald bronmateriaal spelen een rol bij de prompt die je verstuurt.
In zijn aankondiging van de lancering, Google rapporteerde een ARC-AGI-2-score van 77,1%. Dat is een door de leverancier gerapporteerd resultaat op het gebied van redeneren, geen maatstaf voor uw kosten per bruikbaar antwoord. Een waardevollere manier om uw budget te toetsen, is na te gaan of het model uw daadwerkelijke document-, programmeer- of analyseopdracht met minder correcties afrondt. De Gemini 3.1 Pro-codeergids daarin wordt die workflow uitgebreider behandeld.
Gemini 3.1 Pro API-tarieven per miljoen tokens
De Gemini API-prijslijst maakt een onderscheid tussen standaardverzoeken en Batch-, Flex- en Priority-inferenties. Alle tarieven in de onderstaande tabel zijn in Amerikaanse dollars per miljoen tokens. Selecteer de prijsklasse met behulp van de aantal prompt-tokens; pas vervolgens de bijbehorende invoer- en uitvoersnelheden toe.
| Modus | Prompt ≤200k: invoer / uitvoer | Prompt >200k: invoer / uitvoer | Als het past |
|---|---|---|---|
| Standaard | $2 / $12 | $4 / $18 | Regelmatig interactief gebruik |
| Batch | $1 / $6 | $2 / $9 | Asynchroon werken; streeftermijn van 24 uur |
| Flex | $1 / $6 | $2 / $9 | Latentietolerant synchroon werk; variabele latentie en beschikbaarheid op basis van ‘best effort’ |
| Prioriteit | $3.60 / $21.60 | $7.20 / $32.40 | Een apart geprijsd prioriteitsniveau voor inferentie |
Batch en Flex halveer de vermelde standaardinvoer- en uitvoersnelheden, waarbij verschillende afwegingen tussen doorlooptijd en beschikbaarheid gelden. Ze zijn handig voor taken zoals het classificeren van een documentverzameling of het opstellen van een rapport dat je niet onmiddellijk nodig hebt. Deze korting op het aantal tokens leidt niet automatisch tot een halvering van de cacheopslag of van alle toolkosten.
De grens van 200k: invoer verdubbelt, uitvoer stijgt met 50%
Een verzoek van precies 200.000 tokens valt nog steeds in de lagere categorie. Boven de 200.000 stijgt het standaard invoertarief van $2 naar $4, terwijl het uitvoertarief stijgt van $12 naar $18. De hogere tarieven zijn van toepassing op het totale aantal tokens van het verzoek; het gaat hier niet om een toeslag die uitsluitend geldt voor de tokens boven de 200.000.
Bron: Prijzen voor de Google Gemini API. Standaardniveau; gecontroleerd op 15 september 2026. Alle balken zijn gebaseerd op dezelfde schaal in dollars.
Een grotere invoer kan ook de uitvoersnelheid verhogen, zelfs als het antwoord kort is.
Een uitgewerkte maandelijkse API-raming
Stel dat je 100 standaardverzoeken indient, elk met 10.000 invoertokens en 2.000 factureerbare uitvoertokens. De schatting is 100 × [(10.000 ÷ 1.000.000 × $2) + (2.000 ÷ 1.000.000 × $12)] = $4,40. Dit is een indicatieve berekening, geen definitieve factuur; gereedschap, caching, opslag, belastingen en platformkosten zijn hierin niet meegerekend.
Voor één grotere aanvraag met 250.000 invoertokens en 10.000 factureerbare uitvoertokens levert dezelfde methode het volgende resultaat op: $1.18: $1.00 voor de invoer plus $0.18 voor de uitvoer. Hanteer de factureerbare uitvoer, inclusief het denkwerk, in plaats van alleen de woorden te tellen die je in het antwoord kunt zien.
- Tel de volledige prompt mee, inclusief de gespreksgeschiedenis en de bronbestanden.
- Bepaal de aanvraagmodus en de juiste haakjesgrootte voor de prompt.
- Voeg de factureerbare prestaties toe, en vervolgens eventuele kosten voor caching, opslag en hulpmiddelen.
- Vergelijk het gebruiksrapport met de schatting voordat je opschaalt.
De officiële tokenhandleiding legt het tellen van tokens uit. Gebruik voor de configuratie en implementatie de Gemini 3.1 Pro API-ontwikkelaarshandleiding.
Hoe contextcaching de rekening beïnvloedt
Contextcaching is handig wanneer hetzelfde document, dezelfde repository of dezelfde systeeminstructies in herhaalde verzoeken voorkomen. Het houdt rekening met de hergebruikte invoer; het maakt het hele verzoek niet gratis. Op het standaardniveau kost gecacheerde invoer $0,20 per miljoen tokens voor prompts tot 200k, of $0,40 boven de 200k. Expliciete cacheopslag voegt $4,50 per miljoen in de cache opgeslagen tokens per uur.

Google beschrijft twee benaderingen in zijn documentatie over contextcaching: bij impliciete caching worden de besparingen automatisch doorberekend wanneer een verzoek in de cache terechtkomt; bij expliciete caching kun je een opgegeven prefix gedurende een gekozen geldigheidsduur behouden. Als je geen geldigheidsduur instelt, is de standaardduur voor expliciete caching één uur. Tokens in de cache tellen nog steeds mee voor de tokenlimieten, dus caching zorgt er niet voor dat een lange prompt in een lagere prijsklasse terechtkomt.
| Scenario met herhaalde invoer | Vijf leesbewerkingen van 100.000 tokens | Opslag | Illustratief totaal |
|---|---|---|---|
| Niet in de cache opgeslagen, standaard onderste haakje | $1.00 | $0 | $1.00 |
| Expliciete cache wordt 1 uur bewaard | $0.10 | $0.45 | $0.55 |
| De expliciete cache wordt 24 uur bewaard | $0.10 | $10.80 | $10.90 |
Deze schattingen hebben uitsluitend betrekking op de terugkerende invoer- en opslagcomponenten. Nieuwe, niet-gecachete invoer en uitvoer komen daar nog bij. Een cache met een korte levensduur die meerdere keren wordt hergebruikt, kan nuttig zijn; het 's nachts aanhouden van een grote cache voor slechts enkele leesbewerkingen kan meer kosten dan het opnieuw verzenden van die invoer. Stel de bewaartermijn af op de daadwerkelijke werksessie en controleer het aantal cache-hits, in plaats van ervan uit te gaan dat elke herhaalde prompt een korting oplevert.
Het gebruik van tools kan een extra post opleveren. Voor het onderbouwen met Google Search, De prijstabel van Google vermeldt 5.000 gratis “zoekverzoeken” per maand, verdeeld over Gemini 3.x-modellen, en vervolgens $14 per 1.000 zoekverzoeken. Het handleiding voor aarding verduidelijkt dat bij de facturering volgens het Gemini 3-model de zoekopdrachten worden geteld die het model uitvoert, waarbij lege zoekopdrachten niet worden meegeteld bij het tellen van unieke zoekopdrachten. Eén generatieverzoek dat twee afzonderlijke zoekopdrachten activeert, verbruikt daarom twee factureerbare zoekeenheden. Houd bij het opstellen van je budget rekening met het aantal uitgevoerde zoekopdrachten, niet alleen met het aantal gegenereerde antwoorden; de gratis tegoedlimiet is geen garantie voor 5.000 onderbouwde antwoorden.
Google AI Pro en Ultra: maandelijkse abonnementsprijzen in de VS
Als je Gemini in een chatinterface wilt gebruiken, vergelijk dan De abonnementen van Google in de VS in plaats van het aantal chatberichten te vermenigvuldigen met de tarieven per API-token. Op de openbare Amerikaanse pagina staan de volgende maandelijkse opties vermeld. Dit zijn de geadverteerde abonnementsprijzen, geen offerte voor elk land of een totaalbedrag inclusief btw bij het afrekenen.
| Amerikaans plan | Aangegeven maandprijs | Relevant onderscheid in toegangsrechten |
|---|---|---|
| Gratis | $0 | Toegang tot de Gemini-app, inclusief verschillende toegangsniveaus tot 3.1 Pro |
| Google AI Plus | $4.99 | Meer toegangsrechten dan bij de gratis versie |
| Google AI Pro | $19.99 | Uitgebreidere toegang tot Gemini, Google-app-functies en 5 TB opslagruimte |
| Google AI Ultra 5x | $99.99 | 5x hogere gebruikslimieten dan bij AI Pro op de Amerikaanse abonnementspagina |
| Google AI Ultra 20x | $199.99 | 20 keer hogere gebruikslimieten dan bij AI Pro op de Amerikaanse abonnementspagina |

De aanduidingen ‘5x’ en ‘20x’ hebben betrekking op de gepubliceerde vergelijking tussen de abonnementen; ze vormen geen garantie voor een vast aantal API-aanroepen. Google AI Pro is het overwegen waard als Gemini deel uitmaakt van je dagelijkse werkzaamheden en je ook gebruikmaakt van de meegeleverde Google-functies en opslagruimte. Voor lichter gebruik kan het gratis abonnement of het Plus-abonnement volstaan. Ultra is zinvol wanneer het intensievere app-gebruik of de extra functies een oplossing bieden voor een beperking waar je daadwerkelijk tegenaan loopt.
Bevat Google AI Pro API-tegoed?
Google AI Pro bevat een $10 maandelijks ontwikkelaarskrediet door de Google Developer-programma. Google’s huidige veelgestelde vragen beschrijft het bijbehorende Pro/Ultra-voordeel als een maandelijks Google Cloud-tegoed. Dit algemene richtlijnen voor cloudtegoed behandelt producten zoals Firebase, Vertex AI en Google Maps, en legt uit hoe je via My Benefits een voordeel kunt toekennen aan één in aanmerking komend factureringsaccount.
Controleer, voordat u het tegoed in uw budget gebruikt, het specifieke voordeel in ‘My Benefits’, de dienst waarop het van toepassing is, de vervaldatum en het beschikbare saldo op uw factureringsaccount. Controleer of het van toepassing is op de Gemini API-dienst en het project dat u van plan bent te gebruiken. Houd tot die tijd bij het plannen rekening met de API-kosten vóór de tegoeden die in deze handleiding worden vermeld. Houd de facturering voor uw Gemini-app-abonnement en uw API-project gescheiden wanneer u uw uitgaven bijhoudt.
De gratis proefperiode voor $300 Google Cloud is een andere, afzonderlijke aanbieding. In de factureringsgids voor API’s van Google wordt het gebruik van de Gemini-API vanaf maart 2026 uitgesloten van die gratis proefperiode. Een Cloud-welkomsttegoed mag daarom niet worden beschouwd als het maandelijkse ontwikkelaarsvoordeel dat bij een Google AI-abonnement hoort.
De instellingen en het gebruik van accountspecifieke facturering worden uitgelegd in Handleiding voor facturering via de Gemini API van Google. Ook de gebruikslimieten voor apps en de API-limieten verschillen; de Handleiding voor de beperkingen van de Gemini 3.1 Pro legt de verschillen uit. Het betalen van een abonnement neemt niet alle beperkingen weg.
Vergelijking van API-kosten: Gemini, GPT en Claude
De meest zinvolle vergelijking begint met hetzelfde tokenbudget. De onderstaande cijfers zijn gebaseerd op standaard, niet-gecachete first-party API-tarieven voor een prompt van 100.000 tokens en 10.000 factureerbare output-tokens. Hierin zijn tools, opslag, belastingen, regionale verwerkingskosten en platformkosten van derden niet meegerekend. Een gelijk aantal tokens betekent niet noodzakelijkerwijs een gelijke hoeveelheid tekst of even succesvolle antwoorden bij verschillende model-tokenizers.
| Geselecteerd model | Ingang / 1M | Uitgang / 1M | 100k ingang + 10k uitgang |
|---|---|---|---|
| Gemini 3.1 Pro Voorbeeld | $2 | $12 | $0.32 |
| GPT-5,5 | $5 | $30 | $0.80 |
| Claude Opus 4.8 | $5 | $25 | $0.75 |
| Claude Sonnet 4.6 | $3 | $15 | $0.45 |
| Claude Sonnet 5 | $2 | $10 | $0.30 |
Bronnen: Google, OpenAI GPT-5.5, Antropisch. Gecontroleerd op 15 september 2026; berekende voorbeelden, geen gemeten rekeningen.
Sonnet 5 kost $0,30 voor dit tokenbudget, vergeleken met $0,32 voor Gemini. Deze steekproef van vijf modellen is geen marktbreed onderzoek naar de goedkoopste modellen, noch een algemene ranglijst op basis van kwaliteit of rendement op investering.
Anthropic hanteert nu de invoersnelheden $2 en de uitvoersnelheden $10 van Sonnet 5 als standaardprijs; de eerder aangekondigde prijsverhoging in september zal niet plaatsvinden. Sonnet 4.6 en Opus 4.8 blijven nuttige referenties voor bestaande workloads, maar het gaat hierbij om eerdere Claude-versies en niet om het volledige huidige assortiment.
Langere prompts kunnen de omvang van het prijsverschil beïnvloeden. De hoogste prijsklasse van Gemini begint boven de 200.000 prompt-tokens; de gedocumenteerde drempelwaarde voor GPT-5.5 ligt boven de 272.000 invoertokens. Anthropic geeft standaardprijzen weer voor het volledige contextvenster van 1 miljoen voor Claude 4.6 en later. Bij 250.000 invoertokens en 10.000 uitvoertokens is de standaardtokenraming van Gemini $1,18, die van Sonnet 4.6 is $0,90 en die van Sonnet 5 is $0,60. Vergelijk de toepasselijke categorie voor de werklast die u daadwerkelijk gaat verzenden.
Kies op basis van de kosten per voltooide taak: neem daarbij ook mislukte pogingen, herinneringen, denkwerk en handmatige correcties mee. Aan de hand van de tokenprijzen alleen kun je niet bepalen welk model het beste bij jouw werk past. Voor achtergrondinformatie over de prijsstelling van het eerdere model, zie de bestaande vergelijking van Kosten voor Gemini 3 Pro en Gemini 3 API.
Wanneer een abonnement met meerdere modellen binnen uw budget past
Een project met directe API-toegang is geschikt voor een product dat programmeerbare oproepen en facturering op basis van gebruik vereist. Een Google AI-abonnement is geschikt voor gebruikers die Gemini willen en willen profiteren van de voordelen van het Google-ecosysteem. GlobalGPT is geschikt voor werkzaamheden die meerdere modellen en functies omvatten: onderzoek doen naar een onderwerp, een artikel opstellen en bijwerken, hulp vragen bij het programmeren en vervolgens ondersteunende media maken, allemaal binnen één werkruimte. De CLI koppelt bovendien AI-werkzaamheden aan terminal- en ontwikkelingsworkflows.

| Aankoop | Hoe maak je een begroting? | Kies dit voor |
|---|---|---|
| Gemini API | Invoer, uitvoer, serviceniveau, caching en hulpmiddelen | Software ontwikkelen of telefoongesprekken automatiseren |
| Google AI-abonnement | Het in de VS geadverteerde maandabonnement, inclusief de toelatingsvoorwaarden en beperkingen met betrekking tot de functies | Gebruik van Gemini en bijbehorende Google-producten |
| GlobalGPT abonnement | Het gekozen platformplan en de bijbehorende model- en functievergoedingen | Een bredere workflow die toonaangevende modellen en mediatools omvat |
De meerwaarde van een abonnementsvorm voor meerdere modellen ligt in de breedte van het aanbod en het gebruiksgemak binnen de workflow. Vergelijk de tools die je daadwerkelijk zou gebruiken met de afzonderlijke abonnementen die je anders nodig zou hebben. Kies een abonnement waarvan de limieten aansluiten bij die werklast; een platformabonnement en de API of het consumentenabonnement van een officiële aanbieder zijn verschillende producten.
- Voornamelijk chat en Google-apps? Kies het Google-abonnement waarvan het gebruiksniveau het beste bij je dagelijkse routine past. De handleiding voor wat gratis toegang tot Gemini inhoudt kan je helpen voordat je de upgrade uitvoert.
- Een product verzenden? Gebruik een API-budget met logbestanden, schattingen van het verbruik en de juiste factureringsinstellingen voor het project.
- Onderzoek, schrijven, programmeren en media in één dagelijkse routine? Verken De multi-model-werkruimte van GlobalGPT. Zie voor meer opties Alternatieven voor Gemini en hun sterke punten afstemmen op jouw werk.
Als praktische volgende stap na het kiezen van de toegangsroute, volg je hoe gebruik ik Gemini 3.1 Pro. Houd bij het volgen van de installatie-instructies rekening met het verschil tussen app-abonnementen en API-facturering.
Veelgestelde vragen
Hoeveel kost Gemini 3.1 Pro per miljoen tokens?
Op het standaard Gemini API-niveau kost Gemini 3.1 Pro Preview $2 per miljoen invoertokens en $12 per miljoen uitvoertokens voor prompts van maximaal 200.000 tokens. Boven de 200.000 prompttokens bedragen de tarieven $4 en $18. Bij de facturering van de output worden ook thinking-tokens meegerekend.
Is er een gratis Gemini 3.1 Pro API-abonnement?
Google vermeldt geen gratis API-pakket voor Gemini 3.1 Pro Preview. De Gemini-app biedt een gratis abonnement met beperkte toegang tot 3.1 Pro, en via Google AI Studio kun je modellen uitproberen. Deze toegangsmanieren bieden echter geen gratis API-quota voor productiegebruik van dit model.
Brengt de API kosten in rekening voor afbeeldingen en video’s?
Ja. De Gemini 3.1 Pro ondersteunt afbeeldingen, video, audio en PDF-bestanden als invoer, en het gebruik van tokens hiervoor telt mee voor de factuur. Het aantal tokens hangt af van het type media en de verwerkingsinstellingen. Het apparaat genereert tekst; voor het genereren van afbeeldingen of video’s worden modellen gebruikt waarvoor aparte tarieven gelden.
Valt een aantal van precies 200.000 input-tokens in de hogere prijsklasse?
Nee. Een opdracht van precies 200.000 tokens valt binnen de lagere standaardprijsklasse. Voor een opdracht van meer dan 200.000 tokens gelden de hogere invoer- en uitvoertarieven. Tokens in de cache tellen nog steeds mee voor de geldende tokenlimieten.
Is het $19.99 Google AI Pro-abonnement hetzelfde als API-facturering?
Nee. Het maandabonnement US $19.99 is een consumentenabonnement met een maandelijks ontwikkelaarskrediet van $10. De algemene richtlijnen van Google voor Cloud-krediet hebben betrekking op producten zoals Vertex AI en leggen uit hoe je een krediet toewijst aan één in aanmerking komend factureringsaccount. Controleer uw specifieke tegoed in ‘Mijn voordelen’, de in aanmerking komende dienst, de vervaldatum en het beschikbare saldo voordat u het toepast op uw Gemini API-budget. Totdat deze gegevens zijn bevestigd, dient u rekening te houden met API-kosten vóór het in mindering brengen van tegoeden.
Wat is de goedkoopste manier om Gemini 3.1 Pro te gebruiken?
Als je de app slechts af en toe gebruikt, kun je het beste beginnen met de toegang die het gratis abonnement biedt. Voor betaald API-gebruik kun je het aantal tokens inschatten en de opties ‘Batch’ of ‘Flex’ overwegen als de bijbehorende afwegingen qua timing bij je passen. Voor een breder, routinematig gebruik van verschillende modellen en mediatools kun je een abonnement voor meerdere modellen vergelijken met de afzonderlijke abonnementen die je anders zou gebruiken.
Stel je budget af op je daadwerkelijke route en werkvolume: Google’s API-prijslijst voor software, is het abonnementspagina voor de Gemini-app, of GlobalGPT voor een geïntegreerde workflow met meerdere modellen.



