Gemini 3.1 Pro-tarieven 2026: API-kosten en AI-abonnementen

gemini-3-1-pro-prijzen-hero

Kosten van Gemini 3.1 Pro Preview $2 per miljoen invoertokens en $12 per miljoen uitvoertokens op het standaard Gemini API-niveau voor prompts van maximaal 200.000 tokens. Boven die drempel gelden de tarieven $4 en $18. Bij de facturering van de output worden ook ‘thinking tokens’ meegerekend. Voor de Gemini-app is Google AI Pro een afzonderlijke $19,99 maandelijks abonnement in de Verenigde Staten.

Het bedrag dat je moet begroten, hangt af van waar je het model voor gebruikt. Voor een app-abonnement, een API-project en een werkruimte met meerdere modellen gelden verschillende factureringsregels. Een lang document, een uitgebreide gespreksgeschiedenis of een groot denkbudget kunnen de API-factuur beïnvloeden, zelfs als het aantal verzoeken gelijk blijft.

Voor werk dat zich uitstrekt van onderzoek en schrijven tot programmeren en het maken van media, GlobalGPT brengt Gemini, Claude, GPT en andere modellen samen in één abonnement en één werkruimte. Het is een praktische manier om een bredere AI-workflow te organiseren en de abonnementskosten te beheren zonder voor elke tool een aparte account aan te maken. GlobalGPT publiceert deze gids; de onderstaande prijzen van de aanbieder zijn afkomstig van hun officiële pagina’s.

Wat is Gemini 3.1 Pro? Model en contextvenster

Google heeft op 19 februari 2026 de Gemini 3.1 Pro aangekondigd. Het API-model dat hier wordt behandeld, is gemini-3.1-pro-preview. Het officiële modelspecificatie vermeldt een invoerlimiet van 1.048.576 tokens en een uitvoerlimiet van 65.536 tokens. Het accepteert tekst, afbeeldingen, video, audio en PDF’s, en genereert tekst. Deze invoermogelijkheden maken het geen model voor het genereren van afbeeldingen of video’s.

Voor gebruikers die de Gemini Pro-tokenlimiet, capaciteit en kosten geven antwoord op verschillende vragen: het model kan weliswaar een groot bestand verwerken, maar een prompt van meer dan 200.000 tokens valt in de hogere prijsklasse. Ook de volledige conversatie en herhaald bronmateriaal spelen een rol bij de prompt die je verstuurt.

In zijn aankondiging van de lancering, Google rapporteerde een ARC-AGI-2-score van 77,1%. Dat is een door de leverancier gerapporteerd resultaat op het gebied van redeneren, geen maatstaf voor uw kosten per bruikbaar antwoord. Een waardevollere manier om uw budget te toetsen, is na te gaan of het model uw daadwerkelijke document-, programmeer- of analyseopdracht met minder correcties afrondt. De Gemini 3.1 Pro-codeergids daarin wordt die workflow uitgebreider behandeld.

Gemini 3.1 Pro API-tarieven per miljoen tokens

De Gemini API-prijslijst maakt een onderscheid tussen standaardverzoeken en Batch-, Flex- en Priority-inferenties. Alle tarieven in de onderstaande tabel zijn in Amerikaanse dollars per miljoen tokens. Selecteer de prijsklasse met behulp van de aantal prompt-tokens; pas vervolgens de bijbehorende invoer- en uitvoersnelheden toe.

Gemini 3.1 Pro Preview-tokenprijzen — gecontroleerd op 15 september 2026
ModusPrompt ≤200k: invoer / uitvoerPrompt >200k: invoer / uitvoerAls het past
Standaard$2 / $12$4 / $18Regelmatig interactief gebruik
Batch$1 / $6$2 / $9Asynchroon werken; streeftermijn van 24 uur
Flex$1 / $6$2 / $9Latentietolerant synchroon werk; variabele latentie en beschikbaarheid op basis van ‘best effort’
Prioriteit$3.60 / $21.60$7.20 / $32.40Een apart geprijsd prioriteitsniveau voor inferentie

Batch en Flex halveer de vermelde standaardinvoer- en uitvoersnelheden, waarbij verschillende afwegingen tussen doorlooptijd en beschikbaarheid gelden. Ze zijn handig voor taken zoals het classificeren van een documentverzameling of het opstellen van een rapport dat je niet onmiddellijk nodig hebt. Deze korting op het aantal tokens leidt niet automatisch tot een halvering van de cacheopslag of van alle toolkosten.

De grens van 200k: invoer verdubbelt, uitvoer stijgt met 50%

Een verzoek van precies 200.000 tokens valt nog steeds in de lagere categorie. Boven de 200.000 stijgt het standaard invoertarief van $2 naar $4, terwijl het uitvoertarief stijgt van $12 naar $18. De hogere tarieven zijn van toepassing op het totale aantal tokens van het verzoek; het gaat hier niet om een toeslag die uitsluitend geldt voor de tokens boven de 200.000.

Hoe een lange prompt de tokenfrequentie beïnvloedt
Invoer, prompt ≤200k$2 / 1 miljoen tokens
Invoer, prompt >200k$4 / 1 miljoen tokens
Uitvoer, prompt ≤200k$12 / 1 miljoen tokens
Uitvoer, prompt >200k$18 / 1M-tokens

Bron: Prijzen voor de Google Gemini API. Standaardniveau; gecontroleerd op 15 september 2026. Alle balken zijn gebaseerd op dezelfde schaal in dollars.

Een grotere invoer kan ook de uitvoersnelheid verhogen, zelfs als het antwoord kort is.

Een uitgewerkte maandelijkse API-raming

Stel dat je 100 standaardverzoeken indient, elk met 10.000 invoertokens en 2.000 factureerbare uitvoertokens. De schatting is 100 × [(10.000 ÷ 1.000.000 × $2) + (2.000 ÷ 1.000.000 × $12)] = $4,40. Dit is een indicatieve berekening, geen definitieve factuur; gereedschap, caching, opslag, belastingen en platformkosten zijn hierin niet meegerekend.

Voor één grotere aanvraag met 250.000 invoertokens en 10.000 factureerbare uitvoertokens levert dezelfde methode het volgende resultaat op: $1.18: $1.00 voor de invoer plus $0.18 voor de uitvoer. Hanteer de factureerbare uitvoer, inclusief het denkwerk, in plaats van alleen de woorden te tellen die je in het antwoord kunt zien.

  1. Tel de volledige prompt mee, inclusief de gespreksgeschiedenis en de bronbestanden.
  2. Bepaal de aanvraagmodus en de juiste haakjesgrootte voor de prompt.
  3. Voeg de factureerbare prestaties toe, en vervolgens eventuele kosten voor caching, opslag en hulpmiddelen.
  4. Vergelijk het gebruiksrapport met de schatting voordat je opschaalt.

De officiële tokenhandleiding legt het tellen van tokens uit. Gebruik voor de configuratie en implementatie de Gemini 3.1 Pro API-ontwikkelaarshandleiding.

Hoe contextcaching de rekening beïnvloedt

Contextcaching is handig wanneer hetzelfde document, dezelfde repository of dezelfde systeeminstructies in herhaalde verzoeken voorkomen. Het houdt rekening met de hergebruikte invoer; het maakt het hele verzoek niet gratis. Op het standaardniveau kost gecacheerde invoer $0,20 per miljoen tokens voor prompts tot 200k, of $0,40 boven de 200k. Expliciete cacheopslag voegt $4,50 per miljoen in de cache opgeslagen tokens per uur.

De oorspronkelijke prijstabel voor de Gemini 3.1 Pro geeft de tarieven weer voor invoer, uitvoer, ingelezen gegevens en cacheopslag per uur.
Prijstabel overgenomen uit het oorspronkelijke artikel van februari 2026. De weergegeven tarieven voor tokens en opslag zijn op 15 september 2026 opnieuw gecontroleerd aan de hand van de prijslijst van Google; dit is geen recent gemaakte schermafbeelding.

Google beschrijft twee benaderingen in zijn documentatie over contextcaching: bij impliciete caching worden de besparingen automatisch doorberekend wanneer een verzoek in de cache terechtkomt; bij expliciete caching kun je een opgegeven prefix gedurende een gekozen geldigheidsduur behouden. Als je geen geldigheidsduur instelt, is de standaardduur voor expliciete caching één uur. Tokens in de cache tellen nog steeds mee voor de tokenlimieten, dus caching zorgt er niet voor dat een lange prompt in een lagere prijsklasse terechtkomt.

Dezelfde vijf meetwaarden; verschillende retentietijden — USD, 15 september 2026
Scenario met herhaalde invoerVijf leesbewerkingen van 100.000 tokensOpslagIllustratief totaal
Niet in de cache opgeslagen, standaard onderste haakje$1.00$0$1.00
Expliciete cache wordt 1 uur bewaard$0.10$0.45$0.55
De expliciete cache wordt 24 uur bewaard$0.10$10.80$10.90

Deze schattingen hebben uitsluitend betrekking op de terugkerende invoer- en opslagcomponenten. Nieuwe, niet-gecachete invoer en uitvoer komen daar nog bij. Een cache met een korte levensduur die meerdere keren wordt hergebruikt, kan nuttig zijn; het 's nachts aanhouden van een grote cache voor slechts enkele leesbewerkingen kan meer kosten dan het opnieuw verzenden van die invoer. Stel de bewaartermijn af op de daadwerkelijke werksessie en controleer het aantal cache-hits, in plaats van ervan uit te gaan dat elke herhaalde prompt een korting oplevert.

Het gebruik van tools kan een extra post opleveren. Voor het onderbouwen met Google Search, De prijstabel van Google vermeldt 5.000 gratis “zoekverzoeken” per maand, verdeeld over Gemini 3.x-modellen, en vervolgens $14 per 1.000 zoekverzoeken. Het handleiding voor aarding verduidelijkt dat bij de facturering volgens het Gemini 3-model de zoekopdrachten worden geteld die het model uitvoert, waarbij lege zoekopdrachten niet worden meegeteld bij het tellen van unieke zoekopdrachten. Eén generatieverzoek dat twee afzonderlijke zoekopdrachten activeert, verbruikt daarom twee factureerbare zoekeenheden. Houd bij het opstellen van je budget rekening met het aantal uitgevoerde zoekopdrachten, niet alleen met het aantal gegenereerde antwoorden; de gratis tegoedlimiet is geen garantie voor 5.000 onderbouwde antwoorden.

Google AI Pro en Ultra: maandelijkse abonnementsprijzen in de VS

Als je Gemini in een chatinterface wilt gebruiken, vergelijk dan De abonnementen van Google in de VS in plaats van het aantal chatberichten te vermenigvuldigen met de tarieven per API-token. Op de openbare Amerikaanse pagina staan de volgende maandelijkse opties vermeld. Dit zijn de geadverteerde abonnementsprijzen, geen offerte voor elk land of een totaalbedrag inclusief btw bij het afrekenen.

Google AI-abonnementen voor consumenten — Verenigde Staten, geraadpleegd op 15 september 2026
Amerikaans planAangegeven maandprijsRelevant onderscheid in toegangsrechten
Gratis$0Toegang tot de Gemini-app, inclusief verschillende toegangsniveaus tot 3.1 Pro
Google AI Plus$4.99Meer toegangsrechten dan bij de gratis versie
Google AI Pro$19.99Uitgebreidere toegang tot Gemini, Google-app-functies en 5 TB opslagruimte
Google AI Ultra 5x$99.995x hogere gebruikslimieten dan bij AI Pro op de Amerikaanse abonnementspagina
Google AI Ultra 20x$199.9920 keer hogere gebruikslimieten dan bij AI Pro op de Amerikaanse abonnementspagina
Op de Amerikaanse abonnementspagina van Google worden de maandelijkse prijzen voor de Google AI Pro- en Ultra-abonnementen weergegeven.
In de VS geadverteerde prijzen voor Google AI-abonnementen, vastgelegd op 15 september 2026. Toelatingsvoorwaarden, belastingen en lokale aanbiedingen kunnen verschillen.

De aanduidingen ‘5x’ en ‘20x’ hebben betrekking op de gepubliceerde vergelijking tussen de abonnementen; ze vormen geen garantie voor een vast aantal API-aanroepen. Google AI Pro is het overwegen waard als Gemini deel uitmaakt van je dagelijkse werkzaamheden en je ook gebruikmaakt van de meegeleverde Google-functies en opslagruimte. Voor lichter gebruik kan het gratis abonnement of het Plus-abonnement volstaan. Ultra is zinvol wanneer het intensievere app-gebruik of de extra functies een oplossing bieden voor een beperking waar je daadwerkelijk tegenaan loopt.

Bevat Google AI Pro API-tegoed?

Google AI Pro bevat een $10 maandelijks ontwikkelaarskrediet door de Google Developer-programma. Google’s huidige veelgestelde vragen beschrijft het bijbehorende Pro/Ultra-voordeel als een maandelijks Google Cloud-tegoed. Dit algemene richtlijnen voor cloudtegoed behandelt producten zoals Firebase, Vertex AI en Google Maps, en legt uit hoe je via My Benefits een voordeel kunt toekennen aan één in aanmerking komend factureringsaccount.

Controleer, voordat u het tegoed in uw budget gebruikt, het specifieke voordeel in ‘My Benefits’, de dienst waarop het van toepassing is, de vervaldatum en het beschikbare saldo op uw factureringsaccount. Controleer of het van toepassing is op de Gemini API-dienst en het project dat u van plan bent te gebruiken. Houd tot die tijd bij het plannen rekening met de API-kosten vóór de tegoeden die in deze handleiding worden vermeld. Houd de facturering voor uw Gemini-app-abonnement en uw API-project gescheiden wanneer u uw uitgaven bijhoudt.

De gratis proefperiode voor $300 Google Cloud is een andere, afzonderlijke aanbieding. In de factureringsgids voor API’s van Google wordt het gebruik van de Gemini-API vanaf maart 2026 uitgesloten van die gratis proefperiode. Een Cloud-welkomsttegoed mag daarom niet worden beschouwd als het maandelijkse ontwikkelaarsvoordeel dat bij een Google AI-abonnement hoort.

De instellingen en het gebruik van accountspecifieke facturering worden uitgelegd in Handleiding voor facturering via de Gemini API van Google. Ook de gebruikslimieten voor apps en de API-limieten verschillen; de Handleiding voor de beperkingen van de Gemini 3.1 Pro legt de verschillen uit. Het betalen van een abonnement neemt niet alle beperkingen weg.

Vergelijking van API-kosten: Gemini, GPT en Claude

De meest zinvolle vergelijking begint met hetzelfde tokenbudget. De onderstaande cijfers zijn gebaseerd op standaard, niet-gecachete first-party API-tarieven voor een prompt van 100.000 tokens en 10.000 factureerbare output-tokens. Hierin zijn tools, opslag, belastingen, regionale verwerkingskosten en platformkosten van derden niet meegerekend. Een gelijk aantal tokens betekent niet noodzakelijkerwijs een gelijke hoeveelheid tekst of even succesvolle antwoorden bij verschillende model-tokenizers.

Geselecteerde API-modellen, waaronder Sonnet 5 en eerdere versies van Claude — standaardtarieven, 15 september 2026
Geselecteerd modelIngang / 1MUitgang / 1M100k ingang + 10k uitgang
Gemini 3.1 Pro Voorbeeld$2$12$0.32
GPT-5,5$5$30$0.80
Claude Opus 4.8$5$25$0.75
Claude Sonnet 4.6$3$15$0.45
Claude Sonnet 5$2$10$0.30
Eén symbolisch budget, vijf geraamde kosten
Gemini 3.1 Pro Voorbeeld$0.32
GPT-5,5$0.8
Claude Opus 4.8$0.75
Claude Sonnet 4.6$0.45
Claude Sonnet 5$0.3

Bronnen: Google, OpenAI GPT-5.5, Antropisch. Gecontroleerd op 15 september 2026; berekende voorbeelden, geen gemeten rekeningen.

Sonnet 5 kost $0,30 voor dit tokenbudget, vergeleken met $0,32 voor Gemini. Deze steekproef van vijf modellen is geen marktbreed onderzoek naar de goedkoopste modellen, noch een algemene ranglijst op basis van kwaliteit of rendement op investering.

Anthropic hanteert nu de invoersnelheden $2 en de uitvoersnelheden $10 van Sonnet 5 als standaardprijs; de eerder aangekondigde prijsverhoging in september zal niet plaatsvinden. Sonnet 4.6 en Opus 4.8 blijven nuttige referenties voor bestaande workloads, maar het gaat hierbij om eerdere Claude-versies en niet om het volledige huidige assortiment.

Langere prompts kunnen de omvang van het prijsverschil beïnvloeden. De hoogste prijsklasse van Gemini begint boven de 200.000 prompt-tokens; de gedocumenteerde drempelwaarde voor GPT-5.5 ligt boven de 272.000 invoertokens. Anthropic geeft standaardprijzen weer voor het volledige contextvenster van 1 miljoen voor Claude 4.6 en later. Bij 250.000 invoertokens en 10.000 uitvoertokens is de standaardtokenraming van Gemini $1,18, die van Sonnet 4.6 is $0,90 en die van Sonnet 5 is $0,60. Vergelijk de toepasselijke categorie voor de werklast die u daadwerkelijk gaat verzenden.

Kies op basis van de kosten per voltooide taak: neem daarbij ook mislukte pogingen, herinneringen, denkwerk en handmatige correcties mee. Aan de hand van de tokenprijzen alleen kun je niet bepalen welk model het beste bij jouw werk past. Voor achtergrondinformatie over de prijsstelling van het eerdere model, zie de bestaande vergelijking van Kosten voor Gemini 3 Pro en Gemini 3 API.

Wanneer een abonnement met meerdere modellen binnen uw budget past

Een project met directe API-toegang is geschikt voor een product dat programmeerbare oproepen en facturering op basis van gebruik vereist. Een Google AI-abonnement is geschikt voor gebruikers die Gemini willen en willen profiteren van de voordelen van het Google-ecosysteem. GlobalGPT is geschikt voor werkzaamheden die meerdere modellen en functies omvatten: onderzoek doen naar een onderwerp, een artikel opstellen en bijwerken, hulp vragen bij het programmeren en vervolgens ondersteunende media maken, allemaal binnen één werkruimte. De CLI koppelt bovendien AI-werkzaamheden aan terminal- en ontwikkelingsworkflows.

Kies de factureringswijze die past bij de opdracht die je moet afronden
AankoopHoe maak je een begroting?Kies dit voor
Gemini APIInvoer, uitvoer, serviceniveau, caching en hulpmiddelenSoftware ontwikkelen of telefoongesprekken automatiseren
Google AI-abonnementHet in de VS geadverteerde maandabonnement, inclusief de toelatingsvoorwaarden en beperkingen met betrekking tot de functiesGebruik van Gemini en bijbehorende Google-producten
GlobalGPT abonnementHet gekozen platformplan en de bijbehorende model- en functievergoedingenEen bredere workflow die toonaangevende modellen en mediatools omvat

De meerwaarde van een abonnementsvorm voor meerdere modellen ligt in de breedte van het aanbod en het gebruiksgemak binnen de workflow. Vergelijk de tools die je daadwerkelijk zou gebruiken met de afzonderlijke abonnementen die je anders nodig zou hebben. Kies een abonnement waarvan de limieten aansluiten bij die werklast; een platformabonnement en de API of het consumentenabonnement van een officiële aanbieder zijn verschillende producten.

  • Voornamelijk chat en Google-apps? Kies het Google-abonnement waarvan het gebruiksniveau het beste bij je dagelijkse routine past. De handleiding voor wat gratis toegang tot Gemini inhoudt kan je helpen voordat je de upgrade uitvoert.
  • Een product verzenden? Gebruik een API-budget met logbestanden, schattingen van het verbruik en de juiste factureringsinstellingen voor het project.
  • Onderzoek, schrijven, programmeren en media in één dagelijkse routine? Verken De multi-model-werkruimte van GlobalGPT. Zie voor meer opties Alternatieven voor Gemini en hun sterke punten afstemmen op jouw werk.

Als praktische volgende stap na het kiezen van de toegangsroute, volg je hoe gebruik ik Gemini 3.1 Pro. Houd bij het volgen van de installatie-instructies rekening met het verschil tussen app-abonnementen en API-facturering.

Veelgestelde vragen

Hoeveel kost Gemini 3.1 Pro per miljoen tokens?

Op het standaard Gemini API-niveau kost Gemini 3.1 Pro Preview $2 per miljoen invoertokens en $12 per miljoen uitvoertokens voor prompts van maximaal 200.000 tokens. Boven de 200.000 prompttokens bedragen de tarieven $4 en $18. Bij de facturering van de output worden ook thinking-tokens meegerekend.

Is er een gratis Gemini 3.1 Pro API-abonnement?

Google vermeldt geen gratis API-pakket voor Gemini 3.1 Pro Preview. De Gemini-app biedt een gratis abonnement met beperkte toegang tot 3.1 Pro, en via Google AI Studio kun je modellen uitproberen. Deze toegangsmanieren bieden echter geen gratis API-quota voor productiegebruik van dit model.

Brengt de API kosten in rekening voor afbeeldingen en video’s?

Ja. De Gemini 3.1 Pro ondersteunt afbeeldingen, video, audio en PDF-bestanden als invoer, en het gebruik van tokens hiervoor telt mee voor de factuur. Het aantal tokens hangt af van het type media en de verwerkingsinstellingen. Het apparaat genereert tekst; voor het genereren van afbeeldingen of video’s worden modellen gebruikt waarvoor aparte tarieven gelden.

Valt een aantal van precies 200.000 input-tokens in de hogere prijsklasse?

Nee. Een opdracht van precies 200.000 tokens valt binnen de lagere standaardprijsklasse. Voor een opdracht van meer dan 200.000 tokens gelden de hogere invoer- en uitvoertarieven. Tokens in de cache tellen nog steeds mee voor de geldende tokenlimieten.

Is het $19.99 Google AI Pro-abonnement hetzelfde als API-facturering?

Nee. Het maandabonnement US $19.99 is een consumentenabonnement met een maandelijks ontwikkelaarskrediet van $10. De algemene richtlijnen van Google voor Cloud-krediet hebben betrekking op producten zoals Vertex AI en leggen uit hoe je een krediet toewijst aan één in aanmerking komend factureringsaccount. Controleer uw specifieke tegoed in ‘Mijn voordelen’, de in aanmerking komende dienst, de vervaldatum en het beschikbare saldo voordat u het toepast op uw Gemini API-budget. Totdat deze gegevens zijn bevestigd, dient u rekening te houden met API-kosten vóór het in mindering brengen van tegoeden.

Wat is de goedkoopste manier om Gemini 3.1 Pro te gebruiken?

Als je de app slechts af en toe gebruikt, kun je het beste beginnen met de toegang die het gratis abonnement biedt. Voor betaald API-gebruik kun je het aantal tokens inschatten en de opties ‘Batch’ of ‘Flex’ overwegen als de bijbehorende afwegingen qua timing bij je passen. Voor een breder, routinematig gebruik van verschillende modellen en mediatools kun je een abonnement voor meerdere modellen vergelijken met de afzonderlijke abonnementen die je anders zou gebruiken.

Stel je budget af op je daadwerkelijke route en werkvolume: Google’s API-prijslijst voor software, is het abonnementspagina voor de Gemini-app, of GlobalGPT voor een geïntegreerde workflow met meerdere modellen.

Deel de post:

Verwante berichten