Bereken de Google Gemini API-kosten voor Gemini 3.1 Pro, 3 Flash, 2.5 Pro, 2.5 Flash, 2.5 Flash-Lite en 2.0 Flash. Voer tokens in voor directe prijsbepaling. Gratis Gemini kostenraming.
Rekenmachine laden...
Heeft deze tool u geholpen?
Wat is Gemini Kosten Calculator?
Een Gemini Kosten Calculator helpt ontwikkelaars API-kosten te schatten voor Google's Gemini-modellenfamilie. Met 6 modellen variërend van ultra-efficiënte Flash-Lite tot premium Pro-tiers, biedt Gemini enkele van de meest concurrerende prijzen op de AI-markt. Schat kosten nauwkeurig voor hoogvolume applicaties, enterprise-workloads en alles daartussenin.
Wanneer gebruik je deze rekenmachine
Maandelijkse API-kosten budgetteren voordat je een Gemini-aangedreven applicatie naar productie schaalt
Kostenefficiëntie vergelijken tussen Pro, Flash en Flash-Lite voor verschillende workloadtypen
Evalueren of Gemini goedkoper is dan OpenAI of Anthropic voor jouw specifieke use case
Kosten schatten voor een hoogvolume classificatiepijplijn met Flash-Lite of 2.0 Flash
Lange-context documentverwerkingskosten plannen bij het werken met Gemini's 2M-tokenvenster
Een kostendashboard bouwen en per-aanvraag prijspunten nodig hebben voor elk Gemini-model
Stappen:
Selecteer een Gemini-model (3.1 Pro, 3 Flash, 2.5 Pro, 2.5 Flash, 2.5 Flash-Lite of 2.0 Flash).
Voer het aantal invoertokens in.
Voer het aantal uitvoertokens in.
Bekijk de directe kostenschatting.
Vergelijk over Google's modellenaanbod om uitgaven te optimaliseren.
Gemini 3 Flash: Nieuwste snelheid-geoptimaliseerd model
Gemini 2.5 Flash-Lite: Meest kostenefficiënte model
Gratis tier: Gratis API-toegang met snelheidslimieten
Contextvenster: Maximale tokens ondersteund per aanvraag (tot 2M)
Gerelateerde concepten
[object Object]
[object Object]
[object Object]
[object Object]
[object Object]
Voorbeeld
Gebruik van Gemini 2.5 Flash met 5.000 invoer- en 1.000 uitvoertokens: (5000/1000 × $0.0003) + (1000/1000 × $0.0025) = $0.0015 + $0.0025 = $0.004 per aanvraag. Voor 1M dagelijkse aanvragen: $4.000/dag.
Resultaten interpreteren
De calculator toont twee kostencomponenten: invoerkosten (gebaseerd op je prompttokens) en uitvoerkosten (gebaseerd op gegenereerde tokens). Uitvoertokens kosten altijd meer dan invoertokens, dus prompts beknopt houden en systeeminstructies gebruiken om responslengte te beperken zijn praktische manieren om kosten te verlagen.
Bij het vergelijken van modellen, focus op taakcomplexiteit in plaats van alleen prijs. Flash-Lite op $0.0001/$0.0004 is 20x goedkoper dan 3.1 Pro op $0.002/$0.012, maar Pro handelt genuanceerd redeneren veel beter af. Voor productie-workloads, een gelaagde aanpak — Flash-Lite voor eenvoudige taken, Flash voor moderate, Pro voor complexe — levert doorgaans de beste kosten-tot-kwaliteitverhouding op.
Het totale kostenveld schaalt je per-aanvraagschatting naar je verwachte volume, helpt je dagelijkse en maandelijkse uitgaven te prognosticeren. Voor vastgelegde workloads, overweeg Google Cloud's kortingen voor vastgelegd gebruik die kosten met 20-40% kunnen verlagen.
Veelgestelde Vragen
Wat is het verschil tussen Gemini Pro- en Flash-modellen?
Gemini 3.1 Pro ($0.002/$0.012) en 2.5 Pro ($0.00125/$0.01) zijn voor complexe redeneertaken. Flash-modellen (3 Flash op $0.0005/$0.003, 2.5 Flash op $0.0003/$0.0025) zijn geoptimaliseerd voor snelheid. Flash-Lite ($0.0001/$0.0004) en 2.0 Flash ($0.0001/$0.0004) zijn de goedkoopste tiers.
Biedt Google een gratis tier aan?
Ja, Google biedt een gratis tier met snelheidslimieten voor de Gemini API. Dit stelt ontwikkelaars in staat om te testen en prototypen zonder kosten te maken. De gratis tier is beschikbaar voor alle modellen met dagelijkse quota.
Hoe vergelijkt Gemini met GPT en Claude?
Gemini 2.5 Flash-Lite en 2.0 Flash zijn de goedkoopste modellen van alle providers op $0.0001/$0.0004. Gemini 3 Flash ($0.0005/$0.003) is concurrerend met GPT-5.4 Nano. Gemini 3.1 Pro ($0.002/$0.012) zit tussen GPT-5.4 en Claude Sonnet 4.6 in.
Gemini 2.5 Pro en Flash ondersteunen contextvensters tot 1M tokens. Gemini 3.1 Pro en 3 Flash ondersteunen tot 2M tokens — de grootste contextvensters van elke grote AI-provider.
Hoe bereken ik kosten per aanvraag vs kosten per dag?
Voer je gemiddelde aanvraagtellaantallen in om de kosten per enkele aanvraag te krijgen. Vermenigvuldig met het dagelijkse aanvraagvolume om de dagelijkse kosten te krijgen. De calculator toont zowel kosten per aanvraag als geschaalde kosten zodat je op elk volume kunt plannen.
Wat is de tokenprijsstructuur voor Gemini?
Gemini gebruikt per 1K token prijsstelling, met aparte tarieven voor invoer- en uitvoertokens. Uitvoertokens kosten meer dan invoertokens over alle modellen. Prijzen zijn consistent over regio's waar de API beschikbaar is.
Moet ik Flash-Lite gebruiken voor al mijn taken?
Flash-Lite en 2.0 Flash zijn ideaal voor hoogvolume, laagcomplexiteitstaken zoals classificatie, samenvatting en data-extractie. Reserveer Pro-modellen voor taken die diep redeneren, multi-step analyse of complexe instructie-opvolging vereisen.
Zijn er volumekortingen voor de Gemini API?
Google Cloud biedt kortingen voor vastgelegd gebruik voor voorspelbare workloads. Neem contact op met Google Cloud-verkoop voor enterprise-prijzen. Voor de meeste ontwikkelaars is het kiezen van de juiste modeltier (Flash-Lite voor bulk, Pro voor complex) de meest effectieve kostenoptimalisatie.
Hoe werkt lange-context prijsstelling?
Voor invoer die 200K tokens overschrijdt, laden sommige Gemini-modellen een hogere per-token tarief. Gebruik deze calculator met je werkelijke tokenaantallen om nauwkeurige schattingen te krijgen voor lange documentverwerkingsworkloads.
Kan ik multimodale (afbeelding/video) kosten schatten?
Deze calculator richt zich op teksttokenprijsstelling. Afbeeldings- en video-invoer worden door de API omgezet in token-equivalenten. Voor multimodale workloads, schat de teksttokens en voeg een buffer van 20-30% toe voor afbeeldingstokenoverhead.
Wat is het beste Gemini-model voor chatbots?
Voor conversationele chatbots biedt Gemini 3 Flash de beste balans tussen snelheid en kwaliteit op $0.0005/$0.003. Voor complexe klantensupport die diep redeneren vereist, is 3.1 Pro de premium waard. Flash-Lite werkt voor eenvoudige FAQ-stijl bots.