Kira kos API Google Gemini untuk Gemini 3.1 Pro, 3 Flash, 2.5 Pro, 2.5 Flash, 2.5 Flash-Lite dan 2.0 Flash. Masukkan token untuk harga serta-merta. Penganggar kos Gemini percuma.
Memuatkan kalkulator...
Adakah kalkulator ini membantu anda?
Apakah Kalkulator Kos Gemini?
Kalkulator Kos Gemini membantu pembangun menganggar kos API untuk keluarga model Gemini Google. Dengan 6 model merangkumi dari Flash-Lite ultra-cekap hingga tier Pro premium, Gemini menawarkan sesetengah harga paling kompetitif dalam pasaran AI. Anggarkan kos dengan tepat untuk aplikasi volum tinggi, beban kerja perusahaan dan segala-galanya di antaranya.
Bila Menggunakan Kalkulator Ini
Mengbelanjakan kos API bulanan sebelum menskalakan aplikasi berkuasa Gemini ke produksi
Membandingkan kecekapan kos antara Pro, Flash dan Flash-Lite untuk jenis beban kerja berbeza
Menilai sama ada Gemini lebih murah daripada OpenAI atau Anthropic untuk kes penggunaan khusus anda
Menganggar kos untuk paip pengelasan volum tinggi menggunakan Flash-Lite atau 2.0 Flash
Merancang kos pemprosesan dokumen konteks panjang apabila bekerja dengan tingkap 2M token Gemini
Membina papan pemuka kos dan memerlukan titik harga per permintaan untuk setiap model Gemini
Langkah:
Pilih model Gemini (3.1 Pro, 3 Flash, 2.5 Pro, 2.5 Flash, 2.5 Flash-Lite atau 2.0 Flash).
Masukkan kiraan token input.
Masukkan kiraan token output.
Lihat anggaran kos serta-merta.
Bandingkan merentasi barisan model Google untuk mengoptimumkan perbelanjaan.
Mengbelanjakan penggunaan API Google AI pada mana-mana skala
Mengoptimumkan kos dengan tier Flash dan Flash-Lite
Membandingkan harga Gemini vs OpenAI vs Anthropic
Anggaran kos untuk aplikasi AI volum tinggi
Merancang beban kerja konteks panjang dengan tingkap 2M token Gemini
Faedah Utama
Anggar kos Google AI serta-merta merentasi semua 6 model
Bandingkan tier harga Pro, Flash dan Flash-Lite
Tier percuma tersedia untuk pengujian dan prototaip
Tiada pendaftaran diperlukan untuk kalkulator
Tips Pro
Gunakan Flash-Lite atau 2.0 Flash untuk semua pemprosesan mudah volum tinggi
Gunakan 3 Flash untuk beban kerja produksi sensitif kependaman
Simpan 3.1 Pro untuk analisis dan penaakulan kompleks
Manfaatkan diskaun penggunaan komited Google Cloud untuk penjimatan
Gunakan tier percuma Gemini untuk pembangunan dan pengujian
Kesilapan Biasa
Menggunakan model Pro untuk tugas pengelasan mudah yang Flash boleh kendalikan
Mengabaikan Flash-Lite untuk beban kerja volum ultra-tinggi
Tidak mengambil kira harga konteks panjang melebihi 200K token
Melupakan kredit Google Cloud dan diskaun penggunaan komited
Istilah Utama
Gemini 3.1 Pro: Model penaakulan premium terkini Google
Gemini 3 Flash: Model dioptimumkan kelajuan terkini
Gemini 2.5 Flash-Lite: Model paling cekap kos
Tier percuma: Akses API tanpa kos dengan had kadar
Tingkap konteks: Token maksimum disokong per permintaan (sehingga 2M)
Konsep Berkaitan
[object Object]
[object Object]
[object Object]
[object Object]
[object Object]
Contoh
Menggunakan Gemini 2.5 Flash dengan 5,000 token input dan 1,000 token output: (5000/1000 × $0.0003) + (1000/1000 × $0.0025) = $0.0015 + $0.0025 = $0.004 per permintaan. Untuk 1M permintaan harian: $4,000/hari.
Mentafsir Hasil
Kalkulator menunjukkan dua komponen kos: kos input (berdasarkan token prompt anda) dan kos output (berdasarkan token yang dijana). Token output sentiasa kos lebih daripada token input, jadi mengekalkan prompt ringkas dan menggunakan arahan sistem untuk mengehadkan panjang respons adalah cara praktikal untuk mengurangkan kos.
Apabila membandingkan model, tumpukan pada kerumitan tugas dan bukannya hanya harga. Flash-Lite pada $0.0001/$0.0004 adalah 20x lebih murah daripada 3.1 Pro pada $0.002/$0.012, tetapi Pro mengendalikan penaakulan bernuansa jauh lebih baik. Untuk beban kerja produksi, pendekatan bertingkat — Flash-Lite untuk tugas mudah, Flash untuk sederhana, Pro untuk kompleks — biasanya menghasilkan nisbah kos-ke-kualiti terbaik.
Medan jumlah kos menskalakan anggaran per permintaan anda ke volum yang dijangkakan, membantu anda meramalkan perbelanjaan harian dan bulanan. Untuk beban kerja komited, pertimbangkan diskaun penggunaan komited Google Cloud yang boleh mengurangkan kos sebanyak 20-40%.
Soalan Lazim
Apakah perbezaan antara model Gemini Pro dan Flash?
Gemini 3.1 Pro ($0.002/$0.012) dan 2.5 Pro ($0.00125/$0.01) adalah untuk tugas penaakulan kompleks. Model Flash (3 Flash pada $0.0005/$0.003, 2.5 Flash pada $0.0003/$0.0025) dioptimumkan untuk kelajuan. Flash-Lite ($0.0001/$0.0004) dan 2.0 Flash ($0.0001/$0.0004) adalah tier paling murah.
Adakah Google menawarkan tier percuma?
Ya, Google menyediakan tier percuma dengan had kadar untuk API Gemini. Ini membolehkan pembangun menguji dan membuat prototaip tanpa menanggung kos. Tier percuma tersedia untuk semua model dengan kuota harian.
Bagaimana Gemini berbanding dengan GPT dan Claude?
Gemini 2.5 Flash-Lite dan 2.0 Flash adalah model termurah di semua penyedia pada $0.0001/$0.0004. Gemini 3 Flash ($0.0005/$0.003) adalah kompetitif dengan GPT-5.4 Nano. Gemini 3.1 Pro ($0.002/$0.012) berada di antara GPT-5.4 dan Claude Sonnet 4.6.
Tingkap konteks apa yang disokong oleh model Gemini?
Gemini 2.5 Pro dan Flash menyokong tingkap konteks sehingga 1M token. Gemini 3.1 Pro dan 3 Flash menyokong sehingga 2M token — tingkap konteks terbesar mana-mana penyedia AI utama.
Bagaimana saya mengira kos per permintaan vs kos per hari?
Masukkan kiraan token permintaan purata anda untuk mendapatkan kos per permintaan tunggal. Darab dengan volum permintaan harian untuk mendapatkan kos harian. Kalkulator menunjukkan kedua-dua kos per permintaan dan kos berskala supaya anda boleh merancang pada mana-mana volum.
Apakah struktur harga token untuk Gemini?
Gemini menggunakan harga per 1K token, dengan kadar berasingan untuk token input dan output. Token output kos lebih daripada token input merentasi semua model. Harga adalah konsisten merentasi wilayah di mana API tersedia.
Haruskah saya menggunakan Flash-Lite untuk semua tugas saya?
Flash-Lite dan 2.0 Flash adalah ideal untuk tugas volum tinggi, kerumitan rendah seperti pengelasan, ringkasan dan pengekstrakan data. Simpan model Pro untuk tugas yang memerlukan penaakulan mendalam, analisis berbilang langkah atau pematuhan arahan kompleks.
Adakah terdapat diskaun volum untuk API Gemini?
Google Cloud menawarkan diskaun penggunaan komited untuk beban kerja yang boleh diramal. Hubungi jualan Google Cloud untuk harga perusahaan. Untuk kebanyakan pembangun, memilih tier model yang betul (Flash-Lite untuk pukal, Pro untuk kompleks) adalah pengoptimuman kos paling berkesan.
Bagaimanakah harga konteks panjang berfungsi?
Untuk input melebihi 200K token, sesetengah model Gemini mengenakan kadar per token yang lebih tinggi. Gunakan kalkulator ini dengan kiraan token sebenar anda untuk mendapatkan anggaran tepat untuk beban kerja pemprosesan dokumen panjang.
Kalkulator ini memberi tumpuan kepada harga token teks. Input imej dan video ditukar kepada setara token oleh API. Untuk beban kerja multimodal, anggarkan token teks dan tambah penimbal 20-30% untuk overhed token imej.
Apakah model Gemini terbaik untuk chatbot?
Untuk chatbot perbualan, Gemini 3 Flash menawarkan keseimbangan terbaik antara kelajuan dan kualiti pada $0.0005/$0.003. Untuk sokongan pelanggan kompleks yang memerlukan penaakulan mendalam, 3.1 Pro berbaloi dengan premium. Flash-Lite berfungsi untuk bot gaya FAQ mudah.