Hitung biaya API Google Gemini untuk Gemini 3.1 Pro, 3 Flash, 2.5 Pro, 2.5 Flash, 2.5 Flash-Lite, dan 2.0 Flash. Masukkan token untuk harga instan. Estimator biaya Gemini gratis.
Memuat kalkulator...
Apakah kalkulator ini membantu Anda?
Apa itu Kalkulator Biaya Gemini?
Kalkulator Biaya Gemini membantu pengembang memperkirakan biaya API untuk keluarga model Gemini Google. Dengan 6 model mulai dari Flash-Lite ultra-efisien hingga tier Pro premium, Gemini menawarkan beberapa harga paling kompetitif di pasar AI. Perkirakan biaya secara akurat untuk aplikasi volume tinggi, beban kerja perusahaan, dan segala sesuatu di antaranya.
Kapan Menggunakan Kalkulator Ini
Menganggarkan biaya API bulanan sebelum menskalakan aplikasi bertenaga Gemini ke produksi
Membandingkan efisiensi biaya antara Pro, Flash, dan Flash-Lite untuk berbagai jenis beban kerja
Mengevaluasi apakah Gemini lebih murah daripada OpenAI atau Anthropic untuk kasus penggunaan spesifik Anda
Memperkirakan biaya untuk pipeline klasifikasi volume tinggi menggunakan Flash-Lite atau 2.0 Flash
Merencanakan biaya pemrosesan dokumen konteks panjang saat bekerja dengan jendela 2M token Gemini
Membangun dasbor biaya dan memerlukan titik harga per permintaan untuk setiap model Gemini
Langkah-langkah:
Pilih model Gemini (3.1 Pro, 3 Flash, 2.5 Pro, 2.5 Flash, 2.5 Flash-Lite, atau 2.0 Flash).
Masukkan jumlah token input.
Masukkan jumlah token output.
Lihat estimasi biaya instan.
Bandingkan di seluruh jajaran model Google untuk mengoptimalkan pengeluaran.
Menganggarkan penggunaan API Google AI pada skala apa pun
Mengoptimalkan biaya dengan tier Flash dan Flash-Lite
Membandingkan harga Gemini vs OpenAI vs Anthropic
Estimasi biaya untuk aplikasi AI volume tinggi
Merencanakan beban kerja konteks panjang dengan jendela 2M token Gemini
Manfaat Utama
Perkirakan biaya Google AI secara instan di semua 6 model
Bandingkan tier harga Pro, Flash, dan Flash-Lite
Tier gratis tersedia untuk pengujian dan prototipe
Tidak perlu pendaftaran untuk kalkulator
Tips Profesional
Gunakan Flash-Lite atau 2.0 Flash untuk semua pemrosesan sederhana volume tinggi
Gunakan 3 Flash untuk beban kerja produksi sensitif latensi
Cadangkan 3.1 Pro untuk analisis dan penalaran kompleks
Manfaatkan diskon penggunaan berkomitmen Google Cloud untuk penghematan
Gunakan tier gratis Gemini untuk pengembangan dan pengujian
Kesalahan Umum yang Harus Dihindari
Menggunakan model Pro untuk tugas klasifikasi sederhana yang bisa ditangani Flash
Mengabaikan Flash-Lite untuk beban kerja volume ultra-tinggi
Tidak memperhitungkan harga konteks panjang di atas 200K token
Melupakan kredit Google Cloud dan diskon penggunaan berkomitmen
Istilah Kunci Dijelaskan
Gemini 3.1 Pro: Model penalaran premium terbaru Google
Gemini 3 Flash: Model terbaru yang dioptimalkan untuk kecepatan
Gemini 2.5 Flash-Lite: Model paling efisien biaya
Tier gratis: Akses API tanpa biaya dengan batas laju
Jendela konteks: Token maksimum yang didukung per permintaan (hingga 2M)
Konsep Terkait
[object Object]
[object Object]
[object Object]
[object Object]
[object Object]
Contoh
Menggunakan Gemini 2.5 Flash dengan 5.000 token input dan 1.000 token output: (5000/1000 × $0.0003) + (1000/1000 × $0.0025) = $0.0015 + $0.0025 = $0.004 per permintaan. Untuk 1M permintaan harian: $4.000/hari.
Interpretasi Hasil Anda
Kalkulator menampilkan dua komponen biaya: biaya input (berdasarkan token prompt Anda) dan biaya output (berdasarkan token yang dihasilkan). Token output selalu lebih mahal daripada token input, jadi menjaga prompt tetap ringkas dan menggunakan instruksi sistem untuk membatasi panjang respons adalah cara praktis untuk mengurangi biaya.
Saat membandingkan model, fokus pada kompleksitas tugas daripada hanya harga. Flash-Lite di $0.0001/$0.0004 adalah 20x lebih murah daripada 3.1 Pro di $0.002/$0.012, tetapi Pro menangani penalaran bernuansa jauh lebih baik. Untuk beban kerja produksi, pendekatan bertingkat — Flash-Lite untuk tugas sederhana, Flash untuk moderat, Pro untuk kompleks — biasanya menghasilkan rasio biaya-kualitas terbaik.
Bidang total biaya menskalakan estimasi per permintaan Anda ke volume yang diharapkan, membantu Anda memperkirakan pengeluaran harian dan bulanan. Untuk beban kerja berkomitmen, pertimbangkan diskon penggunaan berkomitmen Google Cloud yang dapat mengurangi biaya 20-40%.
Pertanyaan Umum
Apa perbedaan antara model Gemini Pro dan Flash?
Gemini 3.1 Pro ($0.002/$0.012) dan 2.5 Pro ($0.00125/$0.01) untuk tugas penalaran kompleks. Model Flash (3 Flash di $0.0005/$0.003, 2.5 Flash di $0.0003/$0.0025) dioptimalkan untuk kecepatan. Flash-Lite ($0.0001/$0.0004) dan 2.0 Flash ($0.0001/$0.0004) adalah tier termurah.
Apakah Google menawarkan tier gratis?
Ya, Google menyediakan tier gratis dengan batas laju untuk API Gemini. Ini memungkinkan pengembang menguji dan membuat prototipe tanpa mengeluarkan biaya. Tier gratis tersedia untuk semua model dengan kuota harian.
Bagaimana Gemini dibandingkan dengan GPT dan Claude?
Gemini 2.5 Flash-Lite dan 2.0 Flash adalah model termurah di semua penyedia di $0.0001/$0.0004. Gemini 3 Flash ($0.0005/$0.003) kompetitif dengan GPT-5.4 Nano. Gemini 3.1 Pro ($0.002/$0.012) berada di antara GPT-5.4 dan Claude Sonnet 4.6.
Jendela konteks apa yang didukung model Gemini?
Gemini 2.5 Pro dan Flash mendukung jendela konteks hingga 1M token. Gemini 3.1 Pro dan 3 Flash mendukung hingga 2M token — jendela konteks terbesar dari penyedia AI utama mana pun.
Bagaimana menghitung biaya per permintaan vs biaya per hari?
Masukkan jumlah token permintaan rata-rata Anda untuk mendapatkan biaya per permintaan tunggal. Kalikan dengan volume permintaan harian untuk mendapatkan biaya harian. Kalkulator menampilkan biaya per permintaan dan biaya skala sehingga Anda dapat merencanakan pada volume berapa pun.
Bagaimana struktur harga token untuk Gemini?
Gemini menggunakan harga per 1K token, dengan tarif terpisah untuk token input dan output. Token output lebih mahal daripada token input di semua model. Harga konsisten di seluruh wilayah di mana API tersedia.
Haruskah saya menggunakan Flash-Lite untuk semua tugas saya?
Flash-Lite dan 2.0 Flash ideal untuk tugas volume tinggi, kompleksitas rendah seperti klasifikasi, ringkasan, dan ekstraksi data. Cadangkan model Pro untuk tugas yang memerlukan penalaran mendalam, analisis multi-langkah, atau pengikutan instruksi kompleks.
Apakah ada diskon volume untuk API Gemini?
Google Cloud menawarkan diskon penggunaan berkomitmen untuk beban kerja yang dapat diprediksi. Hubungi penjualan Google Cloud untuk harga perusahaan. Untuk sebagian besar pengembang, memilih tier model yang tepat (Flash-Lite untuk volume, Pro untuk kompleks) adalah optimasi biaya paling efektif.
Bagaimana cara kerja harga konteks panjang?
Untuk input yang melebihi 200K token, beberapa model Gemini mengenakan tarif per token yang lebih tinggi. Gunakan kalkulator ini dengan jumlah token aktual Anda untuk mendapatkan estimasi akurat untuk beban kerja pemrosesan dokumen panjang.
Kalkulator ini berfokus pada harga token teks. Input gambar dan video dikonversi ke ekuivalen token oleh API. Untuk beban kerja multimodal, perkirakan token teks dan tambahkan buffer 20-30% untuk overhead token gambar.
Apa model Gemini terbaik untuk chatbot?
Untuk chatbot percakapan, Gemini 3 Flash menawarkan keseimbangan terbaik antara kecepatan dan kualitas di $0.0005/$0.003. Untuk dukungan pelanggan kompleks yang memerlukan penalaran mendalam, 3.1 Pro sepadan dengan premiumnya. Flash-Lite berfungsi untuk bot gaya FAQ sederhana.