Gemini 3.1 Pro, 3 Flash, 2.5 Pro, 2.5 Flash, 2.5 Flash-Lite और 2.0 Flash के लिए Google Gemini API लागत की गणना करें। तत्काल मूल्य निर्धारण के लिए टोकन दर्ज करें। मुफ्त Gemini लागत अनुमानक।
कैलकुलेटर लोड हो रहा है...
क्या इस कैलकुलेटर ने आपकी मदद की?
Gemini लागत कैलकुलेटर क्या है?
एक Gemini लागत कैलकुलेटर डेवलपर्स को Google के Gemini मॉडल परिवार के लिए API लागत का अनुमान लगाने में मदद करता है। अति-कुशल Flash-Lite से प्रीमियम Pro स्तर तक 6 मॉडलों के साथ, Gemini AI बाजार में सबसे प्रतिस्पर्धी मूल्य निर्धारण में से कुछ प्रदान करता है। उच्च-वॉल्यूम अनुप्रयोगों, एंटरप्राइज वर्कलोड और बीच में सब कुछ के लिए लागत का सटीक अनुमान लगाएं।
इस कैलकुलेटर का उपयोग कब करें
Gemini-संचालित अनुप्रयोग को प्रोडक्शन में स्केल करने से पहले मासिक API लागत का बजट
विभिन्न वर्कलोड प्रकारों के लिए Pro, Flash, और Flash-Lite के बीच लागत दक्षता तुलना
आपके विशिष्ट उपयोग मामले के लिए Gemini, OpenAI या Anthropic से सस्ता है या नहीं का मूल्यांकन
Flash-Lite या 2.0 Flash का उपयोग करके उच्च-वॉल्यूम वर्गीकरण पाइपलाइन के लिए लागत अनुमान
Gemini की 2M टोकन विंडो के साथ काम करते समय लॉन्ग-कॉन्टेक्स्ट दस्तावेज़ प्रसंस्करण लागत की योजना
लागत डैशबोर्ड बनाना और प्रत्येक Gemini मॉडल के लिए प्रति-अनुरोध मूल्य बिंदुओं की आवश्यकता
चरण:
एक Gemini मॉडल चुनें (3.1 Pro, 3 Flash, 2.5 Pro, 2.5 Flash, 2.5 Flash-Lite, या 2.0 Flash)।
इनपुट टोकन गणना दर्ज करें।
आउटपुट टोकन गणना दर्ज करें।
तत्काल लागत अनुमान देखें।
खर्च अनुकूलित करने के लिए Google के मॉडल लाइनअप में तुलना करें।
Gemini बनाम OpenAI बनाम Anthropic मूल्य निर्धारण तुलना
उच्च-वॉल्यूम AI अनुप्रयोगों के लिए लागत अनुमान
Gemini की 2M टोकन विंडो के साथ लॉन्ग-कॉन्टेक्स्ट वर्कलोड योजना
मुख्य लाभ
सभी 6 मॉडलों में Google AI लागत तुरंत अनुमान
Pro, Flash, और Flash-Lite मूल्य निर्धारण स्तर तुलना
परीक्षण और प्रोटोटाइपिंग के लिए निःशुल्क स्तर उपलब्ध
कैलकुलेटर के लिए साइन-अप की आवश्यकता नहीं
प्रो टिप्स
सभी उच्च-वॉल्यूम सरल प्रसंस्करण के लिए Flash-Lite या 2.0 Flash का उपयोग करें
विलंबता-संवेदी प्रोडक्शन वर्कलोड के लिए 3 Flash का उपयोग करें
जटिल विश्लेषण और तर्क के लिए 3.1 Pro आरक्षित करें
बचत के लिए Google Cloud प्रतिबद्ध उपयोग डिस्काउंट का लाभ उठाएं
विकास और परीक्षण के लिए Gemini के निःशुल्क स्तर का उपयोग करें
सामान्य गलतियाँ जिनसे बचना चाहिए
Flash जो संभाल सकता है ऐसे सरल वर्गीकरण कार्यों के लिए Pro मॉडल का उपयोग
अति-उच्च-वॉल्यूम वर्कलोड के लिए Flash-Lite को नजरअंदाज करना
200K टोकन से ऊपर लॉन्ग-कॉन्टेक्स्ट मूल्य निर्धारण का हिसाब न लगाना
Google Cloud क्रेडिट और प्रतिबद्ध उपयोग डिस्काउंट भूल जाना
मुख्य शर्तें समझाई गईं
Gemini 3.1 Pro: Google का नवीनतम प्रीमियम तर्क मॉडल
Gemini 3 Flash: नवीनतम गति-अनुकूलित मॉडल
Gemini 2.5 Flash-Lite: सबसे लागत-कुशल मॉडल
निःशुल्क स्तर: दर सीमाओं के साथ निःशुल्क API पहुंच
संदर्भ विंडो: प्रति अनुरोध समर्थित अधिकतम टोकन (2M तक)
संबंधित अवधारणाएँ
[object Object]
[object Object]
[object Object]
[object Object]
[object Object]
उदाहरण
5,000 इनपुट और 1,000 आउटपुट टोकन के साथ Gemini 2.5 Flash का उपयोग: (5000/1000 × $0.0003) + (1000/1000 × $0.0025) = $0.0015 + $0.0025 = $0.004 प्रति अनुरोध। 1M दैनिक अनुरोधों के लिए: $4,000/दिन।
आपके परिणामों की व्याख्या
कैलकुलेटर दो लागत घटक दिखाता है: इनपुट लागत (आपके प्रॉम्प्ट टोकन पर आधारित) और आउटपुट लागत (उत्पन्न टोकन पर आधारित)। आउटपुट टोकन हमेशा इनपुट टोकन से अधिक खर्च करते हैं, इसलिए प्रॉम्प्ट संक्षिप्त रखना और प्रतिक्रिया लंबाई को सीमित करने के लिए सिस्टम निर्देशों का उपयोग करना लागत कम करने के व्यावहारिक तरीके हैं।
मॉडलों की तुलना करते समय, केवल मूल्य के बजाय कार्य जटिलता पर ध्यान केंद्रित करें। $0.0001/$0.0004 पर Flash-Lite $0.002/$0.012 पर 3.1 Pro से 20x सस्ता है, लेकिन Pro सूक्ष्म तर्क को बहुत बेहतर तरीके से संभालता है। प्रोडक्शन वर्कलोड के लिए, एक स्तरित दृष्टिकोण — सरल कार्यों के लिए Flash-Lite, मध्यम के लिए Flash, जटिल के लिए Pro — आमतौर पर सबसे अच्छा लागत-से-गुणवत्ता अनुपात देता है।
कुल लागत फ़ील्ड आपके प्रति-अनुरोध अनुमान को आपके अपेक्षित वॉल्यूम में स्केल करता है, दैनिक और मासिक खर्च का पूर्वानुमान लगाने में मदद करता है। प्रतिबद्ध वर्कलोड के लिए, Google Cloud के प्रतिबद्ध उपयोग डिस्काउंट पर विचार करें जो लागत को 20-40% कम कर सकते हैं।
अक्सर पूछे जाने वाले प्रश्न
Gemini Pro और Flash मॉडल के बीच क्या अंतर है?
Gemini 3.1 Pro ($0.002/$0.012) और 2.5 Pro ($0.00125/$0.01) जटिल तर्क कार्यों के लिए हैं। Flash मॉडल (3 Flash $0.0005/$0.003 पर, 2.5 Flash $0.0003/$0.0025 पर) गति के लिए अनुकूलित हैं। Flash-Lite ($0.0001/$0.0004) और 2.0 Flash ($0.0001/$0.0004) सबसे सस्ते स्तर हैं।
क्या Google निःशुल्क स्तर प्रदान करता है?
हाँ, Google Gemini API के लिए दर सीमाओं के साथ एक निःशुल्क स्तर प्रदान करता है। यह डेवलपर्स को लागत incurred किए बिना परीक्षण और प्रोटोटाइप करने की अनुमति देता है। निःशुल्क स्तर दैनिक कोटा के साथ सभी मॉडलों के लिए उपलब्ध है।
Gemini की तुलना GPT और Claude से कैसे होती है?
Gemini 2.5 Flash-Lite और 2.0 Flash सभी प्रदाताओं में $0.0001/$0.0004 पर सबसे सस्ते मॉडल हैं। Gemini 3 Flash ($0.0005/$0.003) GPT-5.4 Nano के साथ प्रतिस्पर्धी है। Gemini 3.1 Pro ($0.002/$0.012) GPT-5.4 और Claude Sonnet 4.6 के बीच बैठता है।
Gemini मॉडल कौन से संदर्भ विंडो समर्थन करते हैं?
Gemini 2.5 Pro और Flash 1M टोकन संदर्भ विंडो तक समर्थन करते हैं। Gemini 3.1 Pro और 3 Flash 2M टोकन तक समर्थन करते हैं — किसी भी प्रमुख AI प्रदाता की सबसे बड़ी संदर्भ विंडो।
प्रति अनुरोध लागत बनाम प्रति दिन लागत कैसे गणना करें?
एकल अनुरोध की लागत प्राप्त करने के लिए अपने औसत अनुरोध टोकन गणना दर्ज करें। दैनिक लागत प्राप्त करने के लिए दैनिक अनुरोध वॉल्यूम से गुणा करें। कैलकुलेटर प्रति-अनुरोध और स्केल्ड दोनों लागत दिखाता है ताकि आप किसी भी वॉल्यूम पर योजना बना सकें।
Gemini के लिए टोकन मूल्य निर्धारण संरचना क्या है?
Gemini प्रति-1K टोकन मूल्य निर्धारण का उपयोग करता है, इनपुट और आउटपुट टोकन के लिए अलग-अलग दरों के साथ। आउटपुट टोकन सभी मॉडलों में इनपुट टोकन से अधिक खर्च करते हैं। मूल्य निर्धारण उन क्षेत्रों में सुसंगत है जहां API उपलब्ध है।
क्या मुझे अपने सभी कार्यों के लिए Flash-Lite का उपयोग करना चाहिए?
Flash-Lite और 2.0 Flash वर्गीकरण, सारांश और डेटा निष्कर्षण जैसे उच्च-वॉल्यूम, निम्न-जटिलता कार्यों के लिए आदर्श हैं। गहन तर्क, बहु-चरणीय विश्लेषण या जटिल निर्देश पालन की आवश्यकता वाले कार्यों के लिए Pro मॉडल आरक्षित करें।
क्या Gemini API के लिए वॉल्यूम डिस्काउंट हैं?
Google Cloud पूर्वानुमानित वर्कलोड के लिए प्रतिबद्ध उपयोग डिस्काउंट प्रदान करता है। एंटरप्राइज मूल्य निर्धारण के लिए Google Cloud सेल्स से संपर्क करें। अधिकांश डेवलपर्स के लिए, सही मॉडल स्तर चुनना (बल्क के लिए Flash-Lite, जटिल के लिए Pro) सबसे प्रभावी लागत अनुकूलन है।
लॉन्ग-कॉन्टेक्स्ट मूल्य निर्धारण कैसे काम करता है?
200K टोकन से अधिक इनपुट के लिए, कुछ Gemini मॉडल उच्च प्रति-टोकन दर चार्ज करते हैं। लॉन्ग-डॉक्यूमेंट प्रोसेसिंग वर्कलोड के लिए सटीक अनुमान प्राप्त करने के लिए अपनी वास्तविक टोकन गणना के साथ इस कैलकुलेटर का उपयोग करें।
क्या मैं मल्टीमोडल (इमेज/वीडियो) लागत का अनुमान लगा सकता हूं?
यह कैलकुलेटर पाठ टोकन मूल्य निर्धारण पर केंद्रित है। इमेज और वीडियो इनपुट API द्वारा टोकन समतुल्य में परिवर्तित किए जाते हैं। मल्टीमोडल वर्कलोड के लिए, पाठ टोकन का अनुमान लगाएं और इमेज टोकन ओवरहेड के लिए 20-30% बफर जोड़ें।
चैटबॉट के लिए सबसे अच्छा Gemini मॉडल कौन सा है?
संवादी चैटबॉट के लिए, Gemini 3 Flash $0.0005/$0.003 पर गति और गुणवत्ता का सबसे अच्छा संतुलन प्रदान करता है। गहन तर्क की आवश्यकता वाले जटिल ग्राहक सहायता के लिए, 3.1 Pro प्रीमियम के योग्य है। Flash-Lite सरल FAQ-शैली बॉट के लिए काम करता है।