Tính chi phí API Google Gemini cho Gemini 3.1 Pro, 3 Flash, 2.5 Pro, 2.5 Flash, 2.5 Flash-Lite và 2.0 Flash. Nhập token để nhận giá ngay lập tức. Trình ước tính chi phí Gemini miễn phí.
Đang tải máy tính...
Công cụ này có hữu ích với bạn không?
Máy Tính Chi Phí Gemini là gì?
Máy Tính Chi Phí Gemini giúp nhà phát triển ước tính chi phí API cho gia đình mô hình Gemini của Google. Với 6 mô hình trải dài từ Flash-Lite siêu hiệu quả đến tier Pro premium, Gemini cung cấp một số giá cạnh tranh nhất trên thị trường AI. Ước tính chi phí chính xác cho ứng dụng khối lượng cao, khối lượng công việc doanh nghiệp và mọi thứ ở giữa.
Khi Nào Nên Sử Dụng Máy Tính Này
Lập ngân sách chi phí API hàng tháng trước khi mở rộng ứng dụng chạy bằng Gemini lên sản xuất
So sánh hiệu quả chi phí giữa Pro, Flash và Flash-Lite cho các loại khối lượng công việc khác nhau
Đánh giá liệu Gemini có rẻ hơn OpenAI hoặc Anthropic cho trường hợp sử dụng cụ thể của bạn không
Ước tính chi phí cho pipeline phân loại khối lượng cao sử dụng Flash-Lite hoặc 2.0 Flash
Lập kế hoạch chi phí xử lý tài liệu ngữ cảnh dài khi làm việc với cửa sổ 2M token của Gemini
Xây dựng bảng điều khiển chi phí và cần điểm giá mỗi yêu cầu cho mỗi mô hình Gemini
Các bước:
Chọn một mô hình Gemini (3.1 Pro, 3 Flash, 2.5 Pro, 2.5 Flash, 2.5 Flash-Lite hoặc 2.0 Flash).
Nhập số lượng token đầu vào.
Nhập số lượng token đầu ra.
Xem ước tính chi phí ngay lập tức.
So sánh trên toàn bộ dòng mô hình của Google để tối ưu chi tiêu.
Lập ngân sách sử dụng API Google AI ở bất kỳ quy mô nào
Tối ưu chi phí với tier Flash và Flash-Lite
So sánh giá Gemini vs OpenAI vs Anthropic
Ước tính chi phí cho ứng dụng AI khối lượng cao
Lập kế hoạch khối lượng công việc ngữ cảnh dài với cửa sổ 2M token của Gemini
Lợi Ích Chính
Ước tính chi phí Google AI ngay lập tức trên tất cả 6 mô hình
So sánh tier giá Pro, Flash và Flash-Lite
Tier miễn phí có sẵn để kiểm tra và tạo nguyên mẫu
Không cần đăng ký cho máy tính
Mẹo Chuyên Nghiệp
Sử dụng Flash-Lite hoặc 2.0 Flash cho tất cả xử lý đơn giản khối lượng cao
Sử dụng 3 Flash cho khối lượng công việc sản xuất nhạy cảm độ trễ
Dự trữ 3.1 Pro cho phân tích và lập luận phức tạp
Tận dụng giảm giá sử dụng cam kết của Google Cloud để tiết kiệm
Sử dụng tier miễn phí của Gemini cho phát triển và kiểm tra
Những Lỗi Thường Gặp Cần Tránh
Sử dụng mô hình Pro cho tác vụ phân loại đơn giản mà Flash có thể xử lý
Bỏ qua Flash-Lite cho khối lượng công việc ultra-cao
Không tính đến giá ngữ cảnh dài trên 200K token
Quên credit Google Cloud và giảm giá sử dụng cam kết
Các Thuật Ngữ Chính Được Giải Thích
Gemini 3.1 Pro: Mô hình lập luận premium mới nhất của Google
Gemini 3 Flash: Mô hình tối ưu tốc độ mới nhất
Gemini 2.5 Flash-Lite: Mô hình hiệu quả chi phí nhất
Tier miễn phí: Truy cập API miễn phí với giới hạn tốc độ
Cửa sổ ngữ cảnh: Token tối đa hỗ trợ mỗi yêu cầu (lên đến 2M)
Khái niệm liên quan
[object Object]
[object Object]
[object Object]
[object Object]
[object Object]
Ví Dụ
Sử dụng Gemini 2.5 Flash với 5.000 token đầu vào và 1.000 đầu ra: (5000/1000 × $0.0003) + (1000/1000 × $0.0025) = $0.0015 + $0.0025 = $0.004 mỗi yêu cầu. Cho 1M yêu cầu hàng ngày: $4.000/ngày.
Giải thích kết quả của bạn
Máy tính hiển thị hai thành phần chi phí: chi phí đầu vào (dựa trên token prompt của bạn) và chi phí đầu ra (dựa trên token được tạo). Token đầu ra luôn đắt hơn token đầu vào, vì vậy giữ prompt ngắn gọn và sử dụng hướng dẫn hệ thống để giới hạn độ dài phản hồi là những cách thực tế để giảm chi phí.
Khi so sánh mô hình, tập trung vào độ phức tạp tác vụ thay vì chỉ giá. Flash-Lite ở $0.0001/$0.0004 rẻ hơn 20 lần so với 3.1 Pro ở $0.002/$0.012, nhưng Pro xử lý lập luận tinh vi tốt hơn nhiều. Đối với khối lượng công việc sản xuất, phương pháp phân tầng — Flash-Lite cho tác vụ đơn giản, Flash cho trung bình, Pro cho phức tạp — thường mang lại tỷ lệ chi phí-chất lượng tốt nhất.
Trường tổng chi phí mở rộng ước tính mỗi yêu cầu của bạn sang khối lượng dự kiến, giúp bạn dự báo chi tiêu hàng ngày và hàng tháng. Đối với khối lượng công việc cam kết, hãy xem xét giảm giá sử dụng cam kết của Google Cloud có thể giảm chi phí 20-40%.
Câu Hỏi Thường Gặp
Sự khác biệt giữa mô hình Gemini Pro và Flash là gì?
Gemini 3.1 Pro ($0.002/$0.012) và 2.5 Pro ($0.00125/$0.01) dành cho tác vụ lập luận phức tạp. Mô hình Flash (3 Flash ở $0.0005/$0.003, 2.5 Flash ở $0.0003/$0.0025) được tối ưu cho tốc độ. Flash-Lite ($0.0001/$0.0004) và 2.0 Flash ($0.0001/$0.0004) là các tier rẻ nhất.
Google có cung cấp tier miễn phí không?
Có, Google cung cấp tier miễn phí với giới hạn tốc độ cho API Gemini. Điều này cho phép nhà phát triển kiểm tra và tạo nguyên mẫu mà không phát sinh chi phí. Tier miễn phí có sẵn cho tất cả mô hình với hạn ngạch hàng ngày.
Gemini so sánh với GPT và Claude như thế nào?
Gemini 2.5 Flash-Lite và 2.0 Flash là mô hình rẻ nhất trong tất cả nhà cung cấp ở $0.0001/$0.0004. Gemini 3 Flash ($0.0005/$0.003) cạnh tranh với GPT-5.4 Nano. Gemini 3.1 Pro ($0.002/$0.012) nằm giữa GPT-5.4 và Claude Sonnet 4.6.
Mô hình Gemini hỗ trợ cửa sổ ngữ cảnh nào?
Gemini 2.5 Pro và Flash hỗ trợ cửa sổ ngữ cảnh lên đến 1M token. Gemini 3.1 Pro và 3 Flash hỗ trợ lên đến 2M token — cửa sổ ngữ cảnh lớn nhất của bất kỳ nhà cung cấp AI lớn nào.
Làm thế nào để tính chi phí mỗi yêu cầu so với chi phí mỗi ngày?
Nhập số lượng token yêu cầu trung bình của bạn để nhận chi phí mỗi yêu cầu đơn. Nhân với khối lượng yêu cầu hàng ngày để nhận chi phí hàng ngày. Máy tính hiển thị cả chi phí mỗi yêu cầu và chi phí đã mở rộng để bạn có thể lập kế hoạch ở bất kỳ khối lượng nào.
Cấu trúc giá token cho Gemini là gì?
Gemini sử dụng giá mỗi 1K token, với tỷ lệ riêng cho token đầu vào và đầu ra. Token đầu ra đắt hơn token đầu vào trên tất cả mô hình. Giá nhất quán trên các khu vực nơi API khả dụng.
Tôi có nên sử dụng Flash-Lite cho tất cả tác vụ của mình không?
Flash-Lite và 2.0 Flash lý tưởng cho tác vụ khối lượng cao, độ phức tạp thấp như phân loại, tóm tắt và trích xuất dữ liệu. Dự trữ mô hình Pro cho tác vụ yêu cầu lập luận sâu, phân tích nhiều bước hoặc tuân theo hướng dẫn phức tạp.
Có giảm giá khối lượng cho API Gemini không?
Google Cloud cung cấp giảm giá sử dụng cam kết cho khối lượng công việc có thể dự đoán. Liên hệ bộ phận bán hàng Google Cloud để biết giá doanh nghiệp. Đối với hầu hết nhà phát triển, chọn tier mô hình phù hợp (Flash-Lite cho khối lượng lớn, Pro cho phức tạp) là tối ưu chi phí hiệu quả nhất.
Giá ngữ cảnh dài hoạt động như thế nào?
Đối với đầu vào vượt quá 200K token, một số mô hình Gemini tính phí mỗi token cao hơn. Sử dụng máy tính này với số lượng token thực tế của bạn để nhận ước tính chính xác cho khối lượng công việc xử lý tài liệu dài.
Tôi có thể ước tính chi phí đa phương thức (hình ảnh/video) không?
Máy tính này tập trung vào giá token văn bản. Đầu vào hình ảnh và video được chuyển đổi thành token tương đương bởi API. Đối với khối lượng công việc đa phương thức, ước tính token văn bản và thêm bộ đệm 20-30% cho chi phí token hình ảnh.
Mô hình Gemini nào tốt nhất cho chatbot?
Đối với chatbot hội thoại, Gemini 3 Flash cung cấp cân bằng tốt nhất giữa tốc độ và chất lượng ở $0.0005/$0.003. Đối với hỗ trợ khách hàng phức tạp yêu cầu lập luận sâu, 3.1 Pro đáng giá premium. Flash-Lite hoạt động cho bot kiểu FAQ đơn giản.