- Get link
- X
- Other Apps
| Model Tier | Input (per 1M tokens) | Output (per 1M tokens) | Context Window / Notes |
|---|---|---|---|
| Gemini 3.1 Pro | 2.00 (\le$ 200k) / $4.00 (> 200k) | 12.00 (\le$ 200k) / $18.00 (> 200k) | Frontier reasoning tier; over-200k context surcharge applies. |
| Gemini 3.8 / 3.7 / 3.6 Flash | $0.75 (Introductory) / $1.50 (Standard) | $3.75 (Introductory) / $7.50 (Standard) | High-speed workhorse model tier. Introductory rates run through Dec 31, 2026. |
| Gemini 3.5 Flash | $1.50 | $9.00 | Previous-generation mainstream Flash tier. |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | Cost-optimized model tier for lighter workloads. |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | Lowest-cost standard entry tier. |
Additional Pricing Tiers & Discounts
- Batch / Flex Tiers: Asynchronous or flexible queue processing offers a 50% discount (0.5x multiplier) on standard input and output token rates.
- Context Caching: Stored tokens reduce input costs significantly (e.g., down to $0.075–$0.20 per 1M tokens depending on the model) alongside a nominal hourly storage fee (approx. $0.50 to $4.50 per 1M tokens/hour).
- Google Search Grounding: Includes a shared free quota (5,000 requests/month on Gemini 3.x models), followed by $14.00 per 1,000 queries thereafter.
Matriks Harga & Biaya Pengembang Google Gemini API
| Kategori Model | Input (per 1 Juta Token) | Output (per 1 Juta Token) | Jendela Konteks / Catatan |
|---|---|---|---|
| Gemini 3.1 Pro | 2.00 (\le$ 200k) / $4.00 (> 200k) | 12.00 (\le$ 200k) / $18.00 (> 200k) | Tingkat penalaran frontier; biaya tambahan berlaku untuk konteks di atas 200k. |
| Gemini 3.8 / 3.7 / 3.6 Flash | $0.75 (Perkenalan) / $1.50 (Standar) | $3.75 (Perkenalan) / $7.50 (Standar) | Tingkat model pekerja andal berkecepatan tinggi. Tarif perkenalan berlaku hingga 31 Desember 2026. |
| Gemini 3.5 Flash | $1.50 | $9.00 | Tingkat Flash utama generasi sebelumnya. |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | Tingkat model yang dioptimalkan untuk beban kerja ringan. |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | Tingkat entri standar dengan biaya terendah. |
Tingkat Harga & Diskon Tambahan
- Tingkat Batch / Flex: Pemrosesan antrean asinkron atau fleksibel menawarkan diskon 50% (pengali 0,5x) dari tarif token input dan output standar.
- Penyimpanan Konteks (Context Caching): Token yang disimpan mengurangi biaya input secara signifikan (misalnya, turun menjadi $0,075–$0,20 per 1 juta token tergantung pada modelnya) beserta biaya penyimpanan per jam nominal (sekitar $0,50 hingga $4,50 per 1 juta token/jam).
- Grounding Google Search: Mencakup kuota gratis bersama (5.000 permintaan/bulan pada model Gemini 3.x), diikuti oleh $14.00 per 1.000 kueri setelahnya.
Matriks Harga & Biaya Pengembang Google Gemini API (Estimasi Kurs: Rp 17.630 / USD)
| Kategori Model | Input (per 1 Juta Token) | Output (per 1 Juta Token) | Jendela Konteks / Catatan |
|---|---|---|---|
| Gemini 3.1 Pro | Rp 35.260 (\le 200k) / Rp 70.520 (> 200k) | Rp 211.560 (\le 200k) / Rp 317.340 (> 200k) | Tingkat penalaran frontier; biaya tambahan berlaku untuk konteks di atas 200k. |
| Gemini 3.8 / 3.7 / 3.6 Flash | Rp 13.225 (Perkenalan) / Rp 26.445 (Standar) | Rp 66.115 (Perkenalan) / Rp 132.225 (Standar) | Tingkat model pekerja andal berkecepatan tinggi. Tarif perkenalan berlaku hingga 31 Desember 2026. |
| Gemini 3.5 Flash | Rp 26.445 | Rp 158.670 | Tingkat Flash utama generasi sebelumnya. |
| Gemini 3.5 Flash-Lite | Rp 5.290 | Rp 44.075 | Tingkat model yang dioptimalkan untuk beban kerja ringan. |
| Gemini 2.5 Flash-Lite | Rp 1.765 | Rp 7.050 | Tingkat entri standar dengan biaya terendah. |
Tingkat Harga & Diskon Tambahan
- Tingkat Batch / Flex: Pemrosesan antrean asinkron atau fleksibel menawarkan diskon 50% (pengali 0,5x) dari tarif token input dan output standar.
- Penyimpanan Konteks (Context Caching): Token yang disimpan mengurangi biaya input secara signifikan (misalnya, turun menjadi sekitar Rp 1.320–Rp 3.525 per 1 juta token tergantung pada modelnya) beserta biaya penyimpanan per jam nominal (sekitar Rp 8.815 hingga Rp 79.335 per 1 juta token/jam).
- Grounding Google Search: Mencakup kuota gratis bersama (5.000 permintaan/bulan pada model Gemini 3.x), diikuti oleh Rp 246.820 per 1.000 kueri setelahnya.
Comments