Harga Gemini 3.1 Pro 2026: Biaya API dan Paket AI

gemini-3-1-pro-harga-hero

Biaya Gemini 3.1 Pro Preview $2 per juta token masukan dan $12 per juta token keluaran pada tingkatan API standar Gemini untuk prompt hingga 200.000 token. Di atas ambang batas tersebut, tarifnya adalah $4 dan $18. Penagihan output mencakup token pemikiran. Untuk aplikasi Gemini, Google AI Pro merupakan layanan terpisah Langganan bulanan $19.99 di Amerika Serikat.

Biaya yang perlu Anda anggarkan bergantung pada di mana Anda menggunakan model tersebut. Langganan aplikasi, proyek API, dan ruang kerja multi-model memiliki aturan penagihan yang berbeda-beda. Dokumen yang panjang, riwayat percakapan yang berulang, atau anggaran pemrosesan yang besar dapat memengaruhi tagihan API, meskipun jumlah permintaan tetap sama.

Untuk pekerjaan yang mencakup berbagai aspek, mulai dari penelitian dan penulisan hingga pemrograman dan pembuatan konten media, GlobalGPT Menggabungkan Gemini, Claude, GPT, dan model lainnya ke dalam satu langganan dan satu ruang kerja. Ini merupakan cara praktis untuk mengatur alur kerja AI yang lebih luas dan mengelola pengeluaran langganan tanpa perlu membuka akun terpisah untuk setiap alat. Panduan ini diterbitkan oleh GlobalGPT; harga dari penyedia yang tercantum di bawah ini diambil dari halaman resmi mereka.

Apa itu Gemini 3.1 Pro? Jendela model dan konteks

Google mengumumkan Gemini 3.1 Pro pada tanggal 19 Februari 2026. Model API yang dibahas di sini adalah gemini-3.1-pro-preview. Hal itu spesifikasi model resmi Menetapkan batas masukan sebesar 1.048.576 token dan batas keluaran sebesar 65.536 token. Model ini menerima teks, gambar, video, audio, dan berkas PDF, serta menghasilkan teks. Kemampuan masukan tersebut tidak menjadikan model ini sebagai model pembuat gambar atau video.

Bagi pengguna yang membandingkan Batas token Gemini Pro, kapasitas dan biaya menjawab pertanyaan yang berbeda: model tersebut mungkin dapat memproses file berukuran besar, tetapi prompt yang melebihi 200 ribu token akan masuk ke kisaran harga yang lebih tinggi. Percakapan lengkap dan materi sumber yang diulang juga memengaruhi prompt yang Anda kirimkan.

Dalam pengumuman peluncuran, Google melaporkan skor ARC-AGI-2 sebesar 77,1%. Angka tersebut merupakan hasil penalaran yang dilaporkan oleh penyedia layanan, bukan ukuran biaya per jawaban yang bermanfaat bagi Anda. Penilaian anggaran yang lebih bermakna adalah apakah model tersebut dapat menyelesaikan tugas dokumen, pemrograman, atau analisis Anda yang sebenarnya dengan jumlah koreksi yang lebih sedikit. The Panduan Pemrograman Gemini 3.1 Pro menjelaskan alur kerja tersebut secara lebih rinci.

Harga API Gemini 3.1 Pro per juta token

The Daftar Harga API Gemini memisahkan permintaan standar dari inferensi Batch, Flex, dan Priority. Semua tarif dalam tabel berikut dinyatakan dalam dolar AS per satu juta token. Pilih rentang harga menggunakan jumlah token prompt; kemudian terapkan laju masukan dan keluaran yang sesuai.

Tarif token Gemini 3.1 Pro Preview — diperiksa pada 15 September 2026
ModePrompt ≤200 ribu: masukan / keluaranPrompt >200k: masukan / keluaranJika cocok
Standar$2 / $12$4 / $18Penggunaan interaktif secara rutin
Batch$1 / $6$2 / $9Pekerjaan asinkron; target waktu penyelesaian 24 jam
Flex$1 / $6$2 / $9Pekerjaan sinkron yang toleran terhadap latensi; latensi variabel dan ketersediaan berdasarkan upaya terbaik
Prioritas$3.60 / $21.60$7.20 / $32.40Tingkat inferensi prioritas dengan harga terpisah

Batch dan Flex Kurangi setengah dari laju input dan output standar yang tercantum, dengan kompromi yang berbeda antara waktu dan ketersediaan. Opsi ini berguna untuk tugas-tugas seperti mengklasifikasikan kumpulan dokumen atau menyiapkan laporan yang tidak Anda perlukan segera. Diskon token ini tidak secara otomatis mengurangi setengah kapasitas penyimpanan cache atau biaya setiap alat.

Batas 200 ribu: input dua kali lipat, output naik sebesar 50%

Sebuah prompt dengan jumlah token tepat 200.000 tetap berada di kelompok tarif bawah. Di atas 200.000, tarif input standar naik dari $2 menjadi $4, sedangkan tarif output naik dari $12 menjadi $18. Tingkat yang lebih tinggi berlaku untuk jumlah token yang relevan dalam permintaan; ini bukan biaya tambahan yang hanya dikenakan pada token di atas 200 ribu.

Bagaimana prompt yang panjang memengaruhi laju token
Input, prompt ≤200 ribu$2 / 1 juta token
Input, prompt >200 ribu$4 / 1 juta token
Output, prompt ≤200 ribu$12 / 1 juta token
Hasil, prompt >200 ribu$18 / 1 juta token

Sumber: Harga API Google Gemini. Tingkat standar; diperiksa pada 15 September 2026. Semua batang menggunakan skala dolar yang sama.

Input yang lebih besar juga dapat meningkatkan laju keluaran, meskipun jawabannya singkat.

Perkiraan API bulanan yang telah dihitung

Misalkan Anda melakukan 100 permintaan standar, masing-masing dengan 10.000 token masukan dan 2.000 token keluaran yang dikenakan biaya. Perkiraannya adalah 100 × [(10.000 ÷ 1.000.000 × $2) + (2.000 ÷ 1.000.000 × $12)] = $4,40. Ini hanyalah perhitungan ilustratif, bukan tagihan yang sebenarnya; perhitungan ini belum termasuk biaya alat, penyimpanan sementara, penyimpanan, pajak, dan biaya platform.

Untuk satu permintaan yang lebih besar dengan 250.000 token masukan dan 10.000 token keluaran yang dikenakan biaya, metode yang sama menghasilkan $1.18: $1.00 untuk masukan ditambah $0.18 untuk keluaran. Gunakan keluaran yang dapat ditagih, termasuk proses berpikir, alih-alih hanya menghitung kata-kata yang terlihat dalam jawaban.

  1. Hitung seluruh teks prompt, termasuk riwayat percakapan dan berkas sumber.
  2. Tentukan mode permintaan dan kurung ukuran prompt yang tepat.
  3. Tambahkan hasil kerja yang dapat ditagih, lalu biaya-biaya terkait penyimpanan sementara, penyimpanan, dan penggunaan alat.
  4. Bandingkan laporan penggunaan dengan perkiraan sebelum meningkatkan kapasitas.

The panduan resmi tentang token menjelaskan cara menghitung token. Untuk pengaturan dan penerapan, gunakan Panduan Pengembang API Gemini 3.1 Pro.

Bagaimana penyimpanan dalam cache berdasarkan konteks memengaruhi tagihan

Penyimpanan dalam cache berdasarkan konteks berguna ketika dokumen, repositori, atau instruksi sistem yang sama muncul dalam permintaan berulang. Fitur ini mengabaikan input yang digunakan kembali; namun, hal ini tidak membuat seluruh permintaan menjadi gratis. Pada tingkatan standar, biaya input yang disimpan dalam cache adalah $0,20 per juta token untuk prompt hingga 200 ribu, atau $0,40 untuk prompt di atas 200 ribu. Penyimpanan cache eksplisit menambah $4,50 per juta token yang disimpan dalam cache per jam.

Tabel harga asli Gemini 3.1 Pro mencantumkan tarif untuk input, output, input yang disimpan dalam cache, dan penyimpanan cache per jam.
Tabel harga ini diambil dari artikel asli bulan Februari 2026. Tarif token dan penyimpanan yang ditampilkan telah diverifikasi kembali berdasarkan daftar harga Google pada tanggal 15 September 2026; ini bukanlah gambar yang baru diambil.

Google menjelaskan dua pendekatan dalam dokumentasi penyimpanan dalam cache berdasarkan konteks: Caching implisit secara otomatis meneruskan penghematan saat sebuah permintaan menemukan data di cache; sedangkan caching eksplisit memungkinkan Anda mempertahankan prefiks tertentu selama masa berlaku yang dipilih. Jika Anda tidak menetapkan durasi, caching eksplisit secara default berlaku selama satu jam. Token yang disimpan di cache tetap dihitung dalam batas kuota token, sehingga caching tidak akan memindahkan prompt yang panjang ke kisaran harga yang lebih rendah.

Lima pembacaan input yang sama; waktu retensi yang berbeda — USD, 15 September 2026
Skenario masukan berulangLima kali pembacaan masing-masing 100 ribu tokenPenyimpananJumlah ilustratif
Tidak disimpan dalam cache, tanda kurung bawah standar$1.00$0$1.00
Cache eksplisit disimpan selama 1 jam$0.10$0.45$0.55
Cache eksplisit disimpan selama 24 jam$0.10$10.80$10.90

Perkiraan ini hanya membandingkan komponen input dan penyimpanan yang berulang. Input dan output baru yang belum disimpan dalam cache merupakan beban tambahan. Cache berumur pendek yang digunakan kembali beberapa kali bisa bermanfaat; mempertahankan cache berukuran besar semalaman hanya untuk beberapa kali pembacaan bisa lebih mahal daripada mengirimkan input-input tersebut lagi. Atur retensi sesuai dengan durasi sesi kerja yang sebenarnya dan periksa tingkat keberhasilan cache (cache-hit) alih-alih mengasumsikan bahwa setiap prompt yang diulang akan mendapat diskon.

Penggunaan alat dapat menambah satu item baris lagi. Untuk landasan Pencarian Google, Tabel harga Google menyediakan 5.000 “permintaan pencarian” gratis per bulan, yang dibagi di antara model Gemini 3.x, kemudian $14 per 1.000 permintaan pencarian. Layanan ini panduan pengardean menjelaskan bahwa sistem penagihan Gemini 3 menghitung kueri pencarian yang dijalankan oleh model, dengan kueri kosong dikecualikan saat menghitung kueri unik. Oleh karena itu, satu permintaan generasi yang memicu dua pencarian berbeda akan menggunakan dua unit pencarian yang dapat ditagih. Sesuaikan anggaran Anda berdasarkan jumlah pencarian yang dilakukan, bukan hanya jawaban yang dihasilkan; kuota gratis bukanlah jaminan akan 5.000 jawaban yang berlandaskan data.

Google AI Pro dan Ultra: Harga langganan bulanan di AS

Jika Anda ingin menggunakan Gemini dalam antarmuka obrolan, bandingkan Paket langganan Google di AS daripada mengalikan jumlah pesan obrolan dengan tarif token API. Halaman publik AS mencantumkan opsi-opsi bulanan berikut ini. Harga-harga ini merupakan harga langganan yang diiklankan, bukan penawaran harga untuk setiap negara atau total pembayaran yang sudah termasuk pajak.

Paket layanan AI Google untuk konsumen — Amerika Serikat, diperiksa pada 15 September 2026
Rencana ASHarga bulanan yang diiklankanPerbedaan akses yang relevan
Gratis$0Akses ke aplikasi Gemini, termasuk akses yang bervariasi ke 3.1 Pro
Google AI Plus$4.99Akses dengan kuota yang lebih besar daripada versi Gratis
Google AI Pro$19.99Akses Gemini yang lebih luas, fitur aplikasi Google, dan penyimpanan 5 TB
Google AI Ultra 5x$99.99Batas penggunaan 5 kali lebih tinggi daripada AI Pro di halaman paket AS
Google AI Ultra 20x$199.99Batas penggunaan 20 kali lebih tinggi daripada AI Pro di halaman paket AS
Halaman langganan Google di AS menampilkan harga bulanan untuk paket Google AI Pro dan Ultra.
Harga langganan Google AI yang diiklankan di AS, diambil pada 15 September 2026. Syarat kelayakan, pajak, dan penawaran lokal dapat berbeda-beda.

Label 5x dan 20x menggambarkan perbandingan paket yang dipublikasikan; label tersebut bukanlah jaminan jumlah panggilan API yang tetap. Google AI Pro layak dipertimbangkan jika Gemini merupakan bagian dari pekerjaan harian Anda dan Anda juga menggunakan fitur-fitur Google serta penyimpanan yang disertakan. Paket Gratis atau Plus mungkin sudah cukup untuk penggunaan yang lebih ringan. Paket Ultra cocok dipilih jika penggunaan aplikasi yang lebih intensif atau fitur tambahan yang ditawarkannya dapat mengatasi batasan yang benar-benar Anda hadapi.

Apakah Google AI Pro sudah termasuk kredit API?

Google AI Pro dilengkapi dengan sebuah Kredit pengembang bulanan $10 melalui Program Pengembang Google. Google’s Pertanyaan yang Sering Diajukan (FAQ) saat ini menjelaskan bahwa manfaat Pro/Ultra yang terkait berupa kredit Google Cloud bulanan. Hal ini panduan umum mengenai kredit Cloud mencakup produk-produk seperti Firebase, Vertex AI, dan Google Maps, serta menjelaskan cara mengklaim manfaat untuk satu akun penagihan yang memenuhi syarat melalui My Benefits.

Sebelum menggunakan kredit dalam anggaran Anda, periksa manfaat spesifiknya di My Benefits, layanan yang dicakupnya, tanggal kedaluwarsanya, serta saldo yang tersedia di akun penagihan Anda. Pastikan bahwa kredit tersebut berlaku untuk layanan API Gemini dan proyek yang ingin Anda gunakan. Sampai saat itu, rencanakan pengeluaran untuk biaya API sebelum menggunakan kredit yang tercantum dalam panduan ini. Pisahkan langganan aplikasi Gemini dan penagihan proyek API saat melacak pengeluaran.

Uji coba gratis Google Cloud $300 merupakan penawaran terpisah. Panduan penagihan API Google mengecualikan penggunaan API Gemini dari uji coba gratis tersebut yang dimulai pada Maret 2026. Oleh karena itu, saldo selamat datang Cloud tidak boleh dianggap sebagai manfaat bulanan bagi pengembang yang melekat pada paket Google AI.

Pengaturan penagihan khusus akun dan penggunaannya dijelaskan dalam Panduan Penagihan API Gemini dari Google. Batas penggunaan aplikasi dan batas frekuensi API juga berbeda; Panduan Batasan Gemini 3.1 Pro menjelaskan perbedaannya. Membayar langganan tidak menghapus semua batasan.

Perbandingan biaya API: Gemini, GPT, dan Claude

Perbandingan yang paling berguna dimulai dengan anggaran token yang sama. Angka-angka di bawah ini menggunakan tarif API pihak pertama standar (tanpa cache) untuk prompt sebanyak 100.000 token dan 10.000 token keluaran yang dikenakan biaya. Angka-angka tersebut tidak mencakup biaya alat, penyimpanan, pajak, premi pemrosesan regional, dan biaya platform pihak ketiga. Jumlah token yang sama tidak selalu berarti teks yang sama atau jawaban yang sama suksesnya di antara berbagai tokenizer model.

Model API tertentu, termasuk Sonnet 5 dan versi Claude sebelumnya — tarif standar, 15 September 2026
Model yang dipilihMasukan / 1MKeluaran / 1M100 ribu input + 10 ribu output
Pratinjau Gemini 3.1 Pro$2$12$0.32
GPT-5.5$5$30$0.80
Claude Opus 4.8$5$25$0.75
Claude Soneta 4.6$3$15$0.45
Claude Soneta 5$2$10$0.30
Satu anggaran token, lima perkiraan biaya
Pratinjau Gemini 3.1 Pro$0.32
GPT-5.5$0.8
Claude Opus 4.8$0.75
Claude Soneta 4.6$0.45
Claude Soneta 5$0.3

Sumber: Google, OpenAI GPT-5.5, Antropik. Diperiksa pada 15 September 2026; contoh perhitungan, bukan tagihan yang sebenarnya.

Biaya Sonnet 5 sebesar $0,30 untuk anggaran token ini, dibandingkan dengan $0,32 untuk Gemini. Sampel yang terdiri dari lima model ini bukanlah survei model termurah di seluruh pasar, maupun peringkat kualitas atau laba atas investasi secara keseluruhan.

Anthropic kini mencantumkan laju input $2 dan laju output $10 dari Sonnet 5 sebagai harga standarnya; kenaikan harga yang sebelumnya diumumkan untuk bulan September tidak akan diberlakukan. Sonnet 4.6 dan Opus 4.8 tetap menjadi referensi yang berguna untuk beban kerja yang ada, namun keduanya merupakan versi Claude yang lebih lama, bukan jajaran produk terkini yang lengkap.

Prompt yang lebih panjang dapat mengubah besaran selisih harga. Batas atas Gemini dimulai di atas 200 ribu token prompt; ambang batas yang tercantum untuk GPT-5.5 adalah di atas 272 ribu token input. Anthropic mencantumkan harga standar untuk seluruh jendela konteks 1M pada Claude versi 4.6 dan seterusnya. Pada 250 ribu token masukan dan 10 ribu token keluaran, perkiraan token standar Gemini adalah $1.18, sedangkan untuk Sonnet 4.6 adalah $0.90 dan untuk Sonnet 5 adalah $0.60. Bandingkan rentang harga yang berlaku dengan beban kerja yang akan Anda kirimkan.

Pilihlah berdasarkan biaya per tugas yang diselesaikan: termasuk upaya yang gagal, permintaan tindak lanjut, proses pemikiran, dan koreksi oleh manusia. Harga token saja tidak cukup untuk menentukan model mana yang paling cocok untuk pekerjaan Anda. Untuk latar belakang penetapan harga model sebelumnya, lihat perbandingan yang sudah ada mengenai Biaya Gemini 3 Pro dan Gemini 3 API.

Ketika langganan multi-model sesuai dengan anggaran Anda

Proyek API langsung cocok untuk produk yang membutuhkan panggilan yang dapat diprogram dan penagihan berdasarkan penggunaan. Paket Google AI cocok bagi pengguna yang menginginkan Gemini serta manfaat ekosistem Google-nya. GlobalGPT Cocok untuk pekerjaan yang mencakup berbagai model dan fungsi: meneliti suatu topik, menyusun draf dan merevisi artikel, meminta bantuan pemrograman, lalu membuat media pendukung dalam satu ruang kerja. Antarmuka baris perintahnya (CLI) juga mengintegrasikan pekerjaan berbasis AI dengan alur kerja terminal dan pengembangan.

Pilih metode penagihan yang sesuai dengan pekerjaan yang perlu Anda selesaikan
PembelianCara menyusun anggaranPilihlah ini untuk
Antarmuka Pemrograman Aplikasi GeminiInput, output, tingkatan layanan, penyimpanan dalam cache, dan alat bantuMembuat perangkat lunak atau mengotomatiskan panggilan
Langganan Google AIPaket bulanan yang diiklankan di AS beserta syarat kelayakan dan batasan fiturnyaMenggunakan Gemini dan produk-produk Google yang disertakan
Langganan GlobalGPTRencana platform yang dipilih beserta alokasi model dan fungsinyaAlur kerja yang lebih luas yang mencakup berbagai model dan alat media terkemuka

Keunggulan berlangganan multi-model terletak pada cakupan yang luas dan kemudahan alur kerja. Bandingkan alat-alat yang benar-benar akan Anda gunakan dengan langganan terpisah yang seharusnya Anda butuhkan jika tidak menggunakan layanan ini. Pilihlah paket yang kuotanya sesuai dengan beban kerja Anda; langganan platform dan API penyedia resmi atau paket konsumen merupakan produk yang berbeda.

  • Sebagian besar aplikasi obrolan dan Google? Mulailah dengan paket Google yang tingkat penggunaannya sesuai dengan rutinitas Anda. Panduan untuk Apa yang dimaksud dengan akses gratis Gemini? dapat membantu sebelum Anda melakukan pembaruan.
  • Mau mengirim produk? Gunakan anggaran API yang dilengkapi dengan catatan log, perkiraan penggunaan, dan pengaturan penagihan proyek yang tepat.
  • Penelitian, menulis, pemrograman, dan media dalam satu rutinitas? Jelajahi Ruang kerja multi-model GlobalGPT. Untuk opsi lainnya, lihat Alternatif untuk Gemini dan sesuaikan keunggulan mereka dengan pekerjaan Anda.

Sebagai langkah praktis selanjutnya setelah memilih rute akses, ikuti cara menggunakan Gemini 3.1 Pro. Perhatikan perbedaan antara langganan aplikasi dan penagihan API saat mengikuti petunjuk pengaturan.

Pertanyaan yang Sering Diajukan

Berapa biaya Gemini 3.1 Pro per satu juta token?

Pada tingkatan API standar Gemini, Gemini 3.1 Pro Preview dikenakan biaya $2 per juta token masukan dan $12 per juta token keluaran untuk prompt hingga 200.000 token. Di atas 200.000 token prompt, tarifnya adalah $4 dan $18. Penagihan output mencakup token pemikiran.

Apakah ada tingkatan API Gemini 3.1 Pro yang gratis?

Google tidak mencantumkan paket gratis API untuk Gemini 3.1 Pro Preview. Aplikasi Gemini memiliki paket gratis dengan tingkat akses yang bervariasi ke 3.1 Pro, dan Google AI Studio menyediakan platform untuk mencoba berbagai model. Jalur akses tersebut tidak memberikan kuota API gratis untuk penggunaan produksi model ini.

Apakah API mengenakan biaya untuk gambar dan video?

Ya. Gemini 3.1 Pro mendukung gambar, video, audio, dan file PDF sebagai masukan, dan penggunaan token untuk hal-hal tersebut akan diperhitungkan dalam tagihan. Jumlahnya bergantung pada jenis media dan pengaturan pemrosesan. Layanan ini menghasilkan teks; sedangkan pembuatan gambar atau video menggunakan model yang dihargai secara terpisah.

Apakah jumlah 200.000 token input itu termasuk dalam kategori harga yang lebih tinggi?

Tidak. Permintaan sebesar tepat 200.000 token termasuk dalam kisaran harga standar yang lebih rendah. Permintaan di atas 200.000 token menggunakan tarif input dan output yang lebih tinggi. Token yang tersimpan dalam cache tetap dihitung dalam batas token yang berlaku.

Apakah paket Google AI Pro $19.99 sama dengan penagihan API?

Tidak. Paket bulanan AS $19.99 adalah langganan konsumen yang dilengkapi dengan manfaat kredit pengembang bulanan sebesar $10. Panduan umum Google mengenai kredit Cloud mencakup produk seperti Vertex AI dan menjelaskan cara menerapkan manfaat tersebut ke satu akun penagihan yang memenuhi syarat. Periksa kredit spesifik Anda di My Benefits, layanan yang memenuhi syarat, tanggal kedaluwarsa, dan saldo yang tersedia sebelum menggunakannya untuk anggaran API Gemini Anda. Sampai detail tersebut dikonfirmasi, rencanakan biaya API sebelum menggunakan kredit.

Apa cara termurah untuk menggunakan Gemini 3.1 Pro?

Untuk penggunaan aplikasi sesekali, mulailah dengan akses yang tersedia pada paket gratis. Untuk penggunaan API berbayar, perkirakan jumlah token yang dibutuhkan dan pertimbangkan opsi Batch atau Flex jika kompromi waktu yang ditawarkannya sesuai dengan kebutuhan Anda. Untuk penggunaan rutin yang lebih luas yang mencakup berbagai model dan alat media, bandingkan langganan multi-model dengan langganan terpisah yang biasanya akan Anda gunakan.

Sesuaikan anggaran dengan rute dan beban kerja Anda yang sebenarnya: Google’s Daftar Harga API untuk perangkat lunak, hal itu halaman langganan untuk aplikasi Gemini, atau GlobalGPT untuk alur kerja multi-model yang terintegrasi.

Bagikan Postingan:

Postingan Terkait