Ulasan model · Uji perbandingan · Uji API nyata
Gemini 3.7 Flash diposisikan sebagai model yang cepat dan mampu melakukan penalaran untuk pemrograman, pekerjaan berbasis agen, masukan multimodal, serta tugas-tugas produksi sehari-hari. Pertanyaan yang lebih berguna justru lebih sulit: apakah model ini menghasilkan karya akhir yang lebih baik daripada Gemini 3.6 Flash ketika kedua model tersebut menerima prompt yang sama?
Ulasan Gemini 3.7 Flash ini membedakan tiga jenis bukti. Dokumentasi Google mendukung fakta-fakta model, harga, dan klaim benchmark resmi. Artificial Analysis menyediakan konteks benchmark independen dari pihak ketiga. Perbandingan praktis kami menggunakan tujuh tugas API yang serupa, dengan prompt dan pengaturan generasi yang sama untuk kedua model.
Gemini 3.7 Flash terdaftar untuk pengujian melalui GlobalGPT Gemini 3.7 Halaman model Flash. Dengan demikian, Anda memiliki satu tempat untuk menjalankan prompt yang sama pada beberapa model, termasuk model acuan yang digunakan dalam ulasan ini. Untuk konteks terkait, lihat artikel kami Gemini 3.6 Ulasan Singkat dan Perbandingan Gemini 3.6 Flash vs Gemini 3.1 Pro.

Ulasan Singkat Gemini 3.7: Jawaban Singkatnya
Gemini 3.7 Flash menghasilkan jawaban akhir yang lebih baik pada tiga dari enam pasangan tugas yang telah diselesaikan, dibandingkan dengan dua kemenangan yang diraih oleh Gemini 3.6 Flash dan satu hasil seri. Keunggulannya terlihat dalam bidang pemrograman, analisis data, dan penyuntingan SEO yang aman dari klaim. Gemini 3.6 Flash menghasilkan rancangan antarmuka teks yang lebih rapi dan ekstraksi status yang lebih teliti, sedangkan dalam perencanaan berbasis agen, hasilnya berakhir seri.
Ringkasan ulasan
| Ukuran | Hasil yang diamati | Apa artinya |
|---|---|---|
| Kualitas hasil cetak | 3,7 menang 3 kali; 3,6 menang 2 kali; 1 kali seri | Penilaian didasarkan pada hasil karya yang ditampilkan di setiap kartu. |
| Kecepatan | Campuran | 3.7 menyelesaikan empat tugas lebih cepat, tetapi 3.6 memiliki rata-rata waktu penyelesaian enam tugas yang sedikit lebih rendah. |
| Efisiensi token | 3.7 menggunakan 7.948 token keluaran; 3.6 menggunakan 10.058 | Secara keseluruhan, 3.7 menghasilkan 21% token keluaran lebih sedikit. |
| Hasil 3,7 yang paling tinggi | Pengeditan SEO yang aman dari klaim | Laporan tersebut mengikuti fakta-fakta yang telah ditetapkan tanpa menambahkan deskripsi yang tidak didukung bukti. |
Ini adalah enam tugas teks kecil yang terkendali, bukan peringkat model secara umum. T01 tidak dimasukkan karena tidak ada satu pun model yang berhasil menyelesaikan jawaban yang diminta dalam batas keluaran yang ditetapkan.
Apa Itu Gemini 3.7 Flash?
Gemini 3.7 Flash adalah model stabil berkapasitas tinggi dari Google untuk tugas-tugas yang masih memerlukan kemampuan penalaran. Google mencantumkan masukan berupa teks, gambar, video, audio, dan PDF; kemampuan yang didukung meliputi pemanggilan fungsi, eksekusi kode, pencarian berbasis hasil pencarian, pencarian berkas, keluaran terstruktur, dan penggunaan komputer (Pratinjau). Pertanyaan praktisnya adalah bagaimana kontrol-kontrol tersebut diterjemahkan menjadi hasil kerja yang selesai.
Tanggal Rilis dan Ketersediaan
Halaman Analisis Buatan yang ditampilkan menunjukkan Gemini 3.7 Flash (tinggi) dengan jadwal rilis pada Agustus 2026. Untuk mengetahui status resmi, ID model, fitur yang didukung, dan detail peluncuran, gunakan Google’s Kartu model resmi Gemini 3.7 Flash dan dokumentasi API yang tertaut. Ketersediaan dapat bervariasi tergantung pada produk, wilayah, akun, dan tingkatan model, sehingga halaman yang mencantumkan suatu model tidak secara otomatis menjadi bukti bahwa model tersebut dapat diakses secara universal.
Apa yang Berubah Dibandingkan dengan Gemini 3.6 Flash?
Perubahan ini bukan sekadar peningkatan angka benchmark. Google menggambarkan Gemini 3.7 Flash sebagai versi pengembangan dari Gemini 3.6 Flash dengan peningkatan pada fondasi penalaran dan kemampuan berpikir yang dapat disesuaikan. Dalam pasangan tes yang telah kami selesaikan, hal ini tercermin dalam penanganan kendala yang lebih baik pada tiga tugas, namun tidak berhasil meraih kemenangan mutlak.
| Area perbandingan | Gemini 3,7 Flash | Gemini 3,6 Flash | Bukti yang teramati |
|---|---|---|---|
| Perbaikan bug pemrograman | Benar, dengan tes yang lebih akurat | Benar, tapi lebih panjang | 3,7 kemenangan tipis |
| Rencana antarmuka pengguna berbasis teks | Dapat ditindaklanjuti, dengan dua kekurangan redaksional | Lebih rapi dan lebih konsisten secara internal | 3.6 kemenangan tipis |
| Ekstraksi yang mempertimbangkan status | Ingatan yang sempurna, namun satu label kesuksesan yang dilebih-lebihkan | Bahasa status yang lebih tepat | 3.6 kemenangan tipis |
| Penalaran data | Benar, dengan pembagian default yang lebih jelas | Benar, dengan penjelasan bersyarat yang lebih rinci | 3,7 kemenangan tipis |
| Perencanaan agen | Pintu penahan yang kokoh | Rincian pemanggilan alat yang lebih spesifik | Dasi |
| Penyuntingan SEO | Menyimpan semua klaim yang terkunci | Menambahkan satu kata sifat yang tidak didukung | 3,7 kemenangan tipis |
Gemini 3.7 Spesifikasi Flash dan Jendela Konteks
Spesifikasi itu penting karena menentukan syarat-syarat yang membuat perbandingan menjadi adil. Jika Anda membandingkan batas-batas paket alih-alih perilaku model, maka Panduan Batas dan Kuota Gemini adalah tahap tindak lanjut yang lebih mendalam. Angka jendela konteks tidak secara otomatis berarti suatu model akan merangkum setiap dokumen panjang dengan akurat; angka tersebut hanya menunjukkan apa yang dirancang untuk diterima oleh API. Uji ekstraksi di bawah ini akan memeriksa secara terpisah tingkat recall, penanganan kontradiksi, dan nilai yang tidak diketahui.
| Spesifikasi | Gemini 3,7 Flash | Gemini 3,6 Flash | Sumber |
|---|---|---|---|
| ID model API yang dikembalikan | gemini-3.7-flash | gemini-3.6-flash | Respons API yang terekam |
| Konteks masukan | Hingga 1 juta token | Hingga 1 juta token | Kartu model Google |
| Jumlah teks maksimum yang dapat ditampilkan | 64K token | 64K token | Kartu model Google |
| Masukan yang terdokumentasi | Teks, gambar, audio, video | Teks, gambar, audio, video | Kartu model Google |
Gemini 3.7 Harga Flash dan Biaya API
Penetapan harga perlu memiliki pemisahan yang jelas antara tarif yang dipublikasikan dan biaya untuk satu jawaban tertentu. Ringkasan Analisis Buatan yang ditampilkan menunjukkan $0,75 per 1 juta token masukan dan $3,75 per 1 juta token yang dihasilkan untuk daftar Gemini 3.7 Flash (tinggi) yang dipilih. Angka-angka tersebut merupakan data dari pihak ketiga, bukan pengganti tabel harga resmi Google, dan bukan pernyataan mengenai setiap jalur akses.
Konteks harga pihak ketiga yang diperoleh
Hanya bersifat visual relatif. Batang-batang tersebut tidak menggantikan unit penagihan resmi, tingkatan, wilayah, atau aturan cache/batch.
The Kartu model Google mencantumkan tarif API awal sebesar $0,75 per 1 juta token masukan dan $3,75 per 1 juta token keluaran untuk kedua model Flash hingga 31 Desember 2026. Perkiraan per kartu di bawah ini menerapkan tarif tersebut pada token yang tercatat; perkiraan tersebut tidak mencakup upaya ulang, penyimpanan dalam cache, pajak, dan biaya khusus rute.
| Pos biaya | Gemini 3,7 Flash | Gemini 3,6 Flash | Batas bukti |
|---|---|---|---|
| Harga input awal | $0,75 / 1M | $0,75 / 1M | Kartu model Google; berlaku hingga 31 Desember 2026 |
| Harga jual awal | $3,75 / 1M | $3,75 / 1M | Tarif berdasarkan rute mungkin berbeda-beda |
| Enam pasang uji yang telah diselesaikan | Tentang $0.0303 | Tentang $0.0382 | Diambil dari token yang tercatat; T01 dikecualikan |
Gemini 3.7 Flash: Hasil Uji Kinerja Resmi
Tolok ukur resmi menjawab pertanyaan yang terbatas: bagaimana kinerja model pada evaluasi yang telah dipublikasikan berdasarkan pengaturan evaluasi tersebut. Tolok ukur tersebut memang berguna sebagai konteks, tetapi tidak dapat menggantikan perbandingan hasil keluaran dengan prompt yang sama dalam ulasan ini.
Tolok Ukur Pemrograman, Agen, dan Penalaran
Kartu model Google dan dokumentasi resmi merupakan sumber yang harus digunakan untuk klaim benchmark dari Google sendiri. Versi final akan mencantumkan metrik, tanggal, varian model, model pembanding, dan pengaturan pengujian untuk setiap angka. Hasil 3,7 yang dibandingkan dengan model yang lebih lama tidak akan disajikan begitu saja sebagai hasil 3,7 versus 3,6.

Apa yang Tidak Dapat Dibuktikan oleh Kenaikan Indeks Acuan
- Skor pengkodean yang lebih tinggi tidak menjamin bahwa patch pertama pada setiap repositori lebih rapi.
- Skor penalaran tidak membuktikan bahwa seseorang lebih mahir dalam mengedit konten SEO atau menafsirkan tangkapan layar.
- Indeks intelijen pihak ketiga tidak dapat menggantikan bukti yang spesifik untuk tugas tertentu dalam tinjauan ini.
- Ketidakpastian yang tumpang tindih atau pengaturan pengujian yang berbeda tidak boleh dijadikan dasar untuk menentukan peringkat yang mutlak.

Cara Kami Menguji Gemini 3.7 Flash
Ini adalah uji API yang disesuaikan, bukan sekadar kumpulan demo yang tidak saling terkait. Kedua model menerima prompt, materi sumber, suhu 0, batas atas token keluaran, dan perlakuan presentasi yang sama. T05 dinilai berdasarkan pengulangan bersama sebanyak 5.000 token setelah kedua upaya pertama mencapai batas atas yang lebih rendah. T01 tetap tidak lengkap untuk kedua model bahkan setelah pengulangan yang sama.
| Lapangan yang terekam | Mengapa ini penting |
|---|---|
| ID model dan ID model yang dikembalikan | Memastikan bahwa model yang diminta adalah model yang memberikan jawaban. |
| Jumlah detik yang telah berlalu | Mengukur waktu respons dari awal hingga akhir pada rute yang sama. |
| Token masukan dan keluaran | Mendukung perkiraan biaya yang sebanding. |
| Kepatuhan terhadap format | Membedakan jawaban yang benar dari jawaban yang masih perlu diperbaiki strukturnya. |
| Kualitas editorial | Memverifikasi keakuratan, kelengkapan, kekhususan, penyajian, dan keamanan klaim. |
Permintaan yang telah diproses namun tidak menghasilkan keluaran yang dapat digunakan akan dilaporkan sebagai masalah eksekusi dan tidak akan dinilai sebagai penurunan kualitas.
Gemini 3.7 Hasil Uji Coba di Kondisi Nyata
Setiap kartu menampilkan masukan tugas yang sebenarnya, kutipan yang sesuai dari setiap jawaban yang disimpan, dan penilaian berdasarkan hasil pekerjaan yang telah diselesaikan. Waktu yang dihabiskan dihitung dari awal hingga akhir. Biaya dihitung berdasarkan tarif Google untuk pemula yang dijelaskan di atas.
Tes 1 — Sintesis Penelitian
Masukan tugas: Tuliskan rekomendasi pembelian sebanyak 180 kata dengan hanya menggunakan empat fakta yang disediakan, yang mencakup satu rekomendasi, tiga alasan, dua hal yang belum diketahui, dan rencana pengujian.
Gemini 3,7 Flash
33,427 detik · 85 token masukan / 4.996 token keluaran · perkiraan $0,01880
Proses pencocokan kedua terhenti pada batas maksimal 5.000 token sebelum menghasilkan rekomendasi yang dapat digunakan sebanyak 180 kata.
Gemini 3,6 Flash
28,706 detik · 85 token masukan / 4.996 token keluaran · perkiraan $0,01880
Hasilnya menunjukkan jumlah token penyelesaian yang sama dan juga panjang alasan penyelesaian.
Apa yang ditunjukkan oleh hasil tersebut
Kedua model tersebut pertama kali mencapai 2.400 token, lalu mengulangi pola tersebut pada angka 5.000. Teks yang tidak lengkap tidak dianggap sebagai bukti kualitas.
Uji Coba 2 — Perbaikan Bug Kode
Masukan tugas: Perbaiki top_paid(catatan) mengembalikan tiga catatan berbayar dengan nilai tertinggi, mempertahankan urutan masukan jika ada nilai yang sama, mempertahankan tanda tangan, menangani masukan kosong, menjelaskan penyebabnya, dan menambahkan dua tes.
Gemini 3,7 Flash
11,379 detik · 90 token masukan / 1.431 token keluaran · perkiraan $0,00543
paid.sort(key=lambda r: r["amount"], reverse=True); return paid[:3]Sistem tersebut mengidentifikasi urutan naik sebagai penyebabnya dan menguji fitur penyaringan, pemeringkatan, kasus seri, serta masukan kosong.
Gemini 3,6 Flash
13,984 detik · 90 token masukan / 2.273 token keluaran · perkiraan $0,00859
paid.sort(key=lambda r: r["amount"], reverse=True); return paid[:3]Patch tersebut memperbaiki masalah yang sama dan memenuhi kriteria penerimaan yang sama, namun dengan waktu respons yang lebih lama.
Apa yang ditunjukkan oleh hasil tersebut
Keduanya secara tepat menggunakan fungsi sort versi stabil Python untuk nilai yang sama. Jawaban versi 3.7 lebih singkat, tetapi kode akhir dan cakupan fungsinya setara.
Uji Coba 3 — Rencana Implementasi Antarmuka Pengguna Berbasis Teks
Masukan tugas: Rencanakan perbaikan untuk proses checkout dua kolom yang telah dijelaskan, yang memiliki spasi kosong berlebihan, hierarki yang kurang jelas, label "Bayar Sekarang" yang sangat kecil, catatan kepercayaan yang kurang mencolok, peringatan diskon, total pembayaran, dan penumpukan elemen pada tampilan seluler. Tidak ada tangkapan layar yang disertakan.
Gemini 3,7 Flash
15,009 detik · 86 token masukan / 1.591 token keluaran · perkiraan $0,00603
Desain tersebut mengusulkan tata letak 58/42, tombol ajakan bertindak (CTA) berukuran 48–56 piksel, lencana kepercayaan yang ditempatkan di dekatnya, peringatan berwarna kuning, tata letak bertumpuk untuk perangkat seluler, status fokus, dan target sentuh berukuran 44 piksel.
Gemini 3,6 Flash
15,254 detik · 86 token masukan / 1.767 token keluaran · perkiraan $0,00669
Hasilnya menampilkan tata letak 60/40 yang konsisten, ukuran huruf yang ditentukan secara eksplisit, tombol ajakan bertindak (CTA) berukuran 48–52px, konten kolom kanan yang tersusun rapi, titik pemecahan, serta pemeriksaan aksesibilitas.
Apa yang ditunjukkan oleh hasil tersebut
Keduanya bisa diperbaiki. Jawaban versi 3.7 menyebutkan “klik keterjangkauan,” yang tampaknya dimaksudkan sebagai “affordance,” dan menyebut kisi asimetris sebagai “simetris.” Versi 3.6 hanya memerlukan sedikit penyuntingan.
Tes 4 — Ekstraksi yang Memperhatikan Status
Masukan tugas: Rangkum sembilan fakta tentang Orion dalam 120 kata dan tambahkan sebuah tabel sambil tetap mencantumkan status “telah dikonfirmasi”, “direncanakan”, “masih dalam proses”, “belum diketahui”, dan “belum diverifikasi”.
Gemini 3,7 Flash
13,681 detik · 117 token masukan / 1.064 token keluaran · perkiraan $0,00408
Hasil untuk model 18% yang sarat dengan gambar masih belum diketahui, namun hasil uji coba model 82% disebut sebagai “sukses” dan uji coba kedua diberi label “Telah Dikonfirmasi / Direncanakan.”
Gemini 3,6 Flash
9,270 detik · 117 token masukan / 1.454 token keluaran · perkiraan $0,00554
Laporan tersebut menggambarkan program percontohan pertama secara netral sebagai program yang menangani 82% kasus dan memberi label pada program percontohan kedua sebagai “Disetujui (Masih Menunggu Keputusan Hukum).”
Apa yang ditunjukkan oleh hasil tersebut
Keduanya mencantumkan setiap fakta penting. Gemini 3.6 Flash menggambarkan status "disetujui", "masih dalam proses", dan "tidak diketahui" dengan lebih tepat, sedangkan 3.7 sedikit melebih-lebihkan uji coba pertama.
Tes 5 — Penalaran Berbasis Data
Masukan tugas: Berdasarkan pengeluaran, klik, konversi berbayar, dan pendapatan dari empat saluran, tampilkan perhitungan aritmatika, urutkan ROAS dan tingkat konversi yang dapat diukur, anggap pengeluaran nol sebagai tidak dapat diukur, dan rekomendasikan pembagian bersyarat $300.
Gemini 3,7 Flash
16,540 detik · 137 token masukan / 1.981 token keluaran · perkiraan $0,00753
ROAS: Email 7,00×, Pencarian 3,00×, Media Sosial 2,60×; Mitra tidak dapat diukur. Konversi: Email 12,5%, Pencarian dan Mitra 10%, Media Sosial 5%. Kampanye ini menawarkan tiga pembagian bersyarat.
Gemini 3,6 Flash
18,096 detik · 137 token masukan / 2.403 token keluaran · perkiraan $0,00911
Sistem tersebut menghasilkan peringkat yang sama serta penanganan kasus-kasus khusus, kemudian menawarkan efisiensi, diversifikasi, dan alokasi tes Mitra.
Apa yang ditunjukkan oleh hasil tersebut
Kedua perhitungan tersebut benar dan keduanya membuat rekomendasi tersebut bersifat bersyarat. Masing-masing menambahkan konteks spekulatif seputar pengeluaran nol dari Mitra, sehingga kalimat tersebut perlu dikonfirmasi sumbernya atau dihapus.
Tes 6 — Perencanaan Berbasis Agen dan Penggunaan Alat
Masukan tugas: Buatlah rencana yang terdiri dari kurang dari 220 kata dengan hanya menggunakan empat alat yang disebutkan namanya. Hentikan jika halaman tersebut tidak tersedia, tidak resmi, atau ambigu, dan jangan mengklaim bahwa alat-alat tersebut telah dijalankan.
Gemini 3,7 Flash
10,787 detik · 100 token masukan / 1.174 token keluaran · perkiraan $0,00448
Keempat langkahnya berkorelasi satu-ke-satu dengan alat-alat yang disediakan, diikuti oleh tahap penilaian domain resmi, ketersediaan, dan kejelasan. Untuk menyelesaikannya, diperlukan tepat satu catatan CSV yang telah diverifikasi.
Gemini 3,6 Flash
9,702 detik · 100 token masukan / 1.328 token keluaran · perkiraan: $0,00506
Rencana tersebut dapat diterapkan, tetapi menambahkan “atau mengurai isi HTML,” suatu operasi yang tidak termasuk dalam daftar alat yang disediakan.
Apa yang ditunjukkan oleh hasil tersebut
Keduanya mematuhi aturan penghentian dari sumber resmi dan menghindari simulasi eksekusi alat-alat tersebut. Rencana 3.7 tetap lebih terikat pada fungsi-fungsi yang tersedia.
Tes 7 — Penulisan dan Penyuntingan untuk SEO
Masukan tugas: Hasilkan HTML yang hanya berisi satu paragraf dan satu daftar singkat, gunakan kata kunci yang tepat satu kali, serta pertahankan empat fakta yang sudah ditetapkan tanpa mengada-ada mengenai hasil, harga, tanggal rilis, atau klaim ketersediaan.
Gemini 3,7 Flash
7,263 detik · 125 token masukan / 707 token keluaran · perkiraan $0,00275
<p>Dalam ulasan Gemini 3.7 Flash yang akan datang ini, kami menganalisis model Google dengan membandingkan data benchmark resmi dengan hasil pengujian API yang menggunakan prompt yang sama; sementara itu, hasil pengujian langsung masih menunggu.</p>Proses tersebut mengikuti struktur HTML, menggunakan kata kunci tersebut satu kali, dan mempertahankan klaim yang terkunci.
Gemini 3,6 Flash
7,542 detik · 125 token masukan / 833 token keluaran · perkiraan $0,00322
<p>Ulasan awal Gemini 3.7 Flash ini membahas model terbaru dari Google ... meskipun hasil pengujian langsung yang mendetail masih belum tersedia.</p>Strukturnya sudah benar, tetapi frasa “model baru” menambahkan klaim yang berada di luar fakta-fakta yang telah ditetapkan.
Apa yang ditunjukkan oleh hasil tersebut
Perbedaan yang menentukan terletak pada keamanan klaim: 3.7 menolak penambahan deskriptor yang tidak didukung sambil tetap mengembalikan HTML ringkas yang valid.
Gemini 3.7 Lembar Penilaian Uji Flash dan Hal-Hal Penting yang Dapat Diambil
Perbandingan ini menunjukkan keunggulan Gemini 3.7 Flash dalam hal kualitas hasil akhir, namun selisih tersebut lebih disebabkan oleh kedisiplinan instruksi daripada adanya kesenjangan kemampuan yang signifikan. Gemini 3.6 Flash tetap kompetitif dalam hal kode dan aritmatika, serta menghasilkan rencana frontend yang lebih baik.
Lembar penilaian tes yang disesuaikan
| Ukuran | Gemini 3,7 Flash | Gemini 3,6 Flash |
|---|---|---|
| Kemenangan tugas | 3 | 2 |
| Dasi berkualitas | 1 | 1 |
| Tugas yang belum tuntas | 1 | 1 |
| Tugas yang telah diselesaikan dan dapat digunakan | 6 dari 7 | 6 dari 7 |
| Token keluaran tugas yang telah diselesaikan | 7,948 | 10,058 |
| Hasil pengamatan terbaik | Rencana agenik yang terbatasi | Rencana antarmuka pengguna berbasis teks |
Gemini 3.7 Batasan Flash
Keterbatasan terbesar yang teramati sama pada kedua model: keduanya menghabiskan seluruh anggaran keluaran sebanyak dua kali pada permintaan sintesis penelitian sederhana yang terdiri dari 180 kata. T01 tidak dapat digunakan dalam konfigurasi yang diuji.
Gemini 3.7 Flash tidak secara keseluruhan lebih baik. Rencana bagian depannya mengandung kesalahan redaksional dan ketidaksesuaian antara tata letak internal dengan deskripsinya, sementara kedua jawaban data tersebut menimbulkan konteks spekulatif seputar saluran tanpa pengeluaran. Paket ini hanya menggunakan masukan teks, sehingga tidak menguji kualitas gambar, audio, video, atau konteks panjang yang sesungguhnya.
Apakah Gemini 3.7 Flash Layak Dibeli?
Ya, Gemini 3.7 Flash layak dicoba jika kepatuhan terhadap instruksi yang tepat menjadi hal yang penting. Model ini berhasil menyelesaikan tiga tugas dan menggunakan lebih sedikit token keluaran di seluruh enam pasangan yang dapat digunakan. Namun, keunggulannya kurang mencolok dalam hal perbaikan kode sederhana, perhitungan aritmatika, atau perancangan antarmuka pengguna, di mana Gemini 3.6 Flash berhasil memenangkan tugas frontend atau tetap bersaing ketat.
Anda dapat menjalankan perintah yang sama di GlobalGPT dan bandingkan dengan Gemini 3.6 Flash di ruang kerja yang sama. Gunakan tugas berulang Anda sebagai tolok ukur penentu.
Ulasan Singkat Gemini 3.7: Kesimpulan Akhir
Ulasan Gemini 3.7 Flash ini berakhir dengan hasil yang tipis namun dapat dibenarkan: Gemini 3.7 Flash memenangkan tiga tugas yang telah diselesaikan, Gemini 3.6 Flash memenangkan dua, dan satu berakhir imbang. Salah satu tugas penelitian tidak memberikan hasil yang pasti karena kedua model tersebut mencapai batas atas hasil yang sama sebanyak dua kali.
Gemini 3.6 Flash belum ketinggalan zaman. Versi ini menghasilkan rencana antarmuka teks yang lebih baik dan tabel status yang lebih teliti, sementara 3.7 lebih unggul dalam hal pemrograman, analisis data, dan pengeditan SEO berbasis fakta yang terkunci. Tugas perencanaan berbasis agen berakhir imbang, sehingga peningkatan ini bersifat selektif, bukan mutlak.
Gemini 3.7 Pertanyaan Umum tentang Flash
Kapan Gemini 3.7 Flash dirilis?
Google mencantumkan Gemini 3.7 Flash sebagai model yang stabil, dengan dokumentasi model yang terakhir diperbarui pada 13 Agustus 2026.
Apakah Gemini 3.7 Flash sudah stabil atau masih versi pratinjau?
Fitur ini tercantum sebagai "stabil" dalam dokumentasi model API Gemini Google. AI Studio, produk konsumen Gemini, dan rute pihak ketiga mungkin masih menampilkan ketersediaan atau kuota yang berbeda.
Apa ID model Gemini 3.7 Flash API?
Perbandingan yang diminta menggunakan `gemini-3.7-flash`, namun ID model yang dikembalikan harus dicatat dari respons API sebelum artikel akhir menyatakan bahwa model tersebut telah diverifikasi.
Berapa harga Gemini 3.7 Flash?
Tarif paket berbayar Google adalah $0,75 per 1 juta token masukan dan $3,75 per 1 juta token keluaran hingga 31 Desember 2026; mulai 1 Januari 2027, tarif yang tercantum menjadi $1,50/$7,50.
Apakah Gemini 3.7 Flash gratis?
Ketersediaan bagi konsumen atau pihak ketiga tidak berarti akses API gratis tanpa batas. Periksa rute, kuota, batasan laju, dan ketentuan penagihan untuk metode akses yang akan Anda gunakan.
Apa itu jendela konteks Gemini 3.7 Flash?
Ringkasan Analisis Buatan yang ditampilkan menunjukkan daftar konteks sebanyak 1 juta token. Silakan periksa batasan konteks resmi yang tepat serta ketentuan harga atau pembatasan fitur terkait konteks panjang dalam dokumentasi Google.
Apakah Gemini 3.7 Flash mendukung gambar, audio, video, dan PDF?
Periksa jenis masukan yang didukung untuk ID model API yang tepat. Dalam proses peninjauan ini, setiap modalitas yang didukung akan dianggap sebagai kemampuan yang terdokumentasi, bukan sebagai bukti bahwa kualitasnya sama di seluruh jenis masukan.
Apa itu tingkat pemikiran Gemini 3.7 Flash?
Gemini 3.7 Flash dilengkapi dengan kontrol pemikiran yang dapat dikonfigurasi. Tingkat yang tepat, pengaturan default, perilaku token, dan implikasi penagihan harus diambil dari dokumentasi API resmi.
Apakah Gemini 3.7 Flash lebih baik daripada Gemini 3.6 Flash?
Dalam uji API yang disesuaikan ini, Gemini 3.7 Flash memenangkan tiga tugas yang diselesaikan, Gemini 3.6 Flash memenangkan dua, satu berakhir seri, dan satu hasilnya tidak jelas. Hal ini menunjukkan keunggulan tipis bagi versi 3.7, bukan kemenangan mutlak.
Apakah Gemini 3.7 Flash lebih baik daripada Gemini 3.1 Pro?
Draf ini tidak membuat klaim tersebut. Gemini 3.1 Pro merupakan acuan perbandingan yang berbeda, sehingga memerlukan kumpulan prompt dan bukti yang sesuai untuknya sendiri, bukan kesimpulan yang diambil dari perbandingan Gemini 3.6 Flash.
Apakah Gemini 3.7 Flash cocok untuk pemrograman?
Ya, dalam tugas perbaikan bug yang terbatas yang diuji di sini. Kedua model menghasilkan patch minimal yang benar, tetapi Gemini 3.7 Flash unggul sedikit berkat cakupan pengujian yang lebih rapi dengan jumlah token penyelesaian yang lebih sedikit.
Apakah Gemini 3.7 Flash dapat menggunakan alat-alat dan menjalankan alur kerja agen?
Silakan periksa dokumentasi resmi mengenai alat dan pemanggilan fungsi untuk mengetahui rute yang tepat. Uji coba berbasis agen dalam ulasan ini mengevaluasi kemampuan perencanaan dan kesadaran akan batas; uji coba ini tidak menyatakan bahwa sebuah rencana saja sudah cukup untuk membuktikan keberhasilan pelaksanaan alat.
Di mana saya bisa mengakses Gemini 3.7 Flash?
Gunakan titik akses resmi Google jika tersedia, atau coba Halaman model GlobalGPT ketika fitur tersebut telah diaktifkan untuk akun dan wilayah Anda.
Apakah hasil pengujian standar resmi sesuai dengan hasil di dunia nyata?
Tidak secara otomatis. Tolok ukur resmi dan evaluasi pihak ketiga memberikan konteks yang berguna, sementara uji coba dengan prompt yang sama menunjukkan bagaimana suatu model menangani tugas tertentu yang sedang diukur. Ulasan ini membedakan kedua jenis bukti tersebut.



