Ulasan Singkat Gemini 3.7: Harga, Uji Performa, dan Pengujian Nyata

gemini 3.7 flash

Ulasan model · Uji perbandingan · Uji API nyata

Gemini 3.7 Flash diposisikan sebagai model yang cepat dan mampu melakukan penalaran untuk pemrograman, pekerjaan berbasis agen, masukan multimodal, serta tugas-tugas produksi sehari-hari. Pertanyaan yang lebih berguna justru lebih sulit: apakah model ini menghasilkan karya akhir yang lebih baik daripada Gemini 3.6 Flash ketika kedua model tersebut menerima prompt yang sama?

Ulasan Gemini 3.7 Flash ini membedakan tiga jenis bukti. Dokumentasi Google mendukung fakta-fakta model, harga, dan klaim benchmark resmi. Artificial Analysis menyediakan konteks benchmark independen dari pihak ketiga. Perbandingan praktis kami menggunakan tujuh tugas API yang serupa, dengan prompt dan pengaturan generasi yang sama untuk kedua model.

Gemini 3.7 Flash terdaftar untuk pengujian melalui GlobalGPT Gemini 3.7 Halaman model Flash. Dengan demikian, Anda memiliki satu tempat untuk menjalankan prompt yang sama pada beberapa model, termasuk model acuan yang digunakan dalam ulasan ini. Untuk konteks terkait, lihat artikel kami Gemini 3.6 Ulasan Singkat dan Perbandingan Gemini 3.6 Flash vs Gemini 3.1 Pro.

Status bukti: Enam tugas yang cocok menghasilkan jawaban lengkap dari kedua model. T01 tetap tidak dapat disimpulkan setelah kedua model mencapai batas keluaran yang sama sebanyak dua kali, sehingga hasilnya diungkapkan namun tidak diberi skor. Kutipan keluaran di bawah ini diambil dari respons API mentah yang disimpan.
3–2Kemenangan berdasarkan tugas yang diselesaikan untuk Gemini 3.7 Flash
1Dasi berkualitas
1Tugas pencocokan yang tidak memberikan hasil yang pasti
6/7Hasil akhir yang dapat digunakan per model

Ulasan Singkat Gemini 3.7: Jawaban Singkatnya

Gemini 3.7 Flash menghasilkan jawaban akhir yang lebih baik pada tiga dari enam pasangan tugas yang telah diselesaikan, dibandingkan dengan dua kemenangan yang diraih oleh Gemini 3.6 Flash dan satu hasil seri. Keunggulannya terlihat dalam bidang pemrograman, analisis data, dan penyuntingan SEO yang aman dari klaim. Gemini 3.6 Flash menghasilkan rancangan antarmuka teks yang lebih rapi dan ekstraksi status yang lebih teliti, sedangkan dalam perencanaan berbasis agen, hasilnya berakhir seri.

Ringkasan ulasan

UkuranHasil yang diamatiApa artinya
Kualitas hasil cetak3,7 menang 3 kali; 3,6 menang 2 kali; 1 kali seriPenilaian didasarkan pada hasil karya yang ditampilkan di setiap kartu.
KecepatanCampuran3.7 menyelesaikan empat tugas lebih cepat, tetapi 3.6 memiliki rata-rata waktu penyelesaian enam tugas yang sedikit lebih rendah.
Efisiensi token3.7 menggunakan 7.948 token keluaran; 3.6 menggunakan 10.058Secara keseluruhan, 3.7 menghasilkan 21% token keluaran lebih sedikit.
Hasil 3,7 yang paling tinggiPengeditan SEO yang aman dari klaimLaporan tersebut mengikuti fakta-fakta yang telah ditetapkan tanpa menambahkan deskripsi yang tidak didukung bukti.

Ini adalah enam tugas teks kecil yang terkendali, bukan peringkat model secara umum. T01 tidak dimasukkan karena tidak ada satu pun model yang berhasil menyelesaikan jawaban yang diminta dalam batas keluaran yang ditetapkan.

Apa Itu Gemini 3.7 Flash?

Gemini 3.7 Flash adalah model stabil berkapasitas tinggi dari Google untuk tugas-tugas yang masih memerlukan kemampuan penalaran. Google mencantumkan masukan berupa teks, gambar, video, audio, dan PDF; kemampuan yang didukung meliputi pemanggilan fungsi, eksekusi kode, pencarian berbasis hasil pencarian, pencarian berkas, keluaran terstruktur, dan penggunaan komputer (Pratinjau). Pertanyaan praktisnya adalah bagaimana kontrol-kontrol tersebut diterjemahkan menjadi hasil kerja yang selesai.

Tanggal Rilis dan Ketersediaan

Halaman Analisis Buatan yang ditampilkan menunjukkan Gemini 3.7 Flash (tinggi) dengan jadwal rilis pada Agustus 2026. Untuk mengetahui status resmi, ID model, fitur yang didukung, dan detail peluncuran, gunakan Google’s Kartu model resmi Gemini 3.7 Flash dan dokumentasi API yang tertaut. Ketersediaan dapat bervariasi tergantung pada produk, wilayah, akun, dan tingkatan model, sehingga halaman yang mencantumkan suatu model tidak secara otomatis menjadi bukti bahwa model tersebut dapat diakses secara universal.

Apa yang Berubah Dibandingkan dengan Gemini 3.6 Flash?

Perubahan ini bukan sekadar peningkatan angka benchmark. Google menggambarkan Gemini 3.7 Flash sebagai versi pengembangan dari Gemini 3.6 Flash dengan peningkatan pada fondasi penalaran dan kemampuan berpikir yang dapat disesuaikan. Dalam pasangan tes yang telah kami selesaikan, hal ini tercermin dalam penanganan kendala yang lebih baik pada tiga tugas, namun tidak berhasil meraih kemenangan mutlak.

Area perbandinganGemini 3,7 FlashGemini 3,6 FlashBukti yang teramati
Perbaikan bug pemrogramanBenar, dengan tes yang lebih akuratBenar, tapi lebih panjang3,7 kemenangan tipis
Rencana antarmuka pengguna berbasis teksDapat ditindaklanjuti, dengan dua kekurangan redaksionalLebih rapi dan lebih konsisten secara internal3.6 kemenangan tipis
Ekstraksi yang mempertimbangkan statusIngatan yang sempurna, namun satu label kesuksesan yang dilebih-lebihkanBahasa status yang lebih tepat3.6 kemenangan tipis
Penalaran dataBenar, dengan pembagian default yang lebih jelasBenar, dengan penjelasan bersyarat yang lebih rinci3,7 kemenangan tipis
Perencanaan agenPintu penahan yang kokohRincian pemanggilan alat yang lebih spesifikDasi
Penyuntingan SEOMenyimpan semua klaim yang terkunciMenambahkan satu kata sifat yang tidak didukung3,7 kemenangan tipis

Gemini 3.7 Spesifikasi Flash dan Jendela Konteks

Spesifikasi itu penting karena menentukan syarat-syarat yang membuat perbandingan menjadi adil. Jika Anda membandingkan batas-batas paket alih-alih perilaku model, maka Panduan Batas dan Kuota Gemini adalah tahap tindak lanjut yang lebih mendalam. Angka jendela konteks tidak secara otomatis berarti suatu model akan merangkum setiap dokumen panjang dengan akurat; angka tersebut hanya menunjukkan apa yang dirancang untuk diterima oleh API. Uji ekstraksi di bawah ini akan memeriksa secara terpisah tingkat recall, penanganan kontradiksi, dan nilai yang tidak diketahui.

SpesifikasiGemini 3,7 FlashGemini 3,6 FlashSumber
ID model API yang dikembalikangemini-3.7-flashgemini-3.6-flashRespons API yang terekam
Konteks masukanHingga 1 juta tokenHingga 1 juta tokenKartu model Google
Jumlah teks maksimum yang dapat ditampilkan64K token64K tokenKartu model Google
Masukan yang terdokumentasiTeks, gambar, audio, videoTeks, gambar, audio, videoKartu model Google

Gemini 3.7 Harga Flash dan Biaya API

Penetapan harga perlu memiliki pemisahan yang jelas antara tarif yang dipublikasikan dan biaya untuk satu jawaban tertentu. Ringkasan Analisis Buatan yang ditampilkan menunjukkan $0,75 per 1 juta token masukan dan $3,75 per 1 juta token yang dihasilkan untuk daftar Gemini 3.7 Flash (tinggi) yang dipilih. Angka-angka tersebut merupakan data dari pihak ketiga, bukan pengganti tabel harga resmi Google, dan bukan pernyataan mengenai setiap jalur akses.

Konteks harga pihak ketiga yang diperoleh

Masukan · $0,75
Output · $3.75

Hanya bersifat visual relatif. Batang-batang tersebut tidak menggantikan unit penagihan resmi, tingkatan, wilayah, atau aturan cache/batch.

The Kartu model Google mencantumkan tarif API awal sebesar $0,75 per 1 juta token masukan dan $3,75 per 1 juta token keluaran untuk kedua model Flash hingga 31 Desember 2026. Perkiraan per kartu di bawah ini menerapkan tarif tersebut pada token yang tercatat; perkiraan tersebut tidak mencakup upaya ulang, penyimpanan dalam cache, pajak, dan biaya khusus rute.

Pos biayaGemini 3,7 FlashGemini 3,6 FlashBatas bukti
Harga input awal$0,75 / 1M$0,75 / 1MKartu model Google; berlaku hingga 31 Desember 2026
Harga jual awal$3,75 / 1M$3,75 / 1MTarif berdasarkan rute mungkin berbeda-beda
Enam pasang uji yang telah diselesaikanTentang $0.0303Tentang $0.0382Diambil dari token yang tercatat; T01 dikecualikan

Gemini 3.7 Flash: Hasil Uji Kinerja Resmi

Tolok ukur resmi menjawab pertanyaan yang terbatas: bagaimana kinerja model pada evaluasi yang telah dipublikasikan berdasarkan pengaturan evaluasi tersebut. Tolok ukur tersebut memang berguna sebagai konteks, tetapi tidak dapat menggantikan perbandingan hasil keluaran dengan prompt yang sama dalam ulasan ini.

Tolok Ukur Pemrograman, Agen, dan Penalaran

Kartu model Google dan dokumentasi resmi merupakan sumber yang harus digunakan untuk klaim benchmark dari Google sendiri. Versi final akan mencantumkan metrik, tanggal, varian model, model pembanding, dan pengaturan pengujian untuk setiap angka. Hasil 3,7 yang dibandingkan dengan model yang lebih lama tidak akan disajikan begitu saja sebagai hasil 3,7 versus 3,6.

Panel tolok ukur Analisis Buatan untuk Gemini 3.7 Flash
Konteks tolok ukur independen yang diambil dari Analisis Buatan. Tangkapan layar ini bukanlah tabel benchmark resmi dari Google.

Apa yang Tidak Dapat Dibuktikan oleh Kenaikan Indeks Acuan

  • Skor pengkodean yang lebih tinggi tidak menjamin bahwa patch pertama pada setiap repositori lebih rapi.
  • Skor penalaran tidak membuktikan bahwa seseorang lebih mahir dalam mengedit konten SEO atau menafsirkan tangkapan layar.
  • Indeks intelijen pihak ketiga tidak dapat menggantikan bukti yang spesifik untuk tugas tertentu dalam tinjauan ini.
  • Ketidakpastian yang tumpang tindih atau pengaturan pengujian yang berbeda tidak boleh dijadikan dasar untuk menentukan peringkat yang mutlak.
Panel ringkasan Analisis Buatan untuk Gemini 3.7 Flash
Laporan Analisis Buatan menunjukkan Kecerdasan 56, kecepatan keluaran sebesar 389,5 token per detik, harga yang ditampilkan sebesar $0,75 untuk masukan dan $3,75 untuk keluaran per 1 juta token, serta daftar konteks 1 juta untuk entri Gemini 3,7 Flash (tinggi). Ini merupakan pengamatan dari pihak ketiga.

Cara Kami Menguji Gemini 3.7 Flash

Ini adalah uji API yang disesuaikan, bukan sekadar kumpulan demo yang tidak saling terkait. Kedua model menerima prompt, materi sumber, suhu 0, batas atas token keluaran, dan perlakuan presentasi yang sama. T05 dinilai berdasarkan pengulangan bersama sebanyak 5.000 token setelah kedua upaya pertama mencapai batas atas yang lebih rendah. T01 tetap tidak lengkap untuk kedua model bahkan setelah pengulangan yang sama.

Lapangan yang terekamMengapa ini penting
ID model dan ID model yang dikembalikanMemastikan bahwa model yang diminta adalah model yang memberikan jawaban.
Jumlah detik yang telah berlaluMengukur waktu respons dari awal hingga akhir pada rute yang sama.
Token masukan dan keluaranMendukung perkiraan biaya yang sebanding.
Kepatuhan terhadap formatMembedakan jawaban yang benar dari jawaban yang masih perlu diperbaiki strukturnya.
Kualitas editorialMemverifikasi keakuratan, kelengkapan, kekhususan, penyajian, dan keamanan klaim.

Permintaan yang telah diproses namun tidak menghasilkan keluaran yang dapat digunakan akan dilaporkan sebagai masalah eksekusi dan tidak akan dinilai sebagai penurunan kualitas.

Gemini 3.7 Hasil Uji Coba di Kondisi Nyata

Setiap kartu menampilkan masukan tugas yang sebenarnya, kutipan yang sesuai dari setiap jawaban yang disimpan, dan penilaian berdasarkan hasil pekerjaan yang telah diselesaikan. Waktu yang dihabiskan dihitung dari awal hingga akhir. Biaya dihitung berdasarkan tarif Google untuk pemula yang dijelaskan di atas.

Tes 1 — Sintesis Penelitian

Masukan tugas: Tuliskan rekomendasi pembelian sebanyak 180 kata dengan hanya menggunakan empat fakta yang disediakan, yang mencakup satu rekomendasi, tiga alasan, dua hal yang belum diketahui, dan rencana pengujian.

Gemini 3,7 Flash

33,427 detik · 85 token masukan / 4.996 token keluaran · perkiraan $0,01880

Proses pencocokan kedua terhenti pada batas maksimal 5.000 token sebelum menghasilkan rekomendasi yang dapat digunakan sebanyak 180 kata.

Gemini 3,6 Flash

28,706 detik · 85 token masukan / 4.996 token keluaran · perkiraan $0,01880

Hasilnya menunjukkan jumlah token penyelesaian yang sama dan juga panjang alasan penyelesaian.

Apa yang ditunjukkan oleh hasil tersebut

Kedua model tersebut pertama kali mencapai 2.400 token, lalu mengulangi pola tersebut pada angka 5.000. Teks yang tidak lengkap tidak dianggap sebagai bukti kualitas.

Kesimpulan tugas: Belum dapat disimpulkan. Ini adalah kegagalan dalam pembagian anggaran output atau konfigurasi, bukan sebuah keberhasilan.

Uji Coba 2 — Perbaikan Bug Kode

Masukan tugas: Perbaiki top_paid(catatan) mengembalikan tiga catatan berbayar dengan nilai tertinggi, mempertahankan urutan masukan jika ada nilai yang sama, mempertahankan tanda tangan, menangani masukan kosong, menjelaskan penyebabnya, dan menambahkan dua tes.

Gemini 3,7 Flash

11,379 detik · 90 token masukan / 1.431 token keluaran · perkiraan $0,00543

paid.sort(key=lambda r: r["amount"], reverse=True); return paid[:3]

Sistem tersebut mengidentifikasi urutan naik sebagai penyebabnya dan menguji fitur penyaringan, pemeringkatan, kasus seri, serta masukan kosong.

Gemini 3,6 Flash

13,984 detik · 90 token masukan / 2.273 token keluaran · perkiraan $0,00859

paid.sort(key=lambda r: r["amount"], reverse=True); return paid[:3]

Patch tersebut memperbaiki masalah yang sama dan memenuhi kriteria penerimaan yang sama, namun dengan waktu respons yang lebih lama.

Apa yang ditunjukkan oleh hasil tersebut

Keduanya secara tepat menggunakan fungsi sort versi stabil Python untuk nilai yang sama. Jawaban versi 3.7 lebih singkat, tetapi kode akhir dan cakupan fungsinya setara.

Kesimpulan tugas: Gemini 3.7 Flash, menang tipis. Kedua perbaikan tersebut benar, tetapi versi 3.7 mencakup uji penerimaan dengan lebih rapi dan menggunakan lebih sedikit token penyelesaian.

Uji Coba 3 — Rencana Implementasi Antarmuka Pengguna Berbasis Teks

Masukan tugas: Rencanakan perbaikan untuk proses checkout dua kolom yang telah dijelaskan, yang memiliki spasi kosong berlebihan, hierarki yang kurang jelas, label "Bayar Sekarang" yang sangat kecil, catatan kepercayaan yang kurang mencolok, peringatan diskon, total pembayaran, dan penumpukan elemen pada tampilan seluler. Tidak ada tangkapan layar yang disertakan.

Gemini 3,7 Flash

15,009 detik · 86 token masukan / 1.591 token keluaran · perkiraan $0,00603

Desain tersebut mengusulkan tata letak 58/42, tombol ajakan bertindak (CTA) berukuran 48–56 piksel, lencana kepercayaan yang ditempatkan di dekatnya, peringatan berwarna kuning, tata letak bertumpuk untuk perangkat seluler, status fokus, dan target sentuh berukuran 44 piksel.

Gemini 3,6 Flash

15,254 detik · 86 token masukan / 1.767 token keluaran · perkiraan $0,00669

Hasilnya menampilkan tata letak 60/40 yang konsisten, ukuran huruf yang ditentukan secara eksplisit, tombol ajakan bertindak (CTA) berukuran 48–52px, konten kolom kanan yang tersusun rapi, titik pemecahan, serta pemeriksaan aksesibilitas.

Apa yang ditunjukkan oleh hasil tersebut

Keduanya bisa diperbaiki. Jawaban versi 3.7 menyebutkan “klik keterjangkauan,” yang tampaknya dimaksudkan sebagai “affordance,” dan menyebut kisi asimetris sebagai “simetris.” Versi 3.6 hanya memerlukan sedikit penyuntingan.

Hasil tugas: Gemini 3.6 Flash. Rencana implementasi antarmuka pengguna berbasis teks yang lebih rapi.

Tes 4 — Ekstraksi yang Memperhatikan Status

Masukan tugas: Rangkum sembilan fakta tentang Orion dalam 120 kata dan tambahkan sebuah tabel sambil tetap mencantumkan status “telah dikonfirmasi”, “direncanakan”, “masih dalam proses”, “belum diketahui”, dan “belum diverifikasi”.

Gemini 3,7 Flash

13,681 detik · 117 token masukan / 1.064 token keluaran · perkiraan $0,00408

Hasil untuk model 18% yang sarat dengan gambar masih belum diketahui, namun hasil uji coba model 82% disebut sebagai “sukses” dan uji coba kedua diberi label “Telah Dikonfirmasi / Direncanakan.”

Gemini 3,6 Flash

9,270 detik · 117 token masukan / 1.454 token keluaran · perkiraan $0,00554

Laporan tersebut menggambarkan program percontohan pertama secara netral sebagai program yang menangani 82% kasus dan memberi label pada program percontohan kedua sebagai “Disetujui (Masih Menunggu Keputusan Hukum).”

Apa yang ditunjukkan oleh hasil tersebut

Keduanya mencantumkan setiap fakta penting. Gemini 3.6 Flash menggambarkan status "disetujui", "masih dalam proses", dan "tidak diketahui" dengan lebih tepat, sedangkan 3.7 sedikit melebih-lebihkan uji coba pertama.

Kesimpulan tugas: Gemini 3.6 Flash, menang tipis. Ketepatan status yang lebih baik.

Tes 5 — Penalaran Berbasis Data

Masukan tugas: Berdasarkan pengeluaran, klik, konversi berbayar, dan pendapatan dari empat saluran, tampilkan perhitungan aritmatika, urutkan ROAS dan tingkat konversi yang dapat diukur, anggap pengeluaran nol sebagai tidak dapat diukur, dan rekomendasikan pembagian bersyarat $300.

Gemini 3,7 Flash

16,540 detik · 137 token masukan / 1.981 token keluaran · perkiraan $0,00753

ROAS: Email 7,00×, Pencarian 3,00×, Media Sosial 2,60×; Mitra tidak dapat diukur. Konversi: Email 12,5%, Pencarian dan Mitra 10%, Media Sosial 5%. Kampanye ini menawarkan tiga pembagian bersyarat.

Gemini 3,6 Flash

18,096 detik · 137 token masukan / 2.403 token keluaran · perkiraan $0,00911

Sistem tersebut menghasilkan peringkat yang sama serta penanganan kasus-kasus khusus, kemudian menawarkan efisiensi, diversifikasi, dan alokasi tes Mitra.

Apa yang ditunjukkan oleh hasil tersebut

Kedua perhitungan tersebut benar dan keduanya membuat rekomendasi tersebut bersifat bersyarat. Masing-masing menambahkan konteks spekulatif seputar pengeluaran nol dari Mitra, sehingga kalimat tersebut perlu dikonfirmasi sumbernya atau dihapus.

Kesimpulan tugas: Gemini 3.7 Flash, menang tipis. Kedua perhitungan tersebut benar, tetapi opsi 3,7 memberikan pembagian anggaran default yang lebih jelas dan jumlah token penyelesaian yang lebih sedikit.

Tes 6 — Perencanaan Berbasis Agen dan Penggunaan Alat

Masukan tugas: Buatlah rencana yang terdiri dari kurang dari 220 kata dengan hanya menggunakan empat alat yang disebutkan namanya. Hentikan jika halaman tersebut tidak tersedia, tidak resmi, atau ambigu, dan jangan mengklaim bahwa alat-alat tersebut telah dijalankan.

Gemini 3,7 Flash

10,787 detik · 100 token masukan / 1.174 token keluaran · perkiraan $0,00448

Keempat langkahnya berkorelasi satu-ke-satu dengan alat-alat yang disediakan, diikuti oleh tahap penilaian domain resmi, ketersediaan, dan kejelasan. Untuk menyelesaikannya, diperlukan tepat satu catatan CSV yang telah diverifikasi.

Gemini 3,6 Flash

9,702 detik · 100 token masukan / 1.328 token keluaran · perkiraan: $0,00506

Rencana tersebut dapat diterapkan, tetapi menambahkan “atau mengurai isi HTML,” suatu operasi yang tidak termasuk dalam daftar alat yang disediakan.

Apa yang ditunjukkan oleh hasil tersebut

Keduanya mematuhi aturan penghentian dari sumber resmi dan menghindari simulasi eksekusi alat-alat tersebut. Rencana 3.7 tetap lebih terikat pada fungsi-fungsi yang tersedia.

Hasil pertandingan: Seri. Kedua rencana tersebut mematuhi batasan yang ditetapkan oleh sumber resmi dan dihentikan tanpa menyatakan bahwa alat-alat tersebut telah dijalankan; kelebihan keduanya sedikit berbeda.

Tes 7 — Penulisan dan Penyuntingan untuk SEO

Masukan tugas: Hasilkan HTML yang hanya berisi satu paragraf dan satu daftar singkat, gunakan kata kunci yang tepat satu kali, serta pertahankan empat fakta yang sudah ditetapkan tanpa mengada-ada mengenai hasil, harga, tanggal rilis, atau klaim ketersediaan.

Gemini 3,7 Flash

7,263 detik · 125 token masukan / 707 token keluaran · perkiraan $0,00275

<p>Dalam ulasan Gemini 3.7 Flash yang akan datang ini, kami menganalisis model Google dengan membandingkan data benchmark resmi dengan hasil pengujian API yang menggunakan prompt yang sama; sementara itu, hasil pengujian langsung masih menunggu.</p>

Proses tersebut mengikuti struktur HTML, menggunakan kata kunci tersebut satu kali, dan mempertahankan klaim yang terkunci.

Gemini 3,6 Flash

7,542 detik · 125 token masukan / 833 token keluaran · perkiraan $0,00322

<p>Ulasan awal Gemini 3.7 Flash ini membahas model terbaru dari Google ... meskipun hasil pengujian langsung yang mendetail masih belum tersedia.</p>

Strukturnya sudah benar, tetapi frasa “model baru” menambahkan klaim yang berada di luar fakta-fakta yang telah ditetapkan.

Apa yang ditunjukkan oleh hasil tersebut

Perbedaan yang menentukan terletak pada keamanan klaim: 3.7 menolak penambahan deskriptor yang tidak didukung sambil tetap mengembalikan HTML ringkas yang valid.

Hasil tugas: Gemini 3.7 Flash. Kepatuhan terhadap fakta yang telah ditetapkan yang lebih baik.

Gemini 3.7 Lembar Penilaian Uji Flash dan Hal-Hal Penting yang Dapat Diambil

Perbandingan ini menunjukkan keunggulan Gemini 3.7 Flash dalam hal kualitas hasil akhir, namun selisih tersebut lebih disebabkan oleh kedisiplinan instruksi daripada adanya kesenjangan kemampuan yang signifikan. Gemini 3.6 Flash tetap kompetitif dalam hal kode dan aritmatika, serta menghasilkan rencana frontend yang lebih baik.

Lembar penilaian tes yang disesuaikan

UkuranGemini 3,7 FlashGemini 3,6 Flash
Kemenangan tugas32
Dasi berkualitas11
Tugas yang belum tuntas11
Tugas yang telah diselesaikan dan dapat digunakan6 dari 76 dari 7
Token keluaran tugas yang telah diselesaikan7,94810,058
Hasil pengamatan terbaikRencana agenik yang terbatasiRencana antarmuka pengguna berbasis teks

Gemini 3.7 Batasan Flash

Keterbatasan terbesar yang teramati sama pada kedua model: keduanya menghabiskan seluruh anggaran keluaran sebanyak dua kali pada permintaan sintesis penelitian sederhana yang terdiri dari 180 kata. T01 tidak dapat digunakan dalam konfigurasi yang diuji.

Gemini 3.7 Flash tidak secara keseluruhan lebih baik. Rencana bagian depannya mengandung kesalahan redaksional dan ketidaksesuaian antara tata letak internal dengan deskripsinya, sementara kedua jawaban data tersebut menimbulkan konteks spekulatif seputar saluran tanpa pengeluaran. Paket ini hanya menggunakan masukan teks, sehingga tidak menguji kualitas gambar, audio, video, atau konteks panjang yang sesungguhnya.

Apakah Gemini 3.7 Flash Layak Dibeli?

Ya, Gemini 3.7 Flash layak dicoba jika kepatuhan terhadap instruksi yang tepat menjadi hal yang penting. Model ini berhasil menyelesaikan tiga tugas dan menggunakan lebih sedikit token keluaran di seluruh enam pasangan yang dapat digunakan. Namun, keunggulannya kurang mencolok dalam hal perbaikan kode sederhana, perhitungan aritmatika, atau perancangan antarmuka pengguna, di mana Gemini 3.6 Flash berhasil memenangkan tugas frontend atau tetap bersaing ketat.

Anda dapat menjalankan perintah yang sama di GlobalGPT dan bandingkan dengan Gemini 3.6 Flash di ruang kerja yang sama. Gunakan tugas berulang Anda sebagai tolok ukur penentu.

Ulasan Singkat Gemini 3.7: Kesimpulan Akhir

Ulasan Gemini 3.7 Flash ini berakhir dengan hasil yang tipis namun dapat dibenarkan: Gemini 3.7 Flash memenangkan tiga tugas yang telah diselesaikan, Gemini 3.6 Flash memenangkan dua, dan satu berakhir imbang. Salah satu tugas penelitian tidak memberikan hasil yang pasti karena kedua model tersebut mencapai batas atas hasil yang sama sebanyak dua kali.

Gemini 3.6 Flash belum ketinggalan zaman. Versi ini menghasilkan rencana antarmuka teks yang lebih baik dan tabel status yang lebih teliti, sementara 3.7 lebih unggul dalam hal pemrograman, analisis data, dan pengeditan SEO berbasis fakta yang terkunci. Tugas perencanaan berbasis agen berakhir imbang, sehingga peningkatan ini bersifat selektif, bukan mutlak.

Gemini 3.7 Pertanyaan Umum tentang Flash

Kapan Gemini 3.7 Flash dirilis?

Google mencantumkan Gemini 3.7 Flash sebagai model yang stabil, dengan dokumentasi model yang terakhir diperbarui pada 13 Agustus 2026.

Apakah Gemini 3.7 Flash sudah stabil atau masih versi pratinjau?

Fitur ini tercantum sebagai "stabil" dalam dokumentasi model API Gemini Google. AI Studio, produk konsumen Gemini, dan rute pihak ketiga mungkin masih menampilkan ketersediaan atau kuota yang berbeda.

Apa ID model Gemini 3.7 Flash API?

Perbandingan yang diminta menggunakan `gemini-3.7-flash`, namun ID model yang dikembalikan harus dicatat dari respons API sebelum artikel akhir menyatakan bahwa model tersebut telah diverifikasi.

Berapa harga Gemini 3.7 Flash?

Tarif paket berbayar Google adalah $0,75 per 1 juta token masukan dan $3,75 per 1 juta token keluaran hingga 31 Desember 2026; mulai 1 Januari 2027, tarif yang tercantum menjadi $1,50/$7,50.

Apakah Gemini 3.7 Flash gratis?

Ketersediaan bagi konsumen atau pihak ketiga tidak berarti akses API gratis tanpa batas. Periksa rute, kuota, batasan laju, dan ketentuan penagihan untuk metode akses yang akan Anda gunakan.

Apa itu jendela konteks Gemini 3.7 Flash?

Ringkasan Analisis Buatan yang ditampilkan menunjukkan daftar konteks sebanyak 1 juta token. Silakan periksa batasan konteks resmi yang tepat serta ketentuan harga atau pembatasan fitur terkait konteks panjang dalam dokumentasi Google.

Apakah Gemini 3.7 Flash mendukung gambar, audio, video, dan PDF?

Periksa jenis masukan yang didukung untuk ID model API yang tepat. Dalam proses peninjauan ini, setiap modalitas yang didukung akan dianggap sebagai kemampuan yang terdokumentasi, bukan sebagai bukti bahwa kualitasnya sama di seluruh jenis masukan.

Apa itu tingkat pemikiran Gemini 3.7 Flash?

Gemini 3.7 Flash dilengkapi dengan kontrol pemikiran yang dapat dikonfigurasi. Tingkat yang tepat, pengaturan default, perilaku token, dan implikasi penagihan harus diambil dari dokumentasi API resmi.

Apakah Gemini 3.7 Flash lebih baik daripada Gemini 3.6 Flash?

Dalam uji API yang disesuaikan ini, Gemini 3.7 Flash memenangkan tiga tugas yang diselesaikan, Gemini 3.6 Flash memenangkan dua, satu berakhir seri, dan satu hasilnya tidak jelas. Hal ini menunjukkan keunggulan tipis bagi versi 3.7, bukan kemenangan mutlak.

Apakah Gemini 3.7 Flash lebih baik daripada Gemini 3.1 Pro?

Draf ini tidak membuat klaim tersebut. Gemini 3.1 Pro merupakan acuan perbandingan yang berbeda, sehingga memerlukan kumpulan prompt dan bukti yang sesuai untuknya sendiri, bukan kesimpulan yang diambil dari perbandingan Gemini 3.6 Flash.

Apakah Gemini 3.7 Flash cocok untuk pemrograman?

Ya, dalam tugas perbaikan bug yang terbatas yang diuji di sini. Kedua model menghasilkan patch minimal yang benar, tetapi Gemini 3.7 Flash unggul sedikit berkat cakupan pengujian yang lebih rapi dengan jumlah token penyelesaian yang lebih sedikit.

Apakah Gemini 3.7 Flash dapat menggunakan alat-alat dan menjalankan alur kerja agen?

Silakan periksa dokumentasi resmi mengenai alat dan pemanggilan fungsi untuk mengetahui rute yang tepat. Uji coba berbasis agen dalam ulasan ini mengevaluasi kemampuan perencanaan dan kesadaran akan batas; uji coba ini tidak menyatakan bahwa sebuah rencana saja sudah cukup untuk membuktikan keberhasilan pelaksanaan alat.

Di mana saya bisa mengakses Gemini 3.7 Flash?

Gunakan titik akses resmi Google jika tersedia, atau coba Halaman model GlobalGPT ketika fitur tersebut telah diaktifkan untuk akun dan wilayah Anda.

Apakah hasil pengujian standar resmi sesuai dengan hasil di dunia nyata?

Tidak secara otomatis. Tolok ukur resmi dan evaluasi pihak ketiga memberikan konteks yang berguna, sementara uji coba dengan prompt yang sama menunjukkan bagaimana suatu model menangani tugas tertentu yang sedang diukur. Ulasan ini membedakan kedua jenis bukti tersebut.

Bagikan Postingan:

Postingan Terkait