Gemini 3.7 Flash Mengandalkan Kecepatan dan Biaya Rendah, Bukan Gelar Model Terpintar
Gemini 3.7 Flash diluncurkan pada 13 Agustus 2026 sebagai model workhorse Google untuk coding, pengembangan web, dan workflow agen. Harga API perkenalannya adalah US$0,75 per juta token input dan US$3,75 per juta token output hingga 31 Desember 2026.
Gemini 3.7 Flash diluncurkan pada 13 Agustus 2026 sebagai model workhorse Google untuk coding, pengembangan web, dan workflow agen.
Harga API perkenalannya adalah US$0,75 per juta token input dan US$3,75 per juta token output hingga 31 Desember 2026.
Model ini mencatat skor Intelligence Index 56 dan kecepatan sekitar 340 token output per detik—unggul dalam kombinasi kecepatan dan biaya, tetapi bukan pemimpin semua benchmark.
Klaim Google bahwa Gemini 3.7 Flash adalah model dengan pertumbuhan tercepat belum dapat diverifikasi secara independen karena tidak ada angka basis pengguna, periode pertumbuhan, volume token, atau pembanding yang di...
What is Gemini 3.7 Flash, when did it launch, where is it available, and why does Google call it its fastest-growing model ever despite discGemini 3.7 Flash is positioned as Google’s fast, lower-cost workhorse for coding and agentic workflows.
AI Perintah
Create a landscape editorial hero image for this Studio Global article: What is Gemini 3.7 Flash, when did it launch, where is it available, and why does Google call it its fastest-growing model ever despite disc. Article summary: Gemini 3.7 Flash is Google’s production “workhorse” Gemini model for complex coding, web development, and tool-using agents. It launched on August 13, 2026, and is available through the Gemini API/AI Studio, Google Antig. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
openai.com
Gemini 3.7 Flash adalah model produksi terbaru Google yang diposisikan sebagai workhorse untuk coding kompleks, pengembangan web, penggunaan tool, dan workflow agen multi-langkah. Model ini diluncurkan pada 13 Agustus 2026 dan tersedia melalui Gemini API, Google AI Studio, Google Antigravity, serta Gemini Enterprise Agent Platform.
Daya tarik utamanya bukan klaim sebagai model dengan kecerdasan tertinggi di semua pengujian. Gemini 3.7 Flash lebih menonjol lewat perpaduan kemampuan yang mendekati model frontier, kecepatan output sangat tinggi, dan harga API awal yang rendah—kombinasi yang menarik bagi developer yang menjalankan loop agen berulang dalam skala besar.
Apa arti klaim “pertumbuhan tercepat” Google?
Google menyebut Gemini 3.7 Flash sebagai model dengan pertumbuhan tercepat dalam sejarahnya. Namun, data yang tersedia tidak memuat angka yang diperlukan untuk menguji klaim tersebut. Google tidak mengungkap basis penggunaan, periode pengukuran, jumlah developer aktif, volume token, maupun model pembanding.
Kesimpulan yang lebih aman adalah bahwa Google sedang memosisikan Flash untuk mendorong adopsi developer secara cepat. Harga perkenalan yang rendah dan integrasinya ke berbagai produk developer Google mendukung strategi itu. Namun, predikat “pertumbuhan tercepat” masih sebaiknya diperlakukan sebagai klaim perusahaan yang belum terukur secara independen, bukan statistik pasar yang telah terbukti.
Harga murah saat peluncuran, tetapi naik dua kali lipat pada 2027
Tarif API perkenalan Gemini 3.7 Flash hingga 31 Desember 2026 adalah:
Input: US$0,75 per juta token
Output, termasuk token untuk proses berpikir: US$3,75 per juta token
Studio Global AI
Lanjutkan penelitian Anda
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Apa jawaban singkat untuk "Gemini 3.7 Flash Mengandalkan Kecepatan dan Biaya Rendah, Bukan Gelar Model Terpintar"?
Gemini 3.7 Flash diluncurkan pada 13 Agustus 2026 sebagai model workhorse Google untuk coding, pengembangan web, dan workflow agen.
Apa poin penting yang harus divalidasi terlebih dahulu?
Gemini 3.7 Flash diluncurkan pada 13 Agustus 2026 sebagai model workhorse Google untuk coding, pengembangan web, dan workflow agen. Harga API perkenalannya adalah US$0,75 per juta token input dan US$3,75 per juta token output hingga 31 Desember 2026.
Apa yang harus saya lakukan selanjutnya dalam latihan?
Model ini mencatat skor Intelligence Index 56 dan kecepatan sekitar 340 token output per detik—unggul dalam kombinasi kecepatan dan biaya, tetapi bukan pemimpin semua benchmark.
Mulai 1 Januari 2027, tarif standar menjadi US$1,50 per juta token input dan US$7,50 per juta token output—tepat dua kali lipat dari harga perkenalan. Tarif diskon atau model batch juga naik dari US$0,375/US$1,875 menjadi US$0,75/US$3,75 per juta token input/output.
Tanggal berakhirnya harga perkenalan ini penting bagi perencanaan produksi. Workflow yang terlihat sangat murah pada masa peluncuran perlu dihitung ulang menggunakan tarif 2027 sebelum dipakai sebagai dasar arsitektur jangka panjang.
Harga token juga hanya menggambarkan sebagian dari biaya agen. Pengeluaran aktual dipengaruhi panjang konteks, jumlah pemanggilan tool, percobaan ulang, input yang tersimpan di cache, tingkat penalaran, dan panjang output. Karena itu, biaya per benchmark tidak boleh dianggap sebagai jaminan biaya untuk keseluruhan workflow produksi.
Kecepatan menjadi pembeda utama
Dalam laporan Artificial Analysis yang dikutip, Gemini 3.7 Flash memperoleh skor 56 pada Intelligence Index. Angka ini berada di atas Claude Sonnet 5 dengan skor 55, tetapi sedikit di bawah GPT-5.6 Terra dengan skor 57.
Kecepatan adalah keunggulan paling jelas dari Flash. Artificial Analysis mengukur sekitar 340 token output per detik dan skor rata-rata waktu per tugas sebesar 1,7. Laporan tersebut menyebut Flash sekitar 40% lebih cepat daripada GPT-5.6 Terra pada tingkat penalaran maksimum.
Angka tersebut menggambarkan performa model atau penyedia yang diukur, bukan pengalaman universal di setiap aplikasi. Kondisi jaringan, routing penyedia, ukuran prompt, latensi tool, dan pengaturan penalaran dapat mengubah waktu respons dari ujung ke ujung.
Performa coding dan workflow agen
Google melaporkan peningkatan besar dibandingkan Gemini 3.6 Flash dalam rekayasa perangkat lunak, debugging, penyelesaian masalah, pengembangan web, dan workflow agen. Hasil coding yang dikutip mencakup:
43,6% pada FrontierCode 1.1 Main, naik dari 34,4% pada Gemini 3.6 Flash.
1.588 Elo di Code Arena untuk pengembangan web.
85,8% pada Terminal-Bench 2.1, dibandingkan 80,4% untuk Claude Sonnet 5 dan 87,4% untuk GPT-5.6 Terra dalam perbandingan Google.
Hasil ini menunjukkan bahwa Gemini 3.7 Flash adalah model yang mumpuni untuk coding dan agen terminal, tetapi bukan pemenang di semua kategori. GPT-5.6 Terra masih unggul pada hasil Terminal-Bench yang dikutip, sedangkan kelebihan Flash terletak pada kecepatan dan harga awal yang lebih rendah.
ARC-AGI: skor tinggi dengan biaya per tugas rendah
Pada tingkat upaya penalaran tinggi, ARC Prize melaporkan Gemini 3.7 Flash mencatat:
95,5% pada ARC-AGI-1 Semi-Private, dengan biaya US$0,12 per tugas
84,6% pada ARC-AGI-2 Semi-Private, dengan biaya US$0,25 per tugas
Hasil ini kuat, terutama jika mempertimbangkan biaya per tugas yang dilaporkan. Meski demikian, performa ARC-AGI sebaiknya dibaca sebagai sinyal benchmark, bukan ramalan langsung tentang keandalan agen software.
Agen produksi dapat melakukan beberapa panggilan model, menggunakan tool eksternal, mengulang tindakan yang gagal, dan memproses konteks yang jauh lebih besar daripada tugas benchmark. Biaya aktualnya bisa sangat berbeda.
Perbandingan dengan model pesaing
Model
Harga input/output per 1 juta token
Posisi berdasarkan bukti yang tersedia
Gemini 3.7 Flash
US$0,75 / US$3,75 untuk harga perkenalan
Intelligence Index 56; sekitar 340 token output per detik; dirancang untuk coding dan workflow agen ber-throughput tinggi.
GPT-5.6 Terra
US$2 / US$12
Intelligence Index 57 dan hasil Terminal-Bench lebih tinggi, tetapi lebih lambat dan lebih mahal pada tarif yang tercantum.
Claude Sonnet 5
US$2 / US$10
Pesaing dekat untuk coding dan agen produksi, dengan skor Intelligence Index yang dikutip sebesar 55.
Claude Opus 5
US$5 / US$25
Model yang lebih mahal dan diposisikan untuk pekerjaan coding agen yang lebih sulit.
Qwen3.8-Max
US$2 / US$6
Dilaporkan mencatat 67,7 pada SWE-bench Pro dan 86,6 pada Terminal-Bench 2.1; tarif tokennya lebih tinggi daripada harga perkenalan Flash.
GLM-5.3
US$1,40 / US$4,40
Berdekatan dengan Flash dari sisi harga utama, tetapi bukti yang tersedia belum cukup untuk perbandingan independen yang setara dalam kecerdasan atau biaya per tugas.
Nemotron 3.5 Lightning
US$0,05 / US$0,20 untuk tarif hosted yang tercantum
Jauh lebih murah secara nominal, tetapi bukti yang tersedia belum cukup untuk perbandingan benchmark yang setara dengan Flash.
Tabel ini bukan papan peringkat universal. Benchmark berasal dari evaluasi yang berbeda-beda, dan sumber yang tersedia tidak menunjukkan satu pengujian terkendali yang membandingkan semua model. Harga juga dapat mencerminkan perbedaan hosting, diskon, atau ketersediaan.
Strategi Google: throughput, bukan skor tertinggi
Perbandingan yang tersedia menunjukkan pilihan posisi yang cukup jelas. Gemini 3.7 Flash berada dekat dengan frontier pada Intelligence Index, tetapi tidak mencatat skor tertinggi: GPT-5.6 Terra sedikit lebih tinggi dengan skor 57 dan juga memimpin perbandingan Terminal-Bench yang dikutip.
Google justru menekankan keseimbangan antara kecerdasan, latensi, dan biaya. Model yang cukup cepat untuk pengembangan interaktif dan cukup murah untuk dipanggil berulang kali bisa lebih berguna bagi platform agen daripada model yang lebih mahal dan lambat tetapi hanya unggul pada benchmark tertentu.
Hal ini penting untuk asisten coding, penyelesaian masalah otomatis, agen pengembangan web, dan workflow yang berulang kali membaca konteks, memanggil tool, memeriksa hasil, lalu mencoba lagi.
Gelombang rilis model pada Agustus 2026 membuat pertukaran tersebut semakin relevan. Qwen3.8-Max menghadirkan persaingan kuat di bidang agen dan rekayasa perangkat lunak. GLM-5.3 dan Nemotron 3.5 Lightning menekan dari sisi harga dan efisiensi, sementara Claude Opus 5 dan GPT-5.6 menyasar kemampuan kelas atas.
Kesimpulan
Gemini 3.7 Flash paling tepat dipahami sebagai workhorse ber-throughput tinggi, bukan model terpintar yang tidak terbantahkan. Kasus terkuatnya adalah kombinasi skor Intelligence Index 56, generasi sekitar 340 token per detik, hasil coding dan agen terminal yang solid, serta harga perkenalan yang sangat rendah.
Bagi developer, catatan terpentingnya justru bersifat finansial. Tarif US$0,75 untuk input dan US$3,75 untuk output hanya berlaku sampai 31 Desember 2026. Mulai hari berikutnya, tarif standar menjadi US$1,50 dan US$7,50.
Klaim Google soal pertumbuhan tercepat mungkin saja benar, tetapi tanpa angka penggunaan pendukung, bukti yang ada baru menunjukkan strategi untuk menjadikan inferensi cepat dan terjangkau sebagai pilihan default bagi workflow developer—belum membuktikan rekor adopsi model.
eesel.ai
Gemini 3.7 Flash review: benchmarks, real pricing, and the ...