Gemini 3.7 Flash utamakan kelajuan dan kos rendah, bukan kedudukan nombor satu
Gemini 3.7 Flash dilancarkan pada 13 Ogos 2026 sebagai model “workhorse” Google untuk pengekodan, pembangunan web dan aliran kerja ejen AI. Harga API pengenalan ialah $0.75 bagi setiap sejuta token input dan $3.75 bagi setiap sejuta token output sehingga 31 Disember 2026; kadar ini meningkat kepada $1.50 dan $7.50 m...
Gemini 3.7 Flash dilancarkan pada 13 Ogos 2026 sebagai model “workhorse” Google untuk pengekodan, pembangunan web dan aliran kerja ejen AI.
Harga API pengenalan ialah $0.75 bagi setiap sejuta token input dan $3.75 bagi setiap sejuta token output sehingga 31 Disember 2026; kadar ini meningkat kepada $1.50 dan $7.50 mulai 1 Januari 2027.
Model ini mencatat skor Intelligence Index 56, kelajuan kira kira 340 token output sesaat, 95.5% pada ARC AGI 1 dan 84.6% pada ARC AGI 2.
Dakwaan Google bahawa Gemini 3.7 Flash ialah modelnya yang paling pantas berkembang masih belum dapat disahkan secara bebas kerana angka penggunaan tidak didedahkan.
What is Gemini 3.7 Flash, when did it launch, where is it available, and why does Google call it its fastest-growing model ever despite discGemini 3.7 Flash is positioned as Google’s fast, lower-cost workhorse for coding and agentic workflows.
AI Prompt
Create a landscape editorial hero image for this Studio Global article: What is Gemini 3.7 Flash, when did it launch, where is it available, and why does Google call it its fastest-growing model ever despite disc. Article summary: Gemini 3.7 Flash is Google’s production “workhorse” Gemini model for complex coding, web development, and tool-using agents. It launched on August 13, 2026, and is available through the Gemini API/AI Studio, Google Antig. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
openai.com
Gemini 3.7 Flash ialah model AI terbaharu Google yang direka sebagai “workhorse” untuk tugas pengekodan kompleks, pembangunan web, penggunaan alat dan aliran kerja ejen yang memerlukan beberapa langkah. Ia dilancarkan pada 13 Ogos 2026 dan tersedia melalui Gemini API, Google AI Studio, Google Antigravity serta Gemini Enterprise Agent Platform.
Tarikan utamanya bukan kerana ia mendahului semua penanda aras kecerdasan. Kekuatan Gemini 3.7 Flash terletak pada gabungan keupayaan yang menghampiri tahap termaju, kelajuan output yang sangat tinggi dan harga API awal yang rendah—gabungan yang menarik untuk pembangun yang menjalankan gelung ejen berulang pada skala besar.
Apa maksud Google apabila menyebut “paling pantas berkembang”?
Google menggambarkan Gemini 3.7 Flash sebagai modelnya yang paling pantas berkembang setakat ini. Namun, laporan yang tersedia tidak menyertakan angka yang diperlukan untuk menguji dakwaan itu. Tiada jumlah asas penggunaan, tempoh pengukuran, bilangan pembangun aktif, jumlah token atau model perbandingan yang dinamakan dalam bukti yang diberikan.
Kesimpulan yang lebih wajar adalah lebih terbatas: Google sedang meletakkan Flash sebagai model untuk penggunaan pantas dalam kalangan pembangun, manakala harga pengenalan yang rendah dan integrasinya merentas produk pembangun Google menyokong strategi tersebut. Dakwaan “paling pantas berkembang” wajar dianggap sebagai dakwaan syarikat yang belum disokong angka, bukannya statistik pasaran yang telah disahkan secara bebas.
Harga murah ketika pelancaran, tetapi berganda pada 2027
Kadar API pengenalan Gemini 3.7 Flash sehingga 31 Disember 2026 ialah:
Input: $0.75 bagi setiap sejuta token
Output, termasuk token penaakulan: $3.75 bagi setiap sejuta token
Studio Global AI
Continue your research
This page includes a source-backed answer you can continue inside Studio Global.
What is the short answer to "Gemini 3.7 Flash utamakan kelajuan dan kos rendah, bukan kedudukan nombor satu"?
Gemini 3.7 Flash dilancarkan pada 13 Ogos 2026 sebagai model “workhorse” Google untuk pengekodan, pembangunan web dan aliran kerja ejen AI.
What are the key points to validate first?
Gemini 3.7 Flash dilancarkan pada 13 Ogos 2026 sebagai model “workhorse” Google untuk pengekodan, pembangunan web dan aliran kerja ejen AI. Harga API pengenalan ialah $0.75 bagi setiap sejuta token input dan $3.75 bagi setiap sejuta token output sehingga 31 Disember 2026; kadar ini meningkat kepada $1.50 dan $7.50 mulai 1 Januari 2027.
What should I do next in practice?
Model ini mencatat skor Intelligence Index 56, kelajuan kira kira 340 token output sesaat, 95.5% pada ARC AGI 1 dan 84.6% pada ARC AGI 2.
Mulai 1 Januari 2027, kadar standard menjadi $1.50 bagi setiap sejuta token input dan $7.50 bagi setiap sejuta token output—tepat dua kali ganda harga pengenalan. Kadar diskaun atau gaya kelompok yang disenaraikan juga meningkat daripada $0.375/$1.875 kepada $0.75/$3.75 bagi setiap sejuta token input/output.
Tarikh tamat ini penting untuk perancangan sistem produksi. Kos sesuatu beban kerja yang kelihatan sangat murah ketika tempoh pelancaran perlu dikira semula menggunakan kadar 2027 sebelum pembangun memilih seni bina yang akan digunakan untuk jangka panjang.
Harga token juga hanya menggambarkan sebahagian daripada kos ejen sebenar. Perbelanjaan dalam penggunaan harian bergantung pada panjang konteks, panggilan alat, percubaan semula, input yang dicache, tahap penaakulan dan jumlah output. Kos yang diukur untuk satu penanda aras tidak sepatutnya dianggap sebagai harga pasti bagi keseluruhan aliran kerja produksi.
Kelajuan dan kecerdasan umum
Laporan bebas Artificial Analysis memberikan Gemini 3.7 Flash skor 56 pada Intelligence Index. Ini meletakkannya di atas Claude Sonnet 5 dengan skor 55, tetapi sedikit di bawah GPT-5.6 Terra yang mencatat 57 dalam perbandingan tersebut.
Kelajuan ialah pembezaan paling jelas bagi model ini. Artificial Analysis mengukur kira-kira 340 token output sesaat dan skor purata masa bagi setiap tugasan sebanyak 1.7, selain melaporkan bahawa Flash kira-kira 40% lebih pantas daripada GPT-5.6 Terra pada tahap penaakulan maksimum.
Angka ini merujuk kepada prestasi model atau penyedia yang diukur, bukan pengalaman universal bagi setiap aplikasi. Keadaan rangkaian, penghalaan penyedia, saiz prompt, kependaman alat dan tetapan penaakulan boleh mengubah masa tindak balas dari hujung ke hujung.
Prestasi pengekodan dan aliran kerja ejen
Google melaporkan peningkatan ketara berbanding Gemini 3.6 Flash dalam kejuruteraan perisian, penyahpepijatan, penyelesaian isu, pembangunan web dan aliran kerja ejen. Antara keputusan pengekodan yang dipetik ialah:
43.6% pada FrontierCode 1.1 Main, meningkat daripada 34.4% bagi Gemini 3.6 Flash.
1,588 Elo dalam Code Arena untuk pembangunan web.
85.8% pada Terminal-Bench 2.1, berbanding 80.4% bagi Claude Sonnet 5 dan 87.4% bagi GPT-5.6 Terra dalam perbandingan Google.
Keputusan ini menunjukkan bahawa Flash ialah model yang berkebolehan untuk pengekodan dan ejen terminal, tetapi bukan pemenang dalam semua kategori. GPT-5.6 Terra masih mendahului keputusan Terminal-Bench yang dipetik, manakala kelebihan Flash ialah kelajuan dan kos pengenalan yang lebih rendah.
Prestasi ARC-AGI dan kos setiap tugasan
Pada tahap usaha penaakulan tinggi, ARC Prize melaporkan bahawa Gemini 3.7 Flash mencatat:
95.5% pada ARC-AGI-1 Semi-Private, dengan kos $0.12 setiap tugasan
84.6% pada ARC-AGI-2 Semi-Private, dengan kos $0.25 setiap tugasan
Ini ialah keputusan yang kukuh, khususnya berdasarkan kos setiap tugasan yang dilaporkan. Namun, prestasi ARC-AGI harus dilihat sebagai petunjuk penanda aras, bukan ramalan langsung tentang kebolehpercayaan ejen perisian. Ejen dalam produksi mungkin membuat beberapa panggilan model, menggunakan alat luaran, mengulangi tindakan yang gagal dan memproses konteks yang jauh lebih besar berbanding tugasan penanda aras.
Perbandingan dengan model pesaing
Model
Harga input/output yang disenaraikan bagi setiap 1 juta token
Kedudukan berdasarkan bukti tersedia
Gemini 3.7 Flash
$0.75 / $3.75 untuk harga pengenalan
Intelligence Index 56; kira-kira 340 token output sesaat; direka untuk pengekodan dan aliran kerja ejen berkelajuan tinggi.
GPT-5.6 Terra
$2 / $12
Intelligence Index 57 dan keputusan Terminal-Bench yang lebih tinggi, tetapi lebih perlahan serta lebih mahal pada kadar yang disenaraikan.
Claude Sonnet 5
$2 / $10
Pesaing rapat dalam pengekodan dan ejen produksi dengan skor Intelligence Index 55 dalam perbandingan yang dipetik.
Claude Opus 5
$5 / $25
Model lebih mahal yang disasarkan kepada tugas pengekodan ejen yang lebih sukar.
Qwen3.8-Max
$2 / $6
Laporan mencatat 67.7 pada SWE-bench Pro dan 86.6 pada Terminal-Bench 2.1; kadar tokennya lebih tinggi berbanding harga pengenalan Flash.
GLM-5.3
$1.40 / $4.40
Hampir dengan Flash dari segi harga token utama, tetapi bukti tersedia tidak menyediakan perbandingan kecerdasan bebas atau kos setiap tugasan yang benar-benar setara.
Nemotron 3.5 Lightning
$0.05 / $0.20 untuk kadar hos yang disenaraikan
Jauh lebih murah dari segi harga token nominal, tetapi bukti yang tersedia tidak mencukupi untuk perbandingan penanda aras yang setara dengan Flash.
Jadual ini bukan papan pendahuluan mutlak. Penanda aras datang daripada penilaian yang berbeza dan sumber tersedia tidak membuktikan bahawa semua model diuji dalam satu ujian terkawal yang sama. Harga juga mungkin mencerminkan keadaan pengehosan, diskaun atau ketersediaan yang berbeza.
Pertaruhan strategik Google: jumlah pemprosesan mengatasi skor tertinggi
Perbandingan yang tersedia menunjukkan pilihan kedudukan yang disengajakan. Gemini 3.7 Flash berada hampir dengan tahap termaju berdasarkan Intelligence Index yang dipetik, tetapi tidak mendakwa skor tertinggi: GPT-5.6 Terra sedikit mendahuluinya dengan skor 57 dan turut mengatasi Flash dalam perbandingan Terminal-Bench yang dipetik.
Sebaliknya, Google menekankan pertukaran antara kecerdasan, kependaman dan kos. Model yang cukup pantas untuk pembangunan interaktif serta cukup murah untuk membuat panggilan berulang boleh menjadi lebih berguna kepada platform ejen berbanding model yang lebih perlahan dan mahal, walaupun model terakhir memenangi penanda aras tertentu.
Perkara ini penting untuk pembantu pengekodan, penyelesaian isu secara automatik, ejen pembangunan web dan aliran kerja yang berulang kali membaca konteks, memanggil alat, memeriksa keputusan dan mencuba semula.
Dalam gelombang pelancaran model pada Ogos 2026, pertukaran ini menjadi semakin penting. Qwen3.8-Max menambah persaingan dalam ejen dan kejuruteraan perisian, manakala GLM-5.3 dan Nemotron 3.5 Lightning menekan aspek harga serta kecekapan. Claude Opus 5 dan GPT-5.6 pula menyasarkan keupayaan peringkat lebih tinggi.
Kesimpulan
Gemini 3.7 Flash paling tepat difahami sebagai model “workhorse” berkapasiti tinggi, bukannya model paling pintar yang tidak dapat ditandingi. Kes terbaik untuknya ialah gabungan skor Intelligence Index 56, penjanaan kira-kira 340 token sesaat, keputusan pengekodan dan ejen terminal yang kukuh serta harga pengenalan yang sangat rendah.
Bagi pembangun, peringatan utama lebih berkaitan kewangan berbanding teknikal: kadar pelancaran $0.75/$3.75 tamat pada 31 Disember 2026, sebelum kadar standard $1.50/$7.50 bermula pada hari berikutnya.
Dakwaan pertumbuhan Google mungkin terbukti benar kelak. Namun, tanpa angka penggunaan yang menyokongnya, bukti semasa lebih kukuh menyokong satu strategi—menjadikan inferens pantas dan berpatutan sebagai pilihan lalai untuk penggunaan pembangun berskala besar—bukannya rekod penggunaan model yang telah disahkan.
eesel.ai
Gemini 3.7 Flash review: benchmarks, real pricing, and the ...