Google mengumumkan Gemini 4 Argon pada 30 September 2026 sebagai model unggulan pertama dalam generasi Gemini 4. Model ini ditujukan untuk pekerjaan yang membutuhkan banyak langkah dan waktu, seperti rekayasa perangkat lunak, pekerjaan profesional di bidang hukum dan keuangan, serta pertahanan siber. Pengumumannya juga menandai hadirnya model AI frontier terbaru Google setelah rencana generasi berikutnya sempat tertunda berbulan-bulan. Namun, Argon belum tersedia secara luas untuk publik.
1
11
14
Dirancang untuk pekerjaan yang panjang dan kompleks
Google memosisikan Argon untuk menangani alur kerja yang tidak selesai dalam satu instruksi singkat. Contohnya mencakup pekerjaan rekayasa perangkat lunak, riset dan tugas profesional di bidang hukum atau keuangan, serta pertahanan siber.
11
Google menyebut para insinyurnya sudah menggunakan Argon untuk menelusuri bug dan memigrasikan basis kode. Penggunaan internal ini memberi gambaran tentang jenis pekerjaan yang ingin ditangani model tersebut, tetapi bukan evaluasi independen atas kinerjanya.
3
10
Hasil benchmark yang dilaporkan Google
Menurut Google, Argon memperoleh 77,9% pada DeepSWE v1.1, benchmark untuk tugas rekayasa perangkat lunak jangka panjang. Google juga melaporkan skor 68% pada CWE-bench v1, yang mengukur kemampuan memperbaiki kerentanan keamanan; pada benchmark ini, Argon diklaim berbagi posisi pertama.
9
10
22
Angka-angka itu merujuk pada hasil di benchmark tertentu dan berasal dari laporan Google. Hasil tersebut tidak otomatis berarti Argon selalu unggul dalam semua pekerjaan coding, semua model pembanding, atau penanganan keamanan siber di dunia nyata.
10
22
Apa arti batas output 1 juta token?
Batas output maksimum Argon naik dari 64.000 menjadi 1 juta token, menurut pengumuman Google dan laporan peluncurannya. Dengan batas lebih tinggi, model dapat menghasilkan respons yang jauh lebih panjang dalam satu kali keluaran—berguna untuk pekerjaan yang menghasilkan banyak kode atau dokumen terperinci.
3
4
22
Namun, batas ini mengukur seberapa banyak teks yang dapat dihasilkan model, bukan seberapa banyak teks atau kode yang dapat diterima sebagai input. Batas output yang lebih besar memungkinkan hasil lebih panjang, tetapi dengan sendirinya tidak membuktikan bahwa model bernalar lebih akurat atau lebih baik untuk setiap tugas.
Siapa yang bisa menggunakan Argon sekarang?
Pada tahap awal, akses di luar Google dibatasi untuk pakar pertahanan siber terpilih melalui Fairwind Program. Google menyatakan peluncurannya dilakukan secara bertahap untuk model dengan kemampuan pertahanan siber tingkat lanjut.
2
10
11
Google berencana memperluas akses kepada pelanggan API berbayar dan pelanggan Google AI Ultra. Belum ada tanggal pasti untuk tahap tersebut dalam laporan yang tersedia, sehingga Argon saat ini lebih tepat disebut sedang memasuki akses terbatas—belum tersedia umum.
5
6
23
Peluncuran penting, tetapi dampaknya masih perlu diuji
Argon menjadi model frontier terbaru Google setelah penundaan dalam rencana AI generasi berikutnya. Google menyoroti hasil benchmark coding dan keamanan siber untuk menunjukkan kemampuan model, sembari membatasi akses awal kepada kelompok pakar keamanan siber.
1
14
Untuk sekarang, hal paling jelas adalah sasaran penggunaan Argon, batas outputnya yang tinggi, dan klaim benchmark dari Google. Dampaknya dalam pemakaian yang lebih luas baru akan lebih mudah dinilai setelah akses diperluas dan pengguna independen dapat mengujinya dalam beragam tugas.