Google mengumumkan Gemini 4 Argon pada 30 September sebagai model utama dalam generasi baharu Gemini 4. Ia direka untuk tugasan berpanjangan seperti kejuruteraan perisian, kerja profesional dalam bidang undang-undang dan kewangan, serta pertahanan keselamatan siber. Pengumuman ini menandakan kemunculan model AI termaju Google yang seterusnya selepas beberapa bulan tertangguh, tetapi Argon belum tersedia secara meluas kepada orang ramai.
1
11
14
Apa yang Google mahu Argon lakukan?
Google menyasarkan Argon untuk aliran kerja rumit yang memerlukan beberapa langkah dan tumpuan berterusan—bukan sekadar menjawab soalan ringkas. Antara bidang yang disebut ialah pembangunan perisian, tugas profesional dan pertahanan siber.
11
Menurut Google, juruteranya sudah menggunakan Argon untuk kerja seperti menyahpepijat perisian dan memindahkan pangkalan kod. Ini memberi gambaran tentang tugasan yang mahu disokong oleh model tersebut, tetapi penggunaan dalaman itu bukan penilaian prestasi bebas.
3
10
Skor penanda aras: menjanjikan, tetapi ada batasnya
Google melaporkan skor 77.9% pada DeepSWE v1.1, penanda aras bagi tugasan kejuruteraan perisian yang memerlukan kerja berpanjangan. Syarikat itu juga berkata Argon memperoleh 68% pada CWE-bench v1, sekali gus berkongsi tempat pertama dalam penanda aras berkaitan pembaikan kelemahan keselamatan.
9
10
22
Angka ini ialah keputusan yang dilaporkan Google untuk penanda aras tertentu. Ia bukan bukti bahawa Argon mengatasi semua model lain dalam setiap tugas pengekodan atau kerja keselamatan siber di dunia sebenar. Maklumat yang tersedia juga tidak menunjukkan bahawa Argon terbaik untuk semua jenis tugasan.
10
22
Apa makna had output sejuta token?
Had output maksimum Argon meningkat daripada 64,000 kepada 1 juta token, menurut pengumuman Google dan laporan tentang pelancarannya. Secara ringkas, ini memberi model ruang untuk menghasilkan respons yang jauh lebih panjang dalam satu output—sesuatu yang mungkin berguna bagi tugasan yang menghasilkan banyak kod atau dokumen terperinci.
3
4
22
Penting untuk membezakan output daripada input: sejuta token ialah had jumlah yang boleh dijana oleh model, bukan jumlah teks atau kod yang boleh diberikan kepadanya. Had output yang lebih tinggi membolehkan hasil lebih panjang, tetapi tidak dengan sendirinya membuktikan bahawa model lebih tepat atau lebih baik untuk setiap tugasan.
Siapa boleh menggunakan Gemini 4 Argon sekarang?
Ketika pelancaran, akses di luar Google dihadkan kepada kumpulan pakar pertahanan siber yang disaring melalui Program Fairwind. Google menyatakan pelancaran berperingkat itu bertujuan mengurus penggunaan model dengan keupayaan pertahanan siber yang canggih.
2
10
11
Google merancang untuk meluaskan akses kepada pelanggan API berbayar dan pelanggan Google AI Ultra. Namun, laporan yang tersedia tidak menyatakan tarikh tetap untuk peluasan itu. Buat masa ini, Argon lebih tepat digambarkan sebagai model yang sudah diumumkan dan sedang diperkenalkan secara terhad—belum tersedia kepada umum.
5
6
23
Mengapa pelancaran ini penting?
Argon penting kerana ia model termaju baharu Google selepas kelewatan dalam rancangan AI generasi seterusnya. Google mengetengahkan penanda aras pengekodan dan keselamatan siber untuk menunjukkan kemampuan model itu, sambil mengehadkan akses awal kepada kumpulan pakar pertahanan siber.
1
14
Buat masa ini, perkara paling jelas ialah kegunaan yang disasarkan, had outputnya yang besar dan keputusan penanda aras yang dilaporkan Google. Penilaian lebih menyeluruh hanya akan dapat dibuat apabila akses diperluas dan lebih ramai pengguna bebas mencubanya dalam pelbagai tugasan.