Gemini 4 Argon diumumkan pada 30 September sebagai model utama Google untuk tugasan kompleks, termasuk kejuruteraan perisian, kerja undang undang dan kewangan serta keselamatan siber. Google melaporkan keputusan yang kukuh berbanding beberapa model OpenAI dan Anthropic dalam penanda aras terpilih, tetapi kebanyakan...
Diterbitkan olehDisunting dengan GPT-6 LunaImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Google announce about Argon, its new flagship model for the Gemini 4 generation, and how does its size, intended use, benchmark per. Article summary: Google announced **Gemini 4 Argon** on September 30 as its new flagship model, but not as a general public release. It is a bid to regain ground against OpenAI and Anthropic after delays to Google’s previous flagship pla. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Google mengumumkan Gemini 4 Argon pada 30 September sebagai model utama bagi generasi Gemini 4. Model ini direka untuk tugasan kompleks dan berjangka panjang—daripada kejuruteraan perisian hingga kerja undang-undang, kewangan dan keselamatan siber. Namun, buat masa ini Google hanya memberikannya kepada kumpulan pakar pertahanan siber terpilih, bukan kepada orang ramai. 9
Pelancaran ini hadir selepas rancangan Google untuk model utamanya sebelum ini tertangguh. Argon dikatakan lebih besar daripada model Pro termaju Google terdahulu, manakala keputusan penanda aras yang diterbitkan syarikat itu menunjukkan prestasi yang kukuh berbanding beberapa sistem OpenAI dan Anthropic. Tetapi selagi akses masih terhad, kebanyakan pembangun dan perniagaan belum dapat menilai sendiri sejauh mana dakwaan itu mencerminkan penggunaan sebenar. 6
Google menyifatkan Argon sebagai modelnya yang paling berkemampuan setakat ini untuk beban kerja kompleks. Antara kegunaan yang disasarkan ialah tugasan kejuruteraan perisian yang mengambil masa panjang, kerja pengetahuan perusahaan seperti urusan undang-undang dan kewangan, serta pertahanan keselamatan siber. Google berkata model ini lebih besar daripada model Pro peringkat tertingginya yang terdahulu. Namun, sumber yang tersedia tidak menyatakan jumlah parameter Argon. 9
Jadi, istilah “lebih besar” di sini bersifat perbandingan, bukannya ukuran tepat saiz model. Saiz semata-mata juga tidak menentukan kos, kelajuan atau prestasi model untuk sesuatu tugasan tertentu.
Dalam perbandingan yang diterbitkan Google, Argon memperoleh 68.9% dalam Vals Index bagi kerja pengetahuan. Sebagai perbandingan, GPT-6 Astra daripada OpenAI mendapat 63.1%, manakala Claude Opus 5.5 daripada Anthropic mencatat 67.0%. Bagi AutomationBench, Google melaporkan skor Argon sebanyak 51.3%, berbanding 41.4% untuk Astra dan 42.5% untuk Opus 5.5.
Google turut melaporkan skor 77.9% dalam DeepSWE v1.1, ujian yang menilai keupayaan model menangani tugasan kejuruteraan perisian berjangka panjang. Bagi perbandingan keselamatan siber pula, laporan menyebut Argon seri di tempat pertama dalam satu ukuran—bukan mendahului semua pesaing dalam setiap ujian. 3
7
Angka ini memberikan gambaran tentang prestasi yang didakwa Google, tetapi ia ialah keputusan penanda aras terpilih, bukannya penentu muktamad kualiti keseluruhan model. Akses yang masih terhad juga menyukarkan kebanyakan pengguna untuk membuat penilaian bebas. 6
Google mula memberikan akses kepada pakar pertahanan keselamatan siber yang disaring melalui Program Fairwind. Menurut syarikat itu, pelancaran terhad ini bertujuan membolehkan pihak pertahanan menggunakan model tersebut sambil mengurangkan risiko penyalahgunaan. Google juga menyertai proses sukarela kerajaan AS bagi akses kepada model sebelum pelancaran umum. 6
5
Argon belum tersedia secara meluas kepada pembangun, perniagaan atau pengguna biasa. Laporan yang dirujuk juga tidak menyatakan tarikh tetap untuk akses umum. 6 Pelancaran berhati-hati ini menyerupai akses terhad Anthropic kepada Claude Mythos Preview, menurut laporan mengenai langkah tersebut, tetapi maklumat yang tersedia tidak mencukupi untuk membandingkan kedua-dua program secara terperinci.
6
Rancangan Google untuk Gemini 3.5 Pro tertangguh ketika syarikat itu berusaha meningkatkan keupayaan model, khususnya dalam pengekodan, menurut laporan yang memetik individu yang mengetahui perkara tersebut. Google kemudian beralih kepada Gemini 4 Argon dan bukannya melancarkan Gemini 3.5 Pro.
Latar belakang ini menjadikan Argon penting dalam usaha Google bersaing: syarikat itu kini memperkenalkan model utama baharu selepas pesaing seperti OpenAI dan Anthropic memajukan model termaju masing-masing. Namun, laporan yang tersedia mengaitkan kelewatan Gemini 3.5 Pro dengan usaha meningkatkan keupayaan model; ia tidak mengesahkan bahawa perubahan organisasi tertentu di DeepMind menjadi puncanya.
Google turut menonjolkan kelebihan kos modelnya sebagai sebahagian daripada cara syarikat itu bersaing. Ini memberi Google satu lagi sudut persaingan selain keputusan penanda aras. Namun, sumber yang dirujuk tidak mengesahkan bahawa Argon sendiri mempunyai kelebihan kos berbanding model utama pesaingnya.
Buat masa ini, gambaran paling jelas ialah Google melaporkan keputusan yang kukuh dalam beberapa penanda aras untuk pengekodan dan kerja perusahaan, sambil mengehadkan akses ketika model itu dinilai. Sama ada keputusan tersebut akan memberikan kelebihan dalam penggunaan harian—dan bagaimana kos Argon dibandingkan dengan pesaing—masih belum dapat dipastikan sehingga lebih ramai pengguna boleh mengujinya. 6
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Gemini 4 Argon diumumkan pada 30 September sebagai model utama Google untuk tugasan kompleks, termasuk kejuruteraan perisian, kerja undang undang dan kewangan serta keselamatan siber.
Gemini 4 Argon diumumkan pada 30 September sebagai model utama Google untuk tugasan kompleks, termasuk kejuruteraan perisian, kerja undang undang dan kewangan serta keselamatan siber. Google melaporkan keputusan yang kukuh berbanding beberapa model OpenAI dan Anthropic dalam penanda aras terpilih, tetapi kebanyakan pengguna belum boleh mengujinya sendiri.
Buat masa ini, akses diberikan kepada pakar keselamatan siber yang disaring melalui Program Fairwind; Google belum menetapkan tarikh pelancaran umum.