Sesetengah pekerja berkata keputusan penanda aras Gemini 4 Argon tidak semestinya mencerminkan prestasinya dalam tugasan pengekodan praktikal, termasuk pembangunan bahagian hadapan. Pandangan pekerja tentang kemajuan Gemini 4 berbanding Fable dan Astra berbeza beza; rancangan Gemini 3.5 Pro yang dibatalkan turut men...
Diterbitkan olehDisunting dengan GPT-6 LunaImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: Why are some Google employees questioning the forthcoming Gemini 4 model’s real-world coding ability despite strong benchmark scores, how do. Article summary: Some employees say Gemini 4 Argon’s strong benchmark scores do not match their experience using it for actual coding work, particularly certain tasks and front-end design. That is a reported internal assessment, not a se. Topic tags: general, general web, news, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Gemini 4 Argon menerima dua penilaian berbeza. Google mengetengahkan keputusan cemerlang model itu dalam beberapa penanda aras, manakala sesetengah pekerja dilaporkan mendapati prestasinya kurang konsisten apabila digunakan untuk kerja pengekodan sebenar. Perbezaan ini wajar diberi perhatian, tetapi laporan yang tersedia menunjukkan pandangan dalaman yang bercampur-campur—bukan kesepakatan bahawa Gemini 4 ketinggalan berbanding pesaingnya. 11
Google berkata Gemini 4 mencatat keputusan terkemuka dalam beberapa ujian penanda aras, termasuk mengatasi model Astra OpenAI dalam satu ujian keupayaan keselamatan. Namun, pekerja yang mengetahui penilaian dalaman model itu dilaporkan mempunyai pengalaman berbeza dalam sesetengah tugasan pengekodan praktikal, termasuk pembangunan bahagian hadapan—kerja yang melibatkan paparan dan interaksi sesuatu laman web atau aplikasi. 11
14
Pengalaman tersebut tidak membatalkan keputusan penanda aras, dan keputusan penanda aras pula tidak menjawab semua persoalan tentang prestasi dalam kerja kejuruteraan harian. Kedua-duanya menggambarkan perbezaan antara markah dalam ujian tertentu dengan tahap kegunaan dan konsistensi model untuk tugasan khusus.
Google menyatakan bahawa tidak tepat untuk menggambarkan Gemini 4 sebagai berprestasi lemah dalam pengekodan, sambil menekankan keputusan penanda arasnya. Pada masa yang sama, laporan mengenai pandangan pekerja tidak menunjukkan pendirian yang seragam: sesetengah kakitangan dilaporkan berpendapat model Fable daripada Anthropic dan Astra daripada OpenAI sedang berkembang lebih pantas, manakala yang lain berpendapat Gemini 4 sudah mengejar model-model terkemuka. 11
12
13
Perbezaan pandangan ini bermakna kritikan dalaman mahupun hujah Google berdasarkan penanda aras belum cukup untuk dijadikan keputusan muktamad tentang keupayaan Gemini 4.
Menurut laporan, Google pada asalnya merancang untuk melancarkan Gemini 3.5 Pro pada Jun 2026, tetapi membatalkan versi itu dan beralih kepada Gemini 4. Perkembangan ini menambah konteks kepada persoalan tentang rentak pembangunan dan pelancaran model Google. Namun, ia tidak dengan sendirinya menerangkan kelemahan pengekodan yang dilaporkan atau membuktikan bahawa Gemini 4 lebih rendah daripada pesaingnya. 6
13
Selepas laporan itu diterbitkan, saham Alphabet mengurangkan kenaikan terdahulu yang melebihi 2%, lalu menutup sesi dagangan Rabu dengan kenaikan kira-kira 0.5%. Pergerakan harga itu berlaku seiring perubahan sentimen pasaran, tetapi tidak membuktikan bahawa kebimbangan pekerja itu tepat atau bahawa kebimbangan tersebut menjadi punca pergerakan saham. 1
14
Persoalan yang lebih besar bagi pelabur ialah sama ada Google mampu bersaing dengan OpenAI dan Anthropic dalam pembangunan model AI utama. Laporan itu meletakkan Gemini 4 dalam persaingan tersebut, tetapi tidak menyatakan kesan khusus terhadap produk Google yang lain. Sebarang kesan lebih luas masih berupa persoalan, bukannya hasil yang sudah dibuktikan. 10
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Sesetengah pekerja berkata keputusan penanda aras Gemini 4 Argon tidak semestinya mencerminkan prestasinya dalam tugasan pengekodan praktikal, termasuk pembangunan bahagian hadapan.
Sesetengah pekerja berkata keputusan penanda aras Gemini 4 Argon tidak semestinya mencerminkan prestasinya dalam tugasan pengekodan praktikal, termasuk pembangunan bahagian hadapan. Pandangan pekerja tentang kemajuan Gemini 4 berbanding Fable dan Astra berbeza beza; rancangan Gemini 3.5 Pro yang dibatalkan turut menjadi konteks kepada persoalan tentang hala tuju pelancaran Google.