Bloomberg melaporkan Gemini 4 meraih hasil baik dalam benchmark AI, tetapi kesulitan pada beberapa tugas coding saat diuji karyawan. Laporan ini memuat masukan anonim dan bukan evaluasi independen menyeluruh.
Diterbitkan olehDiedit dengan GPT-6 LunaGambar dibuat dengan GPT Image 2
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What did Bloomberg report about the gap between Gemini 4’s strong benchmark scores and its performance on real-world coding tasks, why does. Article summary: Bloomberg reported that Gemini 4 scores well on standard AI benchmarks, but some employees testing it say it struggles with certain coding tasks in actual use. That gap matters because Google is preparing to launch a fla. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Bloomberg melaporkan bahwa Gemini 4 memperoleh hasil baik dalam benchmark AI yang umum digunakan, tetapi sejumlah karyawan Google mengatakan model itu kurang memuaskan saat dipakai untuk tugas nyata, termasuk beberapa pekerjaan coding. Laporan tersebut memotret keraguan internal menjelang peluncuran—bukan penilaian menyeluruh atas semua kemampuan model. Google membantah kritik itu. Pada hari yang sama, perusahaan memperkenalkan Gemini 4 Argon, tetapi belum memberikan jadwal ketersediaan umum. 7
5
10
Sejumlah orang yang memiliki akses langsung ke pengembangan Gemini 4 mengatakan kepada Bloomberg bahwa model itu mendapat skor baik dalam benchmark industri, tetapi kesulitan menangani tugas coding tertentu dalam penggunaan langsung. Narasumber tersebut tidak disebutkan namanya, sehingga temuan ini lebih tepat dipahami sebagai masukan karyawan, bukan hasil pengujian independen yang dipublikasikan. 7
Benchmark adalah pengujian terstandar untuk membandingkan kemampuan model. Hasilnya dan pengalaman pengguna saat mengerjakan tugas tertentu merupakan dua jenis bukti yang berbeda. Laporan Bloomberg menunjukkan bahwa skor benchmark yang kuat belum menghapus semua kekhawatiran internal mengenai kemampuan coding Gemini 4. Namun, laporan itu tidak membuktikan bahwa model tersebut buruk untuk semua penggunaan nyata. 7
Google tengah bersaing dalam pengembangan alat coding berbasis AI. Bloomberg sebelumnya melaporkan bahwa para pemimpin di perusahaan itu khawatir tertinggal dari pesaing, terutama ketika Anthropic menawarkan alat coding yang menurut narasumber lebih efektif dan populer di kalangan bisnis. 4
Laporan terpisah pada Juli menyebut peluncuran Gemini 3.5 Pro tertunda beberapa bulan saat Google berupaya meningkatkan kemampuannya, khususnya dalam coding. Karyawan yang dikutip dalam laporan itu khawatir model dari Anthropic dan OpenAI melampaui kemampuan Gemini. 1 Reuters juga melaporkan bahwa Gemini 3.5 Pro dirancang untuk membantu Google mengejar ketertinggalan dalam alat coding AI dan tugas AI agentik—tugas ketika AI dapat menjalankan rangkaian pekerjaan secara lebih mandiri.
2
Laporan-laporan sebelumnya memberi konteks tentang persaingan, tetapi membahas Gemini 3.5 Pro dan kekhawatiran yang lebih luas. Itu bukan bukti bahwa Gemini 4 memiliki kelemahan yang sama atau bahwa Google telah kalah dalam persaingan. Kemampuan coding yang lebih baik dapat berpengaruh bagi upaya Google mengembangkan alat coding dan AI agentik, tetapi sumber yang tersedia tidak menjelaskan dampak spesifik isu Gemini 4 terhadap produk atau pelanggan. 2
4
7
Laporan yang tersedia mendukung kesimpulan bahwa Gemini 3.5 Pro tertunda sementara Google berupaya meningkatkan kemampuannya, terutama dalam coding. Laporan tersebut tidak membuktikan bahwa Google membatalkan model itu. 1
2
Pembedaan ini penting: penundaan bukan berarti pembatalan. Selain itu, laporan tentang Gemini 3.5 Pro tidak dapat dianggap sebagai konfirmasi mengenai performa Gemini 4. Bloomberg menguraikan kekhawatiran karyawan tentang Gemini 4 secara terpisah. 1
7
Menurut laporan Bloomberg yang dikutip ZeroHedge, Google menyebut anggapan bahwa Gemini 4 berkinerja buruk dalam coding sebagai “tidak akurat”. Pernyataan itu bertentangan dengan kesaksian anonim para karyawan. Sumber yang tersedia tidak memuat pengujian publik independen yang dapat memastikan pihak mana yang benar. 5
7
Konteks waktunya juga perlu diperhatikan. Bloomberg melaporkan adanya keraguan internal saat Gemini 4 mendekati peluncuran. Pada hari yang sama, laporan lain menyebut Google telah memperkenalkan Gemini 4 Argon, tetapi belum mengumumkan kapan model itu akan tersedia secara umum. 7
10
Setelah laporan tersebut beredar, saham Alphabet memangkas sebagian kenaikannya. Menjelang penutupan, saham yang sebelumnya naik lebih dari 2% tercatat menguat sekitar 0,5%, menurut laporan yang mengutip Investing.com. Artinya, kenaikan pada hari itu menyusut, tetapi saham tetap berada di atas harga penutupan sebelumnya. 9
Laporan tersebut menyoroti pertanyaan penting bagi Google: apakah hasil benchmark Gemini 4 yang kuat juga tercermin dalam tugas coding yang dicoba karyawan? Namun, bukti yang tersedia berupa gabungan kesaksian internal anonim dan bantahan Google, bukan evaluasi publik yang lengkap. Penundaan Gemini 3.5 Pro memberi konteks soal persaingan, tetapi tidak membuktikan bahwa model itu dibatalkan atau bahwa Gemini 4 secara luas tertinggal dari pesaingnya. 1
5
7
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Bloomberg melaporkan Gemini 4 meraih hasil baik dalam benchmark AI, tetapi kesulitan pada beberapa tugas coding saat diuji karyawan.
Bloomberg melaporkan Gemini 4 meraih hasil baik dalam benchmark AI, tetapi kesulitan pada beberapa tugas coding saat diuji karyawan. Laporan ini memuat masukan anonim dan bukan evaluasi independen menyeluruh. Google menyebut anggapan bahwa Gemini 4 lemah dalam coding sebagai tidak akurat.
Pada hari yang sama, Google memperkenalkan Gemini 4 Argon, tetapi belum mengumumkan jadwal ketersediaan umum.