Selon des personnes proches du projet, certains employés trouvent Gemini 4 moins fiable sur des tâches de programmation concrètes, notamment en développement front end, que ne le laissent penser ses scores aux benchma... Les avis au sein de Google ne sont pas unanimes : certains estiment que les modèles d’Anthropic...
Publié parModifié avec GPT-6 LunaImages générées avec GPT Image 2
Réponse de recherche

Create a landscape editorial hero image for this Studio Global article: Why are some Google employees questioning the forthcoming Gemini 4 model’s real-world coding ability despite strong benchmark scores, how do. Article summary: Some employees say Gemini 4 Argon’s strong benchmark scores do not match their experience using it for actual coding work, particularly certain tasks and front-end design. That is a reported internal assessment, not a se. Topic tags: general, general web, news, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Gemini 4 Argon suscite deux lectures différentes chez Google. L’entreprise souligne ses bons résultats à plusieurs tests de référence ; certains employés, eux, rapporteraient des performances moins convaincantes lorsqu’ils s’en servent pour des tâches concrètes de programmation. Ces témoignages font état d’avis divergents en interne, pas d’un consensus selon lequel le modèle serait inférieur à ses concurrents. 11
Google affirme que Gemini 4 a obtenu des résultats de premier plan sur plusieurs benchmarks, dont un test de sécurité où il aurait devancé Astra, le modèle d’OpenAI. Mais, selon des personnes ayant accès au projet, certains employés jugent le modèle moins efficace sur des travaux de code réels, notamment en développement front-end — la partie d’un site ou d’une application avec laquelle les utilisateurs interagissent. 11
14
Ces retours ne réfutent pas les résultats aux benchmarks. Mais ces derniers ne suffisent pas non plus à mesurer la régularité d’un modèle dans toutes les tâches d’ingénierie du quotidien. Les deux évaluations portent sur des usages différents.
Google estime qu’il serait inexact de dire que Gemini 4 est en retrait en programmation et met en avant ses résultats aux tests. Les avis rapportés parmi les employés sont eux-mêmes partagés : certains pensent que Fable, chez Anthropic, et Astra, chez OpenAI, progressent plus vite ; d’autres estiment que Gemini 4 a rejoint les modèles de pointe. 11
12
13
Il est donc trop tôt pour tirer un verdict général, que ce soit à partir des critiques internes ou des seuls benchmarks présentés par l’entreprise.
Google avait prévu de lancer Gemini 3.5 Pro en juin 2026, mais a finalement abandonné cette version pour passer à Gemini 4, selon les informations publiées. Ce changement éclaire les interrogations sur le calendrier de développement de Google, sans expliquer à lui seul les difficultés de codage rapportées ni démontrer que Gemini 4 est inférieur. 6
13
Après la publication du reportage, les actions d’Alphabet ont effacé une partie de leur hausse précédente : après avoir progressé de plus de 2 %, elles ont terminé la séance du mercredi en hausse d’environ 0,5 %. Ce mouvement coïncide avec la nouvelle, mais ne prouve ni que les critiques des employés sont fondées ni qu’elles sont à l’origine de l’évolution du cours. 1
14
L’enjeu plus large est la capacité de Google à rivaliser avec OpenAI et Anthropic dans les modèles d’IA de pointe. Gemini 4 s’inscrit dans cette compétition, mais les informations disponibles ne précisent pas d’effet concret sur les produits de Google. Toute conséquence plus large reste donc une question, et non un résultat établi. 10
Studio Global AI
Cette page comprend une réponse basée sur la source que vous pouvez continuer dans Studio Global.
Selon des personnes proches du projet, certains employés trouvent Gemini 4 moins fiable sur des tâches de programmation concrètes, notamment en développement front end, que ne le laissent penser ses scores aux benchma...
Selon des personnes proches du projet, certains employés trouvent Gemini 4 moins fiable sur des tâches de programmation concrètes, notamment en développement front end, que ne le laissent penser ses scores aux benchma... Les avis au sein de Google ne sont pas unanimes : certains estiment que les modèles d’Anthropic et d’OpenAI progressent plus vite, tandis que d’autres jugent Gemini 4 au niveau des meilleurs.
Google avait prévu de lancer Gemini 3.5 Pro en juin 2026, avant d’abandonner cette version au profit de Gemini 4.