По сообщениям, некоторые сотрудники считают, что высокие результаты Gemini 4 Argon в тестах не всегда соответствуют тому, как модель справляется с реальными задачами программирования, в частности с фронтенд разработкой. Мнения о сравнении с Anthropic Fable и OpenAI Astra расходятся.
ОпубликовалОтредактировано с помощью GPT-6 LunaИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: Why are some Google employees questioning the forthcoming Gemini 4 model’s real-world coding ability despite strong benchmark scores, how do. Article summary: Some employees say Gemini 4 Argon’s strong benchmark scores do not match their experience using it for actual coding work, particularly certain tasks and front-end design. That is a reported internal assessment, not a se. Topic tags: general, general web, news, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Новая флагманская модель Google Gemini 4 Argon оказалась в центре спора о том, насколько результаты стандартных тестов отражают её пользу в работе. Компания подчёркивает высокие оценки на бенчмарках, тогда как некоторые сотрудники, знакомые с моделью, по сообщениям, считают её менее надёжной в отдельных практических задачах программирования. Это разница в оценках, а не доказательство того, что Gemini 4 уступает конкурентам по всем направлениям. 11
Google заявила о сильных результатах Gemini 4 в нескольких тестах. В одном из них, оценивающем навыки в области безопасности, модель превзошла OpenAI Astra. Однако сотрудники, знакомые с внутренними оценками, описывают более неоднозначный опыт при выполнении некоторых реальных задач — в том числе во фронтенд-разработке, которая связана с внешним видом и взаимодействием с сайтами и приложениями. 11
14
Бенчмарки проверяют модели в заданных условиях и помогают сравнивать результаты по конкретным критериям. Но такие оценки сами по себе не отвечают на все вопросы о том, насколько последовательно модель справляется с повседневной инженерной работой. И наоборот: отдельные критические отзывы не отменяют результатов тестов.
Google заявила, что было бы неверно говорить о слабых результатах Gemini 4 в программировании, и сослалась на достижения модели в бенчмарках. При этом мнения сотрудников, о которых сообщали СМИ, различаются: одни считают, что модели Anthropic Fable и OpenAI Astra развиваются быстрее, другие полагают, что Gemini 4 уже догнала ведущие системы. 11
12
13
Поэтому пока рано считать внутреннюю критику окончательным вердиктом — так же как и результаты тестов исчерпывающим доказательством того, что модель одинаково хорошо работает с любыми практическими задачами.
По сообщениям, Google планировала выпустить Gemini 3.5 Pro в июне 2026 года, но отказалась от этой версии и перешла к Gemini 4. Этот эпизод добавляет контекст к обсуждению темпов разработки и выпуска моделей. Однако сам по себе он не объясняет сообщения о трудностях Gemini 4 с программированием и не доказывает, что новая модель уступает конкурентам. 6
13
После публикации сообщения акции Alphabet, материнской компании Google, сократили прежний рост более чем на 2% и завершили указанную среду с повышением примерно на 0,5%. Это показывает, что новость совпала с переменой настроений на рынке, но не доказывает ни правоту критиков Gemini 4, ни то, что именно их опасения вызвали движение котировок. 1
14
Для инвесторов важен более широкий вопрос: сможет ли Google конкурировать с OpenAI и Anthropic в разработке передовых ИИ-моделей. Gemini 4 — часть этой гонки, однако опубликованные сведения не устанавливают конкретных последствий для отдельных продуктов Google. Возможное влияние сомнений на конкурентные позиции компании остаётся вопросом, а не подтверждённым результатом. 10
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
По сообщениям, некоторые сотрудники считают, что высокие результаты Gemini 4 Argon в тестах не всегда соответствуют тому, как модель справляется с реальными задачами программирования, в частности с фронтенд разработкой.
По сообщениям, некоторые сотрудники считают, что высокие результаты Gemini 4 Argon в тестах не всегда соответствуют тому, как модель справляется с реальными задачами программирования, в частности с фронтенд разработкой. Мнения о сравнении с Anthropic Fable и OpenAI Astra расходятся. Google отвергает утверждения о слабых результатах модели, а запланированный, но отменённый релиз Gemini 3.5 Pro добавляет контекст к вопросам о темпах ра...