Bloomberg сообщил: Gemini 4 показала хорошие результаты в отраслевых бенчмарках, но, по словам сотрудников, испытывала трудности с некоторыми задачами по программированию. Прежние публикации Bloomberg описывали опасения сотрудников Google из за конкуренции с Anthropic и OpenAI, а также задержку Gemini 3.5 Pro для ул...
ОпубликовалОтредактировано с помощью GPT-6 LunaИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did Bloomberg report about the gap between Gemini 4’s strong benchmark scores and its performance on real-world coding tasks, why does. Article summary: Bloomberg reported that Gemini 4 scores well on standard AI benchmarks, but some employees testing it say it struggles with certain coding tasks in actual use. That gap matters because Google is preparing to launch a fla. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Сильные результаты в стандартизированных тестах не всегда означают, что модель так же уверенно справляется с рабочими задачами. Bloomberg сообщил, что Gemini 4 хорошо показала себя в популярных бенчмарках, но у некоторых сотрудников Google возникли сомнения в её работе с отдельными задачами по программированию. Это отзывы людей, знакомых с разработкой, а не опубликованная независимая оценка всех возможностей модели. 7
В тот же день Google представила Gemini 4 Argon, однако не сообщила, когда модель станет доступна широкой публике. 10
По словам источников Bloomberg, у которых был непосредственный доступ к проекту, Gemini 4 набирала высокие баллы в отраслевых тестах, но хуже справлялась с некоторыми задачами, когда сотрудники использовали её на практике. Источники говорили анонимно, поскольку обсуждали внутренние вопросы компании. 7
Бенчмарки позволяют сравнивать модели по заранее заданным критериям, а рабочие задания проверяют их в конкретных ситуациях. Это разные виды оценки: хорошие результаты в тестах сами по себе не снимают вопросов к практической работе, но и не доказывают, что модель слаба во всех реальных сценариях. 7
Google конкурирует с другими разработчиками ИИ-инструментов для программирования. В апреле Bloomberg писал, что руководители компании беспокоились об отставании в этой области, тогда как инструменты Anthropic источники издания называли более эффективными и популярными у бизнеса. 4
В июле Bloomberg сообщил, что выпуск Gemini 3.5 Pro отложили на несколько месяцев, пока Google улучшала возможности модели, в особенности программирование. По словам сотрудников, некоторые внутри компании опасались, что модели Anthropic и OpenAI превосходят Gemini по возможностям. 1 Reuters также писал, что Gemini 3.5 Pro должна была помочь Google догнать конкурентов в инструментах для программирования и задачах с ИИ-агентами.
2
Эти публикации объясняют конкурентный контекст, но речь в них шла о Gemini 3.5 Pro и более широких опасениях сотрудников. Они не доказывают, что Gemini 4 столкнулась с теми же проблемами или что Google проиграла гонку. Имеющиеся источники также не позволяют определить, как замечания о программировании скажутся на конкретных продуктах и клиентах компании. 2
4
7
Доступные публикации подтверждают, что выпуск Gemini 3.5 Pro задержали, пока компания работала над её возможностями, особенно в программировании. Они не подтверждают, что Google отказалась от модели. 1
2
Важно не смешивать два разных вывода: задержка не означает отмену, а сообщения о Gemini 3.5 Pro не служат подтверждением оценки Gemini 4. В материале Bloomberg о новой модели описаны отдельные сомнения сотрудников. 1
7
Google назвала «неточной» характеристику Gemini 4 как модели, которая плохо справляется с программированием, — так её позицию передал Bloomberg, согласно публикации ZeroHedge. Это противоречит рассказам анонимных сотрудников. В доступных источниках нет независимого публичного тестирования, которое окончательно разрешило бы это расхождение. 5
7
При этом в день публикации Bloomberg Google представила Gemini 4 Argon, но не объявила срок её выхода для широкой публики. 7
10
После публикации акции Alphabet сократили дневной рост: по данным Investing.com, на которые ссылался материал Yahoo Finance, они перешли от роста более чем на 2% к примерно 0,5% у закрытия торгов. Иными словами, акции отдали часть набранного, но не ушли в минус относительно предыдущего закрытия. 9
Сообщения указывают на вопрос, который предстоит прояснить: насколько сильные результаты Gemini 4 в бенчмарках соответствуют её работе с задачами программирования, которые пробовали сотрудники. Пока это сочетание анонимных отзывов и возражений Google, а не полная публичная оценка модели. История с задержкой Gemini 3.5 Pro добавляет конкурентный фон, но не доказывает ни отказ от той модели, ни отставание Gemini 4 от соперников по всем направлениям. 1
5
7
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Bloomberg сообщил: Gemini 4 показала хорошие результаты в отраслевых бенчмарках, но, по словам сотрудников, испытывала трудности с некоторыми задачами по программированию.
Bloomberg сообщил: Gemini 4 показала хорошие результаты в отраслевых бенчмарках, но, по словам сотрудников, испытывала трудности с некоторыми задачами по программированию. Прежние публикации Bloomberg описывали опасения сотрудников Google из за конкуренции с Anthropic и OpenAI, а также задержку Gemini 3.5 Pro для улучшения навыков программирования.
После публикации акции Alphabet сократили рост: с более чем 2% до примерно 0,5% у закрытия торгов, но остались в плюсе.