Gemini 4 Argon отримав дві різні оцінки. Google вказує на високі результати моделі в низці бенчмарків, а деякі працівники, за повідомленнями, кажуть, що під час реальної роботи з кодом вона буває менш передбачуваною. Це розбіжність між тестовими оцінками та досвідом із практичними завданнями, а не доказ того, що Gemini 4 поступається конкурентам у всьому.
11
Чому високих балів у тестах недостатньо
Google заявила, що Gemini 4 показала сильні результати в кількох бенчмарках. Зокрема, в одному з тестів на навички кібербезпеки модель випередила OpenAI Astra. Водночас співробітники, знайомі з внутрішніми оцінюваннями, розповідали про труднощі з деякими практичними завданнями з програмування, серед них — фронтенд-розробка.
11
14
Ці повідомлення не скасовують результатів бенчмарків — так само як високі бали самі собою не відповідають на всі запитання про щоденну роботу розробників. Тести оцінюють визначені завдання, тоді як практична користь залежить від конкретної роботи й того, наскільки стабільно модель її виконує.
Усередині компанії немає одностайної оцінки
Google заперечила характеристику, ніби Gemini 4 слабко справляється з програмуванням, і наголосила на результатах бенчмарків. Водночас погляди співробітників, згаданих у повідомленнях, різняться: одні вважають, що Fable від Anthropic і Astra від OpenAI розвиваються швидше, інші — що Gemini 4 уже наздогнав провідні моделі.
11
12
13
Тож ані внутрішню критику, ані наведені компанією тестові результати не варто сприймати як остаточний вердикт про можливості Gemini 4.
Що додає історія з Gemini 3.5 Pro
За повідомленнями, Google планувала випустити Gemini 3.5 Pro у червні 2026 року, але відмовилася від цієї версії та перейшла до Gemini 4. Ця зміна додає контексту до запитань про темп розробки й випуску моделей, однак сама по собі не пояснює повідомлення про труднощі Gemini 4 із програмуванням і не доводить, що модель поступається конкурентам.
6
13
Чому новина привернула увагу інвесторів
Після появи повідомлень акції Alphabet скоротили попереднє зростання — з понад 2% до приблизно 0,5% за підсумками торгової сесії в середу. Рух акцій збігся в часі з новиною, але сам по собі не підтверджує правдивість зауважень працівників і не доводить, що саме вони спричинили зміну котирувань.
1
14
Для інвесторів ширше питання полягає в тому, чи зможе Google конкурувати з OpenAI та Anthropic у сегменті передових моделей ШІ. У наявних повідомленнях Gemini 4 розглядають саме в контексті цього змагання; конкретного впливу ситуації на окремі продукти Google вони не встановлюють.
10