Проблема полягала не в самому нагадуванні про особисту безпеку. Загальне застереження доречне, якщо користувач справді повідомляє про загрозу. Питання виникло через те, що за майже однакової конструкції запиту попередження, схоже, змінювалося залежно від названої ідентичності. У такому разі нейтральне правило безпеки може перетворитися на непряме твердження, ніби представники певних груп від природи небезпечніші за інших.
Користувачі Reddit назвали різницю в рекомендаціях подвійним стандартом, а Futurism заявило, що мова про екстрене реагування посилює расові стереотипи. Онлайн-активісти окремо звернули увагу на контраст між запитами про мусульманина та ізраїльтянина, назвавши його проявом упередженості щодо мусульман.
Імам Омар Сулейман поширив відповідь, яка заперечувала саму ідею, що мусульманина слід вважати небезпечним лише через його віру. На пізнішому скриншоті, який приписують його обліковому запису, йшлося, що перебування наодинці з мусульманином є нормальним і що спільна релігія сама по собі не визначає характер людини чи рівень загрози.
Цей пізніший текст підтверджує, що користувачам демонстрували іншу відповідь. Однак надані матеріали не встановлюють, коли саме її змінили, чи застосували зміну до всіх користувачів і чи зробила Google це безпосередньо у відповідь на публікацію Сулеймана.
За доступними повідомленнями, Google визнала, що результати в цій категорії «не такі, якими мають бути», і заявила, що працює над покращеннями. Це відповідає загальній практиці компанії: під кожним AI Overview користувач може повідомити, що відповідь є неточною, упередженою або проблемною.
Детального технічного пояснення нерівномірних відповідей у наданих матеріалах немає. Тому вони не дають змоги встановити, що саме стало головною причиною: поведінка моделі, знайдений у мережі контент, логіка системи безпеки чи взаємодія всіх цих чинників.
AI Overviews розташовані у верхній частині результатів Google Search, тому згенерована відповідь може виглядати авторитетною навіть тоді, коли вона не має достатніх підстав або є помилковою. Раніше функцію критикували через абсурдні поради — зокрема покласти клей на піцу або їсти каміння, — а також через повторення неправдивого твердження, ніби Барак Обама був мусульманином.
Інші публікації порушували питання щодо неточної медичної інформації в згенерованих пошукових підсумках. Окремий аналіз, на який посилалося Futurism, оцінював точність AI-підсумків приблизно у 91%. Навіть за такого показника на масштабах пошуку Google йдеться про значну кількість неправильних відповідей.
Надані джерела не містять достатніх деталей, щоб підтвердити конкретні твердження про нібито неточну расову генерацію зображень у Gemini. Однак вони демонструють ширшу, повторювану проблему: системи, які мають стисло переказувати інформацію, можуть упевнено видавати соціально шкідливі або фактично хибні відповіді, а виправлення з’являються вже після того, як користувачі привертають до них увагу.
AI Overview краще сприймати як відправну точку, а не остаточний авторитет — особливо коли відповідь стосується безпеки, релігії, національності чи особи. Корисно порівнювати паралельні запити, відкривати посилання на першоджерела та повідомляти Google про упереджені або неточні результати через інструменти зворотного зв’язку.
Особисту безпеку слід оцінювати за поведінкою та конкретними обставинами, а не виводити з національності, раси чи релігії людини. Ця історія показує, що такий принцип має бути закладений і в правила безпеки моделі, і в перевірки, які проходять пошукові відповіді до того, як потрапити на екрани користувачів.