אזהרת בטיחות כללית יכולה להיות הגיונית כאשר משתמש אומר שהוא מרגיש מאוים. החשש כאן נבע מכך שהאזהרה, לכאורה, השתנתה בהתאם לזהות שהוזכרה בשאילתה — אף שהמבנה שלה כמעט לא השתנה.
כאשר מערכת מגיבה כך, היא עלולה להפוך כלל בטיחות ניטרלי למסר משתמע שלפיו קבוצות מסוימות מסוכנות יותר מאחרות מעצם היותן מי שהן. זו הסיבה שהמקרה עורר ביקורת על האופן שבו מערכות חיפוש מבוססות בינה מלאכותית מתמודדות עם סטריאוטיפים.
משתמשי Reddit הצביעו על הפער כעל סטנדרט כפול, ואילו Futurism תיאר את הניסוחים שהפנו לשירותי חירום כחיזוק לסטריאוטיפים גזעניים. פעילים ברשת התמקדו במיוחד בהבדל המדווח בין השאילתות על מוסלמי ועל ישראלי, ותיארו אותו כהטיה אנטי-מוסלמית.
האימאם עומר סולימאן שיתף תשובה שדחתה את ההנחה שאדם מוסלמי צריך להיתפס כמסוכן בשל אמונתו. בצילום מסך מאוחר יותר שיוחס לחשבונו, נכתב כי להיות לבד עם אדם מוסלמי הוא מצב רגיל ובטוח, וכי השתייכות לדת מסוימת אינה קובעת את אופיו של אדם או את רמת האיום שהוא מציב.
עם זאת, החומר הזמין אינו מוכיח מתי בדיוק הוצגה התשובה המאוחרת, אם השינוי הוחל על כלל המשתמשים, או אם גוגל ביצעה אותו בעקבות הפרסום של סולימאן. לכן אי אפשר לקבוע על בסיס הראיות האלה שגוגל "תיקנה" את התוצאה באופן גורף.
לפי הדיווחים, גוגל הודתה שהתוצאות בקטגוריה הזו "אינן כפי שהיו צריכות להיות" ואמרה שהיא פועלת לשיפורן. החברה מאפשרת למשתמשים לדווח על תשובות של AI Overview שאינן מדויקות, מוטות או בעייתיות באמצעות כפתורי המשוב שמופיעים מתחת לתשובה.
החומר שסופק אינו כולל הסבר טכני מפורט מגוגל לגבי מקור הפערים. לכן אי אפשר לקבוע אם התשובות נבעו בעיקר מהתנהגות המודל, מתוכן שהמערכת שלפה מהאינטרנט, ממנגנוני הבטיחות שלה — או משילוב בין הגורמים.
ל-AI Overviews יש מקום בולט בראש תוצאות החיפוש, ולכן תשובה שנוצרה אוטומטית עלולה להישמע סמכותית גם כשהיא שגויה או חסרת בסיס. בעבר ספגה התכונה ביקורת על המלצות ביזאריות, כמו להוסיף דבק לפיצה ולאכול אבנים, וכן על חזרה על טענה כוזבת שלפיה ברק אובמה היה מוסלמי.
דיווחים אחרים העלו חששות גם לגבי מידע רפואי שגוי בתמציות חיפוש שנוצרו בידי AI. ניתוח נפרד שצוטט ב-Futurism העריך שתמציות כאלה היו מדויקות בכ-91% מהמקרים — נתון שנשמע גבוה, אך בקנה המידה העצום של החיפוש בגוגל עדיין עשוי לייצג מספר גדול מאוד של תשובות שגויות.
המקורות שסופקו אינם מתעדים מספיק פרטים כדי לבסס את הטענות הספציפיות לגבי יצירת תמונות גזעניות ולא מדויקת ב-Gemini. הם כן מצביעים על בעיה רחבה יותר: מערכות שנועדו לסכם מידע עלולות להפיק תשובות בטוחות בעצמן, מזיקות מבחינה חברתית או פשוט שקריות — ורק לאחר שהמשתמשים חושפים את הכשל מתחיל תהליך התיקון.
כדאי להתייחס ל-AI Overview כאל נקודת פתיחה, לא כאל סמכות סופית — במיוחד כשהתשובה עוסקת בבטיחות, בזהות, בדת או בלאום של אדם. מומלץ לבדוק את הקישורים שעליהם התשובה מסתמכת, להשוות בין ניסוחים מקבילים ולדווח לגוגל על תוצאות מוטות או שגויות באמצעות כלי המשוב שלה.
והעיקר: הערכת סכנה צריכה להתבסס על התנהגות ועל נסיבות ממשיות, לא על לאום, גזע או דת. הפרשה ממחישה עד כמה חשוב שהעיקרון הזה יהיה חלק מובנה הן מכללי הבטיחות של המודל והן מהבדיקות שמערכות חיפוש עוברות לפני שהן מגיעות למשתמשים.