אזהרה מפני תרחיש אסון יכולה לעורר דיון ציבורי, אבל היא אינה אומרת לארגון אם לחבר מחר סוכן בינה מלאכותית למאגר הלקוחות שלו. בתגובה לגל האזהרות שהתחדש בספטמבר 2026, קולות בתעשיית ה־AI בסינגפור מדגישים שאלה אחרת: איך בודקים מערכת, מי רשאי לבחון את אמצעי הבטיחות שלה, ואילו סמכויות מותר לתת לה? התשובה שהם מציעים מתמקדת בפיקוח ובאחריותיות — לא בפיתוח ללא הגבלה, אך גם לא בעצירה גורפת.
7
32
מה הצית מחדש את הדיון?
ג׳ייקוב קוקסון התפטר מ־Anthropic לאחר שעבד גם בה וגם ב־OpenAI. הוא האשים את שתי החברות במרוץ לפיתוח בינת־על שתוכל לשפר את עצמה, בלי לנהוג באחריות מספקת. חוקר Anthropic אוון האובינגר הביע הסכמה עם החשש והעריך באופן אישי שהסיכוי לכך שבינה מלאכותית תגרום להכחדת האנושות בעשור הקרוב גבוה מ־10%. זו הערכתו האישית, לא הסתברות שנמדדה או ראיה לכך שהכחדה קרובה.
3
4
ב־12 בספטמבר קרא מנכ״ל Anthropic, דריו אמודיי, להאט את הפיתוח. הצעתו כללה גם מתן גישה לבודקים חיצוניים, כדי שיוכלו לוודא שנהלי הבטיחות והדיווח על תקריות אכן מיושמים. כך הדיון עובר מן השאלה עד כמה צריך לחשוש לשאלה מה גורם בלתי תלוי יכול לבדוק בפועל.
13
32
בדיקה עצמאית אינה תעודת ביטוח לעתיד
אפשר לבחון את מגבלותיהן של מערכות קיימות. כלי הבדיקה AI Verify, שהושק בסינגפור ב־2022, מסייע להעריך אם תוצאות של מערכות AI הוגנות, עמידות וניתנות להסבר. גם תוכנית להסמכת בודקי AI נועדה לחזק את יכולת הבדיקה. אף אחת מהיוזמות הללו אינה מוכיחה שכל מערכת עתידית תהיה בטוחה.
19
33
כדי שבדיקה תהיה משמעותית, לא די בהצהרת החברה שפיתחה את המודל כי הוא עבר מבחן פנימי. בודקים חיצוניים זקוקים לגישה שתאפשר להם לבחון את נהלי הבטיחות ולזהות תקריות; ארגונים שמטמיעים AI זקוקים לשקיפות ולאמצעי שליטה לפני שהם מאפשרים למודל גישה למידע ולתהליכי העבודה שלהם. גם גישה למשקלי המודל לבדם אינה מגלה בהכרח כיצד אומן, היכן כשל ואילו הגנות הוטמעו בו.
32
34
אין פירוש הדבר שלעולם אין להאט פיתוח. מומחה מסינגפור שהשתתף בדיון טען כי אם מפתחים אינם יכולים להכיל מערכת כראוי או להסביר כיצד הם מנהלים סיכונים חמורים, עליהם לעצור את הפעילות הזאת. ההבחנה היא בין עצירה המותנית בסיכון מסוים לבין השבתה גורפת של כל השימושים בבינה מלאכותית.
32
לפני שנותנים לסוכן לפעול, מגדירים מה מותר לו
השאלה נעשית דחופה במיוחד כשמדובר בסוכני AI: מערכות שיכולות להפעיל כלים ולבצע פעולות לאורך תהליכי עבודה, ולא רק להשיב לשאלות. בינואר 2026 השיקה הרשות הסינגפורית לפיתוח מדיה ומידע דיגיטלי, IMDA, מסגרת ממשל לסוכני AI. היא ממליצה להעריך סיכונים מראש ולהגביל את עצמאות הסוכנים ואת גישתם לכלים ולמידע. הגרסה המעודכנת מפרטת את עקרון ההרשאה המזערית: להעניק לסוכן רק את הגישה הדרושה לביצוע המשימה. מדובר בהנחיות, לא באיסור חוקי גורף על הפעלת סוכנים.
50
48
52
עבור ארגון, המשמעות היא למנות אדם האחראי לכל סוכן, לצמצם הרשאות, לתעד פעולות, לאפשר לבטל אותן ככל האפשר ולפקח על הפעילות לאורך זמן. אלה צעדים שאפשר ליישם ולבדוק — בניגוד להבטחה כללית שהסוכן ״בטוח״.
34 השרה הסינגפורית ג׳וזפין טאו השוותה את התפקיד שבאמצעי בטיחות ובתקנים בתחום ה־AI לנוהלי בטיחות בתעופה האזרחית: שכבות של הגנה שנועדו לבסס אמון בשימוש בטכנולוגיה.
17
השורה התחתונה היא אחריות גם כשאין ודאות: לבדוק את מה שאפשר לבדוק, לאפשר ביקורת חיצונית, ולא להעניק למערכות סמכויות שאי אפשר לשלוט בהן בבטחה. אלה אינם פתרונות לשאלת הסיכון ארוך הטווח של AI, אבל הם מציבים למפתחים ולארגונים חובות מעשיות כבר עכשיו.
32
48