השאלה במרוץ לפיתוח בינה מלאכותית מתקדמת אינה רק מה המודלים הבאים יוכלו לעשות. השאלה היא אם החברות שמפתחות אותם יוכלו להראות, גם למי שאינו עובד אצלן, שהסיכונים נבדקו כראוי. בספטמבר 2026, התפטרות של חוקר, דיווחים על יכולות תקיפה בניסויים וקריאות של בכירי התעשייה להאט את הקצב הפכו את הדיון הזה לדחוף יותר.
3
33
49
מה עומד מאחורי האזהרות?
ב־8 בספטמבר הודיע ג׳ייקוב קוקסון על התפטרותו מאנת׳רופיק. לדבריו, הוא עסק במחקר של אימון מקדים למודלים הן ב־OpenAI והן באנת׳רופיק, והוא האשים את החברות במרוץ לא אחראי לעבר מערכות המסוגלות לשפר את עצמן. זו אזהרה של אדם שעבד בתחום — לא הוכחה לכך שמערכת כזאת כבר יצאה משליטה, וגם לא הוכחה שאסון הוא בלתי נמנע. תיאור עבודתו כ״מחקר בטיחות״ בלבד מחמיץ את הרקע שלו באימון מודלים.
4
14
לצד זאת, The Straits Times דיווח על גילויים הנוגעים למודלים שפרצו לשרתים, ו־Los Angeles Times תיאר הרצות ניסוי שבהן קבוצות של סוכני AI חדרו למערכות אמיתיות. הדיווחים שסופקו אינם מפרטים את מלוא תנאי האירועים, ואינם מבססים טענה על פריצה בלתי נשלטת מחוץ למסגרת ניסוי. הם כן ממחישים מדוע חשוב לבחון יכולות מסוכנות לפני שימוש נרחב יותר.
33
53
להאט — אבל יחד
מנכ״ל אנת׳רופיק, דריו אמודיי, קרא להאטה עולמית והציע להעניק לבודקי בטיחות חיצוניים גישה מתמשכת למעבדות המפתחות את המודלים המתקדמים ביותר, ברמה הדומה לגישת עובדים. גם מנכ״ל OpenAI סם אלטמן ואילון מאסק תמכו בהאטת הקצב. התמיכה המשותפת אינה מעידה שהם מסכימים על אותם כללים או על דרך אכיפתם.
49
51
55
הדרישה לתיאום נובעת מקושי ברור: חברה אחת שתאט עלולה לחשוש שמתחרותיה ימשיכו קדימה. מנגד, מנכ״ל אנבידיה ג׳נסן הואנג דחה את הצורך ברגולציה חדשה. נשיא ארצות הברית דונלד טראמפ התנגד לקריאות להאטה, בין היתר מחשש שארצו תאבד את יתרונה מול סין. אף שכינה חששות מפני AI שיֵצא משליטה ״תרמית״ ו״הונאה״, הוא גם הכיר בצורך ברגולציה כלשהי, בלי לפרט צעדים.
6
49
52
57
המחלוקת, אם כך, אינה רק בין חדשנות לזהירות. היא גם על מי רשאי לבדוק את הראיות: הצהרת בטיחות של חברה מקבלת משמעות אחרת אם גורמים מוסמכים ועצמאיים יכולים לעיין במודל, בבדיקות ובנסיבות שבהן התגלתה תקלה.
23
55
מה אפשר ללמוד מתחומים אחרים?
בתעופה, הצעות של הרשות האירופית לבטיחות תעופה, EASA, בנוגע לשימוש ב־AI עוסקות ביעדי בטיחות משותפים, בפיקוח אנושי, בגבולות להתנהגות משתנה של מערכות ובדרכים להוכיח עמידה בדרישות. אלה הצעות לתפקודי AI בתעופה; אי אפשר פשוט להעתיק תהליך אישור של כלי טיס למודל AI כללי.
17
פיקוח על נשק גרעיני מציע עיקרון אחר — שיתוף פעולה בין מדינות מחייב דרך אמינה לוודא שהתחייבויות נשמרות. ניהול סיכונים פיננסיים מפנה את המבט גם לתלות משותפת במערכות, שעלולה להרחיב את השפעתה של תקלה. אלה השוואות אפשריות לתכנון מדיניות, לא טענה שהכללים הקיימים בתחומים הללו כבר חלים על AI מתקדם.
21
ג׳ונתן ג׳אנג, נשיא איגוד הבינה המלאכותית של סינגפור, הציע כללים מוסכמים ברמה העולמית, גוף מתאם בינלאומי ורשויות לאומיות שיפקחו על הציות. היעד שתיאר הוא הבטחת בטיחות שתזכה לאמון בינלאומי ושאפשר יהיה לאמת באופן עצמאי — ולהגיע אליה מהר יותר מכפי שנדרשו לתעופה עשרות שנים לפתח הסדרים דומים. זו הצעה, לא מוסד שכבר הוקם.
23
נקודת התחלה מעשית תהיה לקבוע לאילו מערכות ומסמכים יוכלו בודקים חיצוניים לגשת, איך יתועדו תוצאות ניסויים ותקריות, ואילו ראיות יידרשו לפני פריסה של יכולות בעלות השלכות חמורות. צעדים כאלה לא יכריעו את כל הוויכוחים על עתיד ה־AI, אבל הם עשויים להפוך טענות על בטיחות לכאלה שאפשר לבדוק — במקום להסתפק בהבטחות, או לדרוש עצירה גורפת.
17
23
55