הצהרה של חברה כי מערכת הבינה המלאכותית שלה „בטוחה” אינה שקולה להוכחה. כדי שכללי בטיחות עולמיים יזכו לאמון, גורמים בלתי תלויים צריכים להיות מסוגלים לבדוק את הראיות — ורשויות במדינות צריכות להיות מסוגלות לפעול כשהמערכת אינה עומדת בדרישות.
שרת הפיתוח הדיגיטלי והמידע של סינגפור, ג'וזפין טאו, הציעה ללמוד מהתעופה: שכבות של אמצעי הגנה אפשרו לציבור להסתמך עליה בשגרה, ולדבריה גם אימוץ רחב של בינה מלאכותית מחייב בניית אמצעי בטיחות לצד השימוש בטכנולוגיה.
3
6
הלקח מהתעופה: להתחיל בהסכמות שאפשר ליישם
הכללים הבינלאומיים לתעופה לא נוצרו בבת אחת. חוקים לאומיים והסכמים בין מדינות קדמו לאמנת פריז מ־1919; אמנת שיקגו מ־1944 יצרה מסגרת חדשה, וב־1947 החל לפעול הארגון הבינלאומי לתעופה אזרחית, ICAO.
31
39
35 אין בכך טענה שלבינה מלאכותית דרוש אותו ספר תקנות. הלקח הוא שאפשר להתחיל בהסכמות מעשיות ולהרחיב אותן ככל שנצבר ניסיון משותף.
במסגרת כזאת, גוף בינלאומי יוכל לתאם דרישות מינימום, להכיר בכשירותם של גופי בדיקה ולהשוות מידע על תקריות. הרשויות הלאומיות הן שיחזיקו בסמכות לבדוק מערכות, לחייב תיקונים, להגביל הפעלה ולהטיל סנקציות. אישור בינלאומי לא יחליף אכיפה מקומית.
גם בדיקה לפני השקה אינה סוף הדרך. יש לעקוב אחר המערכת בזמן השימוש, לבדוק אותה מחדש לאחר שינוי מהותי ולהיערך לחזרה לגרסה קודמת או להפסקת השימוש. אישור בטיחות צריך לציין איזו גרסה נבדקה ובאילו תנאי שימוש — לא להעניק הכשר קבוע לכל שימוש עתידי.
מה צריך בודק עצמאי לראות?
ציון טוב במבחן פומבי או תווית „נבדק” אינם מספיקים. בודק מוסמך יזדקק לגישה מאובטחת למודל הרלוונטי, לאופן שבו הוא מופעל בפועל, לתיעוד ולרישומי כשלים משמעותיים. שיטות הבדיקה והממצאים צריכים להיות מפורטים מספיק כדי שבודק מוסמך אחר יוכל לבחון אותם ולערער עליהם — בלי לחשוף ללא צורך מידע אישי, סודות מסחריים או פרטים רגישים מבחינה ביטחונית.
ממפעילי מערכות בסיכון גבוה אפשר לדרוש תיק בטיחות: מה המערכת רשאית לעשות, כיצד נבחנה, אילו אמצעי הגנה הוכחו, מה הסיכונים שנותרו וכיצד יטופלו תקריות. אם הראיות אינן מספקות, הרגולטור צריך להיות מסוגל לדרוש תיקון או להגביל את ההפעלה. היעד אינו הבטחה שאפס נזק הוא אפשרי, אלא עמידה בדרישות מוגדרות שאפשר לאמת.
גם דרך המימון משפיעה על עצמאות הבדיקה. מפתחים גדולים יוכלו לממן בדיקות באמצעות קרן משותפת או אגרות בניהול רגולטורי, במקום לבחור ולשלם ישירות למי שמעריך אותם. חקירה עצמאית של כשלים חמורים ושל אירועים שכמעט הסתיימו בפגיעה צריכה להתמקד במניעה ולתת הגנה למי שמדווחים בתום לב — בלי להעניק פטור על הסתרה או על התנהגות פסולה.
סינגפור יכולה לסייע, אך אמון צריך להרוויח
טאו קראה לבנות אמצעי הגנה במקביל לאימוץ הבינה המלאכותית. לפי דיווחים, כלי הבדיקה AI Verify והמכון הסינגפורי לבטיחות בינה מלאכותית הם חלק מהתשתית שסינגפור מפתחת בתחום.
1
3 היא עשויה לארח בדיקות משותפות או חילופי ידע טכני חסויים כחלק מרשת רחבה יותר של מעבדות מוסמכות.
אבל עצם האירוח לא יהפוך מתקן כזה למקובל על ארצות הברית ועל סין. לשם כך יידרשו ממשל שקוף, כללים לגישה מאובטחת, אפשרות לערער על החלטות והשתתפות בפועל של שתי המדינות. רשת מבוזרת גם תמנע תלות במוקד יחיד.
להתחיל בסיכונים משותפים, לא בוויכוח על האטה
המחלוקת על קצב הפיתוח עמוקה. לפי רויטרס, דריו אמודיי מאנתרופיק, סם אלטמן מ־OpenAI ואילון מאסק קראו להאטה מתואמת; מארק צוקרברג העדיף אמצעי הגנה בהובלת השוק, וג'נסן הואנג התנגד לצורך ברגולציה חדשה.
47
48 סין דחתה קריאות להאטה, והנשיא דונלד טראמפ אמר כי אינו מצפה להתקדמות בהצבת מגבלות בטיחות לבינה מלאכותית בפגישתו עם שי ג'ינפינג ב־24 בספטמבר.
58
50 גם הסיקור לקראת הפסגה הצביע על ציפיות נמוכות לפריצת דרך משמעותית.
49
אין הכרח לפתור את המחלוקת הזאת לפני שמטפלים בסכנות ששני הצדדים רוצים למנוע. לפי דיווח על הצעות של מומחי ביטחון אמריקאים וסינים, נקודות פתיחה אפשריות הן קווים אדומים סביב מערכות גרעיניות, שמירה על שליטה אנושית במתקפות סייבר בעלות השלכות כבדות וקו חירום לתקריות שמעורבת בהן בינה מלאכותית אוטונומית.
20 מכאן אפשר להתקדם להגדרות מוסכמות של תקריות חמורות, להודעות חירום ולדיונים טכניים הדדיים. השתתפות אמריקאית־סינית חשובה, אך גם למדינות אחרות דרוש קול בקביעת הכללים וגישה ליכולת בדיקה.
חובות מחמירות במקום שבו הסיכון גדול
מהסכמי בקרת נשק אפשר לשאוב עיקרון: להתחיל בהתחייבויות הדדיות ומוגדרות היטב, שאפשר לבדוק אם קוימו. מפיקוח פיננסי אפשר לשאוב עיקרון נוסף: להחמיר בדרישות כאשר כשל עלול לפגוע בציבור בהיקף גדול. לכן מפתחים ומפעילים של מערכות בסיכון גבוה עשויים להידרש להערכות עצמאיות, לאחריות ניהולית, לתוכניות התאוששות ולדיווח מהיר על כשלי בטיחות חמורים, דליפות מידע משמעותיות, פריצות או גניבת מודל. שירותים בסיכון נמוך יוכלו להסתייע בתשתיות בדיקה משותפות ובתיעוד פשוט יותר; גודלה הקטן של חברה לא יפטור מערכת מסוכנת מבדיקה מחמירה.
אמנה ומוסד קבוע עד 2030 הם יעד מדיניות שאפתני, לא תחזית. מבחן התקדמות אמין יותר הוא פשוט: האם מדינות יסכימו מה נחשב לתקרית חמורה, מי רשאי לבדוק מערכת באופן עצמאי, אילו אמצעי הגנה יוכרו הדדית — והאם רגולטורים יוכלו לפעול כשהראיות אינן עומדות במבחן.