הערכתו של אוון היובינגר לסיכוי של יותר מ־10% הייתה תחזית אישית, לא מדיניות של Anthropic ולא קונצנזוס מדעי. המחלוקת אינה טענה שהמודלים הקיימים צפויים לגרום לאסון מיידי: היובינגר הגדיר את הסיכון מהם כנמוך.
פורסם על ידינערך באמצעות GPT-5.6 Terraהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Anthropic alignment science lead Evan Hubinger’s public statement that he personally believes there is more than a 10% chance AI co. Article summary: Hubinger’s statement chiefly exposed a sharp mismatch between frontier-AI labs’ public safety posture and the private-level uncertainty described by people closest to the work: a senior alignment lead said the field may . Topic tags: general, general web, news, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
הדברים שפרסם אוון היובינגר לא הוכיחו שבינה מלאכותית תגרום להכחדת האנושות. הם חשפו משהו ממוקד יותר — ובעל משמעות ציבורית חריגה: מי שמוביל ב־Anthropic את תחום מדע היישור (alignment) כתב שלדעתו האישית יש יותר מ־10% סיכוי לכך בעשור הקרוב, ובאותה נשימה הודה שלחברה עדיין אין תוכנית לפתור את בעיית היישור של בינת־על, ואף אין לה מסלול ברור לפתרון כזה. 1
2
הצירוף הזה חיזק את ליבת האזהרה של ג'ייקוב קוקסון, חוקר לשעבר ב־Anthropic וב־OpenAI שהתפטר: מעבדות ה־AI המובילות עשויות לדחוף למערכות בעלות יכולות גדלות והולכות, בעוד שהשיטות להבטיח שמערכות כאלה יישארו נאמנות לכוונה האנושית עדיין לא הוכחו. 2
3
הנתון של „יותר מ־10%” היה הערכתו של היובינגר עצמו. הוא לא הוצג כאומדן הסתברות רשמי של Anthropic, כהסכמה בין עובדי החברה או כתחזית מדעית מבוססת ומוסכמת. 1
2
הסייג הזה מהותי. הסתברות לבדה אינה מסבירה מנגנון, אינה קובעת לוח זמנים ואינה מוכיחה שאסון הוא תוצאה סבירה. לפי הדיווחים, היובינגר גם אמר שהסיכון מהמודלים הזמינים כיום נמוך. חששו נגע למערכות עתידיות שעלולות להיות מסוגלות בהרבה, לרבות באמצעות שיפור עצמי רקורסיבי — שימוש ביכולות AI כדי לסייע ביצירת AI מתקדם יותר. 2
10
ובכל זאת, יש משמעות לכך שהדברים באו מאדם המוביל עבודת יישור במעבדת AI מהחזית הטכנולוגית. הגילוי המרכזי איננו רק המספר הדרמטי, אלא הפער בין התקדמות ביכולות לבין ביטחון שאפשר יהיה להשאיר מערכות בינת־על תחת שליטה אנושית. 1
2
קוקסון, שעבד בעבר גם ב־OpenAI וגם ב־Anthropic, התפטר בטענה שאף אחת מהחברות אינה פועלת באחריות, ושהן מתחרות בדרך לבינת־על המשפרת את עצמה. היובינגר הסכים בפומבי עם טענתו של קוקסון שלאנשים הבונים את המערכות הללו יש חשש כנה מתרחישים ברמת הכחדה. 2
3
אין בכך הוכחה שכל העובדים שותפים לעמדה אחת, ואין בכך להפוך את תיאורו של קוקסון להערכה מאומתת באופן בלתי תלוי של שתי החברות. אבל קשה יותר להציג את ההתפטרות כתלונה בודדת של עובד לשעבר: מנהל יישור מכהן אישר את נקודת היסוד — דאגה פנימית רצינית יכולה להתקיים לצד המשך פיתוח של מודלי חזית. 1
2
גם את דבריו של סמואל מרקס יש לקרוא בזהירות דומה. לפי הדיווחים, הוא אמר שמפתחי AI מאמינים שהטכנולוגיה עלולה לגרום להכחדת האנושות או לתוצאות חמורות באותה מידה; אולם זו נקודת מבט של גורם מבפנים, ולא ראיה שפורסמה להערכת סיכון כלל־חברתית. 5
קל לצמצם את הפרשה ל„נביאי זעם של AI מול אופטימיסטים”. השאלה המעשית יותר היא אילו אמצעי הגנה צריכים להיות מחייבים כאשר הנזק האפשרי הוא עולמי ובלתי הפיך, אך ההסתברות ולוח הזמנים אינם ודאיים מאוד.
דברי היובינגר מחדדים כמה סוגיות:
אלה בעיות ממשל, לא הוכחה לאסון קרוב. אבל בדיוק בעיות כאלה עלולות להיות קשות הרבה יותר לפתרון לאחר שמערכות ישיגו יכולות מסוכנות.
לפי דיווחים, Anthropic סירבה להגיש את המודל העדכני שלה לבדיקה במכון הבטיחות ל־AI של בריטניה לפני השקתו. יש להתייחס לכך בזהירות: החשבונות הזמינים מתארים זאת כדיווח, ולא כממצא פומבי מאומת של החברה או של ממשלת בריטניה. 10
ועדיין, הטענה ממחישה מדוע התחייבויות בטיחות וולונטריות מעוררות ספקנות. אם מובילי הבטיחות בחברה עצמה מכירים באתגרי יישור שטרם נפתרו, משקיפים מבחוץ ישאלו באופן סביר אילו בדיקות נערכו, מי בחן אותן, אילו תוצאות חולקו, ואילו ספי יכולת מחייבים בקרות מחמירות יותר.
קריאה „להאט” אינה חייבת להיות דרישה להפסיק לצמיתות כל מחקר או פריסה של AI. הטיעון המדיניותי הוא לבדיקות מחייבות לפני שמערכות חוצות ספי יכולת בעלי השלכות חריגות.
צעדים אפשריים כוללים:
ההיגיון פשוט: אם ההסתברות אינה ודאית אך המחיר האפשרי קיצוני, אמצעי ההגנה צריכים להיות ניתנים להדגמה לפני אובדן שליטה — ולא אחריו.
הפוסט של היובינגר חשף מתח בלב תחום ה־AI המתקדם: מפתחים מובילים יכולים להכיר בפומבי בסיכונים חמורים לטווח הארוך, ובו בזמן להמשיך לבנות את היכולות שהופכות את הסיכונים הללו לדחופים יותר. 1
2
הוא אינו מכריע מהי ההסתברות לנזק קטסטרופלי מבינה מלאכותית, ואין להתייחס אליו כאל תחזית רשמית של Anthropic. אך הוא הופך את ויכוח היישור לקונקרטי יותר. השאלה אינה רק אם AI מתקדם עלול להיות מסוכן, אלא אם חברות וממשלות יכולות להראות — באמצעות ראיות עצמאיות, כללים אכיפים ותיאום בינלאומי — שהן ערוכות לכך לפני שהמערכות הנדונות יהיו חזקות מכדי למשול בהן בבטחה. 1
10
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
הערכתו של אוון היובינגר לסיכוי של יותר מ־10% הייתה תחזית אישית, לא מדיניות של Anthropic ולא קונצנזוס מדעי.
הערכתו של אוון היובינגר לסיכוי של יותר מ־10% הייתה תחזית אישית, לא מדיניות של Anthropic ולא קונצנזוס מדעי. המחלוקת אינה טענה שהמודלים הקיימים צפויים לגרום לאסון מיידי: היובינגר הגדיר את הסיכון מהם כנמוך.
הפרשה ממקדת את הדיון בשקיפות תאגידית, בבדיקות חיצוניות, ברגולציה ובתיאום בינלאומי — ולא בעימות פשטני בין אופטימיסטים לפסימיסטים.