Sampura Research הושק רשמית ב 25 באוגוסט 2026, ולא ב 24 באוגוסט, ומפתח מערכות משולבות של בני אדם ובינה מלאכותית להערכת מודלים מתקדמים. הארגון מזהיר שפיקוח המבוסס על AI בלבד עלול לפספס כשלים חדשים, להיות נתון למניפולציה או לשחזר את אותן טעויות שהמודל המפוקח מנצל.
Research answer

Create a landscape editorial hero image for this Studio Global article: What is Sampura Research, the London-based nonprofit formally launched on August 24, 2026 by former Google DeepMind researchers Rishub Jain,. Article summary: Sampura Research is a London-based AI-safety nonprofit developing “human–AI complementarity for scalable oversight”: systems in which people and AI jointly evaluate increasingly capable models rather than delegating over. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
ככל שמודלי בינה מלאכותית נעשים חזקים ואוטונומיים יותר, מתחדדת שאלה בסיסית: מי, או מה, מוסמך לקבוע אם מערכת AI מתנהגת נכון ובבטחה?
על השאלה הזו מנסה לענות Sampura Research, ארגון ללא מטרות רווח לבטיחות AI שמושבו בלונדון. במקום להוציא את בני האדם מתהליך הפיקוח, הארגון רוצה לתכנן מערכות שבהן בני אדם ובינה מלאכותית חולקים את האחריות להערכת המודלים. סמפורָה הודיעה שקיבלה מענק ראשוני של 11 מיליון דולר מ-Coefficient Giving: 7 מיליון דולר לשנת הפעילות הראשונה ו-4 מיליון דולר נוספים שהובטחו. 1
ההשקה הפומבית מתוארכת ל-25 באוגוסט 2026, ולא ל-24 באוגוסט. בהודעה הרשמית מופיעים Rishub Jain וג'ושוע (Josh) Jacob כמייסדים. פוסטים מוקדמים יותר ברשתות החברתיות הזכירו גם את Alex Adams, אך ההודעה הרשמית אינה קובעת שכל השלושה הקימו את הארגון באופן רשמי. 112
במונחים של סמפורָה, שופט יכול להיות אדם, מודל AI או מערכת משולבת, שתפקידה לבדוק אם ההתנהגות של מערכת AI אחרת נכונה ותואמת את היעדים והערכים שהוגדרו לה. הבדיקה יכולה להתייחס לתשובה יחידה, לשיחה שלמה או למסלול פעולה רב-שלבי של “סוכן” אוטונומי. 1
ההבחנה הזו חשובה משום שפיקוח נוטה להיתפס כבעיה נפרדת מיכולת המודל. מודל יכול לנסח תשובות משכנעות ולהשלים משימות מורכבות, ובכל זאת להטעות את המעריך, לנצל פרצות במנגנון התגמול או לבצע פעולה מסוכנת במהלך רצף ארוך של צעדים.
סמפורָה מגדירה את גישתה כ-השלמה בין אדם ל-AI לצורך פיקוח שניתן להרחיב: להשתמש באוטומציה במקומות שבהם היא אמינה, אך לשמור על מעורבות אנושית במקרים הדורשים שיקול דעת, פרשנות או הכרעות תלויות-ערכים. 1
מערכות AI אטרקטיביות כמפקחות משום שהן מהירות וזולות יותר להפעלה בקנה מידה גדול. אבל מהירות לבדה אינה הופכת מעריך לאמין. בהודעת ההשקה שלה מצביעה סמפורָה על כמה סיכונים מרכזיים:
הטענות האלה אינן מוכיחות שמעריכים אנושיים תמיד טובים יותר. הן מסבירות מדוע סמפורָה רוצה לבדוק איזה שילוב של הערכה אנושית וממוחשבת מתפקד בצורה הטובה ביותר בתנאי לחץ, במקום להניח שבני אדם או AI צריכים לטפל לבדם בכל מקרה. 1
תוכנית העבודה הראשונה של סמפורָה תימשך שישה חודשים ותתמקד בבניית דירוג מגוון של מעריכים, שיכלול יותר מ-20 תתי-מאגרי נתונים. בין תחומי הבדיקה המתוכננים: זיהוי הטעיה, הטיה תרבותית ופעולות לא בטוחות של סוכני AI. 1
הבדיקות לא יסתפקו בשאלות ותשובות סטטיות. סמפורָה מתכננת גם תרחישים שבהם המודל המפוקח מנסה באופן ישיר למטב את התנהגותו מול השופט במהלך למידת חיזוק. המטרה היא לבדוק אם מנגנון ההערכה ממשיך לעבוד גם כאשר למודל יש תמריץ לאתר את חולשותיו ולנצל אותן. 1
המחקר ישווה בין שלוש גישות עיקריות:
המטרה אינה רק להשיג ציון גבוה במבחן צר ומוגדר. סמפורָה אומרת שהיא מחפשת מעריכים שיישארו עמידים במגוון רחב של בדיקות — גם כאשר המודלים שעליהם הם מפקחים ילמדו לנצל טוב יותר את חולשות ההערכה. 1
הארגון הציג כמה דרכים אפשריות לשלב בין שיפוט אנושי לשיפוט ממוחשב:
בגישה הזו, מעורבות אנושית אינה דרישה של “הכול או כלום”, אלא משאב שצריך לתכנן ולייעל. מקרים פשוטים עשויים להתאים לבדיקה אוטומטית זולה ואמינה; מקרים אחרים יצדיקו תשומת לב אנושית איטית ומעמיקה יותר.
לכן השאלה אינה באמת “אדם או AI”, אלא כיצד לאזן בין דיוק, עלות, מהירות ועמידות בפני ניסיון מכוון לעקוף את המערכת. 1
לאחר פיתוח שופטים חזקים יותר, סמפורָה מתכננת לבדוק אם הם יכולים לצמצם פריצת תגמול — מצב שבו מודל מוצא דרך להשיג ציון גבוה בלי לבצע בפועל את המטרה הרצויה — במהלך אימון המודלים. הארגון רוצה גם לבחון כמה מעורבות אנושית נדרשת, כיצד מערכות פיקוח צריכות להשתנות כאשר מודלים לומדים לנצל אותן, והאם אפשר להשתמש בשופטים למשימות רחבות יותר מסיווג פלטים. 1
העבודה עשויה לכלול גם ניסוח או הערכה של מפרטים, הוראות, מדדים, כללי בדיקה ותרחישי מבחן המשמשים לאימון ולהערכת מערכות AI. סמפורָה מסרה כי בכוונתה לפרסם את מחקריה באמצעות מאמרים, קוד, מאגרי נתונים ודירוגים. 1
עם זאת, החומרים הזמינים אינם מאשרים כל פרויקט ספציפי שמקושר לשם הארגון. בפרט, אין בהם אישור למאגר נתונים בשם “forward-looking harm” או לפלטפורמת קוד פתוח מאומתת לדירוג אנושי. לכן יש להתייחס לתיאורים הללו כאל טענות שטרם אומתו, ולא כמוצרים שהוכרזו רשמית.
סמפורָה מגייסת אנשי צוות טכניים ראשונים בלונדון. התוכנית שלה דורשת שילוב של למידת מכונה, תכנון הערכות, אינטראקציית אדם–מחשב, תפעול נתונים והטמעה. 1 פוסטים קודמים ברשתות החברתיות דיברו על גיוס של לפחות שישה חוקרים נוספים ועל שכר של 100 אלף עד 290 אלף ליש"ט, אך ההודעה הרשמית של הארגון אינה מאשרת את הנתונים המדויקים האלה. 1213
השוק הרחב יותר של הערכת AI מתמודד אף הוא על מאגר מצומצם של מומחים. מודעת גיוס של METR לתפקיד בתחום ביצוע ההערכות מציינת שכר בסיס של 285,548 עד 503,116 דולר, ואף אומרת שהארגון עשוי לשקול סכום גבוה יותר עבור מועמדים מנוסים במיוחד. 18
ההשוואה ממחישה את האתגר: פיקוח אמין דורש גם מחקר טכני וגם הערכה קפדנית בעולם האמיתי, בעוד שהארגונים העוסקים בכך מתחרים על רבים מאותם אנשי מקצוע.
השקת סמפורָה מתרחשת על רקע חשש גובר שהתקדמות ה-AI תקדים את מערכות הפיקוח שנועדו לנטר אותה. ביולי 2026 חתמו יותר מ-1,100 עובדים מחברות AI גדולות על מכתב פתוח שקרא לממשל האמריקאי לתמוך בכלים טכניים וממשלתיים בינלאומיים, שיוכלו להאט במכוון את פיתוח ה-AI המתקדם אם יהיה בכך צורך. המכתב לא קרא לעצירה מיידית של פיתוח הבינה המלאכותית. 40
במקביל נרשמו שינויים משמעותיים בקרב חוקרי AI בכירים. רויטרס דיווחה על חילופי תפקידים בהנהלת חטיבת ה-AI של גוגל ועל עזיבת מהנדסים וחוקרים בולטים לחברות ולסטארט-אפים אחרים. 49 ההתפתחויות האלה מספקות הקשר להקמת סמפורָה, אך אינן מוכיחות שהארגון פתר את בעיית הבטיחות הבסיסית.
הראיות הקיימות תומכות בתיאור סמפורָה כארגון מחקר צעיר שבונה תשתית מדידה וקבלת החלטות לפיקוח על מערכות AI. בעתיד, הדירוגים ושיטות ההערכה ההיברידיות שלה עשויים לשמש מעבדות AI, מעריכים עצמאיים וארגונים אחרים שבוחנים את התנהגותם של מודלים. 1
אבל זה שונה מאוד מהוכחה שסמפורָה מסוגלת “לבלום” מערכות AI מתקדמות. התרומה המיידית שלה היא לחקור כיצד צריך לתכנן ולבחון מנגנוני פיקוח כאשר המודל המפוקח חזק, מסתגל, ואולי אף מתומרץ לעבור את הבדיקות בהצלחה בלי להיות בטוח באמת.
ההימור המרכזי של סמפורָה הוא שבטיחות בקנה מידה גדול תדרוש אוטומציה — אבל לא אוטומציה שתסלק את בני האדם מההכרעות החשובות ביותר.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Sampura Research הושק רשמית ב 25 באוגוסט 2026, ולא ב 24 באוגוסט, ומפתח מערכות משולבות של בני אדם ובינה מלאכותית להערכת מודלים מתקדמים.
Sampura Research הושק רשמית ב 25 באוגוסט 2026, ולא ב 24 באוגוסט, ומפתח מערכות משולבות של בני אדם ובינה מלאכותית להערכת מודלים מתקדמים. הארגון מזהיר שפיקוח המבוסס על AI בלבד עלול לפספס כשלים חדשים, להיות נתון למניפולציה או לשחזר את אותן טעויות שהמודל המפוקח מנצל.
בתוכנית העבודה הראשונית, שאורכה שישה חודשים, ייבנה דירוג שופטים הכולל יותר מ 20 תתי מאגרי נתונים, תוך השוואה בין מעריכים אנושיים, מערכות AI ומערכות היברידיות.