Inherent טוענת ש Faraday, סוכן בן 27 מיליארד פרמטרים, גבר על Claude Opus 4.8 ועל GPT 5.5 במשימות לשחזור תוצאות מחקר — אך לא הוכח שהוא מסוגל לגלות ידע מדעי חדש. הסוכן נבחן ב Replica, אמת מידה הכוללת 310 משימות שנבנו מתוך 100 מאמרים בתחומי למידת מכונה ומדע מבוסס AI, בלי גישה לתרשימים המקוריים.
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Inherent, a London AI lab founded by Google DeepMind alumni, announce about its 27-billion-parameter Faraday AI agent’s ability to. Article summary: Inherent says its 27-billion-parameter Faraday agent can independently reproduce findings from published scientific papers without being given the answer beforehand, and that it outperformed Anthropic’s Claude Opus 4.8 a. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
מעבדת ה-AI הלונדונית Inherent, שנוסדה בידי יוצאי Google DeepMind, טוענת שסוכן המחקר שלה Faraday — מודל בעל 27 מיליארד פרמטרים — מסוגל לשחזר ממצאים ממאמרים מדעיים שפורסמו, מבלי לקבל מראש את התשובה. החברה מוסיפה כי Faraday עקף את Claude Opus 4.8 של Anthropic ואת GPT-5.5 של OpenAI במשימת שחזור המחקרים הזו. 259
אם התוצאה תאושר בבדיקות רחבות ועצמאיות יותר, מדובר בהישג מעניין. עם זאת, חשוב לסייג את הכותרת: Faraday נבחן על שחזור תוצאות קיימות, לא על גילוי עצמאי של ידע מדעי חדש.
Inherent פיתחה את Replica — אמת מידה שנבנתה מתוך 100 מאמרים בתחומי למידת מכונה ומדע מבוסס AI, והומרה ל-310 משימות שחזור. בכל משימה נדרש הסוכן לשחזר תרשים מסוים מתוך מאמר, תחת מגבלות של זמן ומשאבי מחשוב, ומבלי לראות את התרשים המקורי. 34
זו משימה מורכבת יותר מבקשה פשוטה לסכם מאמר או להעתיק תרשים שפורסם. הסוכן צריך להבין את המחקר, לממש את הניסויים הדרושים, להחליט כיצד לנצל את המשאבים הזמינים ולהפיק תוצאה שתהיה דומה מספיק לממצא המדווח כדי להיחשב לשחזור.
Inherent אומרת ש-Faraday השיג תוצאה טובה יותר מזו של Claude Opus 4.8 ושל GPT-5.5 באמת המידה הזו, אף שהוא מבוסס על מודל קטן בהרבה — בן 27 מיליארד פרמטרים. 158 עם זאת, מדובר בטענה הנוגעת למבחן מוגדר וספציפי, ולא בדירוג כללי של המערכות בכל משימה מדעית או תכנותית.
הטענה המרכזית של Inherent היא שמחקר מדעי מוצלח דורש יותר מהגעה לתוצאה הסופית. חוקר טוב צריך לדעת אילו ניסויים ראוי לבצע, כיצד לתכנן אותם, איך לפרש תוצאות עמומות ומתי לשנות כיוון לאחר שניסיון נכשל. החברה מכנה את מכלול השיקולים הזה „חוש מחקרי” — research taste. 47
ההבחנה הזו חשובה משום שמערכת AI יכולה להפיק תוצאה שנראית סבירה בלי לפעול לפי תהליך מדעי אמין. לפי Inherent, Faraday אומן לפתח התנהגות שמתאימה לחקירה ארוכת טווח: לנסח השערות, לבדוק אותן, ללמוד מכישלונות ולבחור את הצעד הבא בעל הסיכוי הגבוה ביותר לקדם את המחקר. 4
לשם כך השתמשה החברה בלמידת חיזוק ארוכת-אופק. במקום לאמן את המודל רק להתאים את הפלט לתוצאה הרצויה, המטרה היא לעודד רצף של החלטות מחקריות — מתכנון הניסוי ועד הערכת התוצאות.
Inherent רואה בשחזור מחקרים סביבת אימון שימושית להתנהגות הזו. כדי לשחזר תוצאה שפורסמה, הסוכן נדרש לשחזר חלק מתהליך הניסוי והטעייה המעשי שמאמר מדעי לא תמיד מתעד במלואו. לפי התזה הרחבה יותר של החברה, מי שילמד לנווט בתהליך הזה יוכל בעתיד לעבור מאימות ממצאים מוכרים למחקר פתוח יותר. 49
Faraday לא מוצג כתחליף עצמאי לסוכן תכנות רב-עוצמה. במקום זאת, הוא פועל כשכבת פיקוח מדעית שמכוונת את GPT-5.5 Codex של OpenAI במהלך משימות השחזור. Inherent משווה את המבנה הזה לחוקר אנושי שמשתמש בעוזר תכנות: Faraday מספק את התכנון ואת שיקול הדעת המדעי, ואילו Codex מבצע חלק גדול מעבודת המימוש. 39
הגישה הזו מעבירה את הדגש מגודל המודל בלבד ליכולת לתזמר כלים. מודל קטן יותר עשוי להוסיף ערך בכך שיחליט מה המודל הגדול צריך לעשות, מתי כדאי לשנות אסטרטגיה וכיצד להעריך את התוצאות.
לכן, היתרון המדווח של Faraday הוא בחלקו יתרון של ארכיטקטורה ושילוב מערכות: תכנון מדעי ושיקול דעת מצד אחד, ויכולת קידוד מתקדמת מצד אחר. זו אינה הוכחה לכך שמודל בן 27 מיליארד פרמטרים מסוגל באופן כללי יותר ממערכות גדולות ממנו.
Inherent אומרת שהיא רוצה לבנות סוכני AI שישתפו פעולה עם חוקרים כעמיתים. המערכת העתידית אמורה לסייע בתכנון, בביצוע, בביקורת ובאיטרציה של ניסויים, בעוד שבני האדם שומרים על הכיוון ועל הפיקוח. 45
Faraday הוא גרסה מוקדמת של הרעיון הזה: מודל שמנסה לספק אינטואיציה מדעית וניהול של תהליך מחקר, על גבי כלי קידוד כלליים. השאיפה ארוכת הטווח של החברה היא לפתח סוכנים שיוכלו לתרום לגילוי ידע חדש, אך התוצאה הנוכחית מדגימה שחזור — לא גילוי. 34
זהו גבול חשוב. שחזור תוצאה ידועה הוא מבחן משמעותי לאמינות מדעית, אך הוא אינו מוכיח כשלעצמו שסוכן יכול לנסח שאלות מקוריות ובעלות חשיבות, להעלות השערות חדשות באמת או לאמת תגליות בעולם האמיתי.
Inherent יצאה ממצב חשאי כמעבדת מחקר לונדונית ממוקדת, שנוסדה בידי יוצאי Google DeepMind, ולפי הדיווחים גייסה 50 מיליון דולר בסבב סיד. 25 האסטרטגיה שלה היא להתמקד בחלקים של מחקר בסיוע AI שמודלים כלליים אינם בהכרח לומדים באופן אוטומטי: שיקול דעת ניסויי, קבלת החלטות לאורך זמן, הערכה ותיאום בין בני אדם לכלי תוכנה.
האסטרטגיה הזו מסבירה גם מדוע החברה מדגישה את השימוש ב-Faraday במערכת קידוד חיצונית. במקום לנסות לבנות את כל היכולות בתוך מודל יחיד, Inherent מפתחת שכבה מתמחה שאמורה להפוך כלי AI מתקדמים קיימים ליעילים יותר בעבודה מדעית. 39
השורה התחתונה זהירה אך משמעותית: Inherent טוענת שמודל פיקוח קטן יחסית, שאומן בלמידת חיזוק, יכול לעקוף מערכות AI מתקדמות וגדולות יותר במבחן שחזור מוגדר היטב. השאלה החשובה יותר — האם אותה גישה תוביל לתרומות מדעיות מקוריות ואמינות — עדיין פתוחה.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Inherent טוענת ש Faraday, סוכן בן 27 מיליארד פרמטרים, גבר על Claude Opus 4.8 ועל GPT 5.5 במשימות לשחזור תוצאות מחקר — אך לא הוכח שהוא מסוגל לגלות ידע מדעי חדש.
Inherent טוענת ש Faraday, סוכן בן 27 מיליארד פרמטרים, גבר על Claude Opus 4.8 ועל GPT 5.5 במשימות לשחזור תוצאות מחקר — אך לא הוכח שהוא מסוגל לגלות ידע מדעי חדש. הסוכן נבחן ב Replica, אמת מידה הכוללת 310 משימות שנבנו מתוך 100 מאמרים בתחומי למידת מכונה ומדע מבוסס AI, בלי גישה לתרשימים המקוריים.
Faraday מתפקד כשכבת תכנון ושיקול דעת מדעי, ומשתמש ב GPT 5.5 Codex ככלי לביצוע משימות קידוד מורכבות.