ENPIRE (Embodied Neural Policy Improvement through Physical AutoResearch) היא מסגרת ששוחררה ב 17 ביוני 2026 על ידי NVIDIA GEAR Lab, אוניברסיטת קרנגי מלון ו UC Berkeley [3][5][8]. המערכת מורכבת מארבעה מודולים: סביבה (EN), שיפור מדיניות (PI), ריצה (R) ואבולוציה (E) היוצרים לולאת משוב פיזית אוטונומית [3][4][5].
Research answer

Create a landscape editorial hero image for this Studio Global article: What is ENPIRE, the framework released on June 17 by Nvidia's GEAR Lab, Carnegie Mellon University, and UC Berkeley, and how does it use AI. Article summary: Here is the full breakdown of ENPIRE and its context.. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
במשך עשרות שנים, אימון רובוט לבצע משימה פיזית מדויקת – כמו הכנסת כרטיס גרפי ללוח אם או קשירת אזיקון – הצריך עבודה אנושית רבה: איפוס הסצנה, כיוונון אלגוריתמים, ניתוח כשלים וכתיבת קוד מחדש. צוואר הבקבוק לא היה רק האלגוריתמים; זו הייתה העבודה האנושית.
ב-17 ביוני 2026, צוות מ-NVIDIA GEAR Lab, אוניברסיטת קרנגי מלון (Carnegie Mellon University) ו-UC Berkeley שחרר מסגרת שמשנה את המשוואה הזו. המסגרת, הנקראת ENPIRE (Embodied Neural Policy Improvement through Physical AutoResearch), היא המערכת המתועדת הראשונה שבה סוכני AI אוטונומיים מריצים את מחזור המחקר הרובוטי המלא על חומרה פיזית .
ENPIRE היא לא רובוט בפני עצמו, ולא מודל AI חדש. זוהי מסגרת רתמה (harness framework) – תוכנה שעוטפת סוכני AI ומעניקה להם את הכלים לערוך ניסויים פיזיים. התובנה המרכזית, לפי צוות המחקר, היא שבחקר הרובוטיקה חסרה לולאת משוב פיזית שניתנת לשחזור, ו-ENPIRE מספקת בדיוק את ההפשטה הזו .
המסגרת משחררת סוכני AI על צי של רובוטים ומעניקה להם את כל הלולאה: לאפס את הסביבה, לחפש בספרות, לממש רעיונות, לאמן ולפרוס מדיניות, לאמת את התוצאות, לנתח לוגים, לשכתב קוד, ולחזור על התהליך עד שהמדיניות עובדת באופן אמין בעולם האמיתי .
הארכיטקטורה של ENPIRE היא לולאה סגורה המורכבת מארבעה מודולים, כל אחד מטפל בחלק קריטי מתהליך המחקר הפיזי :
EN — מודול הסביבה: מאפס אוטומטית את הסצנה הפיזית למצב התחלתי אקראי ומאמת את השלמת המשימה באמצעות פונקציות תגמול מבוססות ראייה (למשל, מודלי סגמנטציה וגלאי תיבות חוסמות). אין צורך שבן אדם יאפס את הרובוט בין ניסוי לניסוי .
PI — מודול שיפור המדיניות: מפעיל חידוד מדיניות באמצעות מגוון שיטות – למידה היוריסטית, קריאת כלים, חיקוי התנהגות, למידת חיזוק מקוונת ולא מקוונת. סוכן התכנות מציע השערות אלגוריתמיות וכותב את הקוד .
R — מודול הריצה: מעריך את מדיניות המועמד על רובוט אחד או מספר רובוטים הפועלים במקביל. הוא שומר מידע על מצב, פעולה, וידאו ותוצאות לצורך ביקורת .
E — מודול האבולוציה: סוכני התכנות מנתחים לוגים, מתייעצים בספרות מחקרית, משווים ענפים, ומשנים את תשתית האימון ואת קוד האלגוריתם כדי לטפל במצבי כשל. מתכונים מוצלחים ממוחזרים; השערות נכשלות נגזמות .
במקום להמציא שכבת תיאום אקזוטית, המסגרת מסתמכת על כלי מוכר לשיתוף פעולה מבוזר: Git. כאשר תחנת סוכן אחת מגיעה לפריצת דרך, היא מבצעת commit לקוד המדיניות המשופר. תחנות אחרות מושכות את העדכון ובונות עליו, מה שמאפשר שיפור מבוזר וא-סינכרוני ללא תיאום מרכזי .
הצוות פרס שמונה סוכני AI בשילוב שמונה תחנות עבודה רובוטיות, כל אחת מצוידת בשתי זרועות מכניות עם שש דרגות חופש, מצלמות עומק Intel RealSense, ומעבדי NVIDIA RTX 5090 מקומיים. בהינתן הקצאה של GPUs ותקציב tokens נדיב, הצי שוחרר עם מטרה פשוטה: לפתור את המשימה במהירות האפשרית, לשמור על הרובוטים פעילים אך בטוחים, ולא לבזבז כוח חישוב .
סוכנים המופעלים על ידי ENPIRE השיגו 99% pass@8 במערך של משימות תמרון עדין ומאתגרות בעולם האמיתי :
העיתון מציין ש-pass@8 מודד ניסיון חוזר והחלמה מתוך ריצה ארוכת טווח אחת (עד 8 ניסיונות חוזרים בהקשר, מותנים בכשלונות קודמים), לא מדגם i.i.d. של 8 הריצות הטובות ביותר .
העיתון מציג שני מדדים חדשים: Mean Robot Utilization (MRU) ו-Mean Token Utilization (MTU) למדידת היעילות של מחקר פיזי אוטונומי רב-סוכנים .
המערכת צורכת כמות גדולה של tokens. סוכנים קוראים מאמרים, כותבים קוד, מנתחים לוגים וחוזרים חלילה – כל מחזור שיפור צורך כמות משמעותית של tokens מ-LLM. הצוות נתן לסוכנים "תקציב tokens נדיב" והורה להם לא לבזבז כוח חישוב .
כל שלושת סוכני התכנות שנבדקו – Codex (עם GPT-5.5), Claude Code (עם Opus 4.7) ו-Kimi Code (עם Kimi K2.6) – פתרו את משימת Push-T בסימולציה. עם זאת, לא כולם עברו בצורה חלקה לחומרה אמיתית. ENPIRE אינה מבטלת את פער sim-to-real; היא נותנת לסוכני AI דרך לגלות את הפער הזה דרך ניסויים פיזיים חוזרים ולהסתגל אליו . זהו כשל מרכזי שהעיתון מכיר בו
.
העיתון כולל סעיף "מגבלות וכיוונים עתידיים" המציין ש-ENPIRE עדיין דורשת הגדרה ראשונית של הסביבה (חומרה, צינור ראייה ממוחשבת), ושהגישה מוגבלת באיכות ובעלות של מודלי ה-LLM הבסיסיים של סוכני התכנות .
כאשר הצוות הגדיל את הצי מרובוט אחד לשמונה רובוטים, הזמן לשליטה במשימת הפינים התקצר מיותר מ-1.5 שעות לכ-40 דקות. עם זאת, צריכת ה-tokens גדלה באופן מעריכי: ככל שיותר סוכני AI עובדים במקביל, הם לא רק מריצים ניסויים אלא גם "קוראים" את העבודה של האחרים, מה שמגדיל משמעותית את צריכת האנרגיה החישובית .
ENPIRE נמצאת בתוך אסטרטגיה רחבה בהרבה של NVIDIA ל-Physical AI – AI שמבין ופועל בעולם הפיזי. שותפויות עם יונדאי (Hyundai Motor Group) להקמת מפעל AI עם 50,000 GPUs מדגם Blackwell, עם פוקסקון (Foxconn), ג'נרל מוטורס (General Motors) ואחרות לאימוץ NVIDIA Omniverse כמערכת הפעלה פיזיקלית AI . ENPIRE היא שכבת האוטומציה המחקרית על גבי תשתית זו – דרך לסגור את הלולאה בין סימולציה (Cosmos/Isaac), חומרה (ציי רובוטים, מפעלי AI) ושיפור מדיניות אוטונומי, המונעים על ידי סוכני AI מתקדמים.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
ENPIRE (Embodied Neural Policy Improvement through Physical AutoResearch) היא מסגרת ששוחררה ב 17 ביוני 2026 על ידי NVIDIA GEAR Lab, אוניברסיטת קרנגי מלון ו UC Berkeley [3][5][8].
ENPIRE (Embodied Neural Policy Improvement through Physical AutoResearch) היא מסגרת ששוחררה ב 17 ביוני 2026 על ידי NVIDIA GEAR Lab, אוניברסיטת קרנגי מלון ו UC Berkeley [3][5][8]. המערכת מורכבת מארבעה מודולים: סביבה (EN), שיפור מדיניות (PI), ריצה (R) ואבולוציה (E) היוצרים לולאת משוב פיזית אוטונומית [3][4][5].
שמונה סוכני AI עם שמונה רובוטים שיתפו פעולה דרך Git, והגיעו ל 99% הצלחה במשימות כמו התקנת GPU, קשירת אזיקונים וסידור פינים [3][5][7].