במבחן שפרסמה TrueFoundry, TrueForge השלים כ 11 מתוך 14 משימות — בדומה ל Claude Managed Agents — בעלות נמוכה בכ 30% עם Opus 4.8, ועד כ 75% פחות כאשר נעשה שימוש ב GLM 5.2. ההבדל המרכזי הוא שליטה מול נוחות: TrueForge מופץ תחת רישיון MIT, ניטרלי לספקיות מודלים וניתן לאירוח בתשתית הארגון; Claude Managed Agents מספק סביבת...
Research answer

Create a landscape editorial hero image for this Studio Global article: What is TrueFoundry’s TrueForge, how does its open-source, MIT-licensed, vendor-neutral and self-hostable agent harness compare with Anthrop. Article summary: TrueForge is TrueFoundry’s open-source agent runtime/harness: the layer that manages an agent’s tools, context, subagents, code execution, approvals, state, and traces around an LLM. It is MIT-licensed, designed to run i. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
TrueForge הוא תשתית ההפעלה — או ה-harness — של סוכני AI מבית TrueFoundry. הוא יושב סביב מודל השפה ומנהל כלים, הקשר, סוכני משנה, הרצת קוד, אישורים, סשנים, מצב ו-traces. הקוד מופץ תחת רישיון MIT, והוא נועד לרוץ על תשתית שהלקוח שולט בה, בלי לקשור את סביבת ההרצה לספקית מודלים יחידה.
השאלה המעשית אינה אם TrueForge מחליף באופן גורף את Claude Managed Agents. השאלה היא אם הארגון מוכן לקחת בעלות על חלק גדול יותר ממחסנית הסוכן — בתמורה לגמישות בבחירת מודלים, שליטה בנתונים ואפשרות להוזיל את עלות המשימות.
הבידול של TrueForge הוא אפוא ארכיטקטוני, ולא רק קשור למודל. צוות יכול להשתמש באותו harness עם נקודות קצה של מודלים שונים ולהחליט היכן נשמרים סביבת ההרצה, הנתונים והבקרות. Claude Managed Agents מציע מסלול אינטגרטיבי יותר: פחות תשתיות להרכיב ולתחזק, אך תלות גדולה יותר בפלטפורמה ובאקוסיסטם של Anthropic.
TrueFoundry אומרת שהשוותה בין שני ה-harnesses על 14 משימות ברמות 1 ו-2 מתוך Enterprise-Bench של DevRev. המשימות דרשו עבודה מול מערכות ארגוניות, קריאה לשרתי MCP ושילוב מידע לכדי תשובה סופית. לפי החברה, כל תצורה קיבלה את אותן משימות, ובוצעו שלושה ניסויים לכל תצורה.
התוצאות שדווחו:
הנתונים שימושיים כתיאור של המבחן שערכה TrueFoundry, אך אינם ערובה למחיר בכל תרחיש. המבחן קטן יחסית, וההשוואה של 75% משנה גם את סביבת ההרצה וגם את המודל. לכן אי אפשר לבודד ממנה את השפעת TrueForge בלבד לעומת ההשפעה של בחירת GLM-5.2 במקום Opus 4.8. בנוסף, הפחתה נטענת בעלות התפעול הכוללת אינה כוללת בהכרח תשתיות, כוח אדם והוצאות ארגוניות אחרות.
התזה של TrueFoundry נשענת על שני מנופים שונים: יעילות של לולאת הסוכן ובחירת המודל המתאים לכל משימה.
בעת בניית תקציב, אין להסתכל רק על מחיר הרישיון או על מחיר הטוקנים. ניסוי פנימי צריך למדוד גם טוקני קלט ופלט, גידול בהקשר, קריאות לכלים, ניסיונות חוזרים, זמני תגובה, עלות אירוח המודל, רמת מקביליות וזמן בדיקה אנושי. הראיות הציבוריות תומכות בטענות TrueFoundry כפי שדווחו, אך אינן מוכיחות שאותו אחוז חיסכון יופיע בכל מודל, סוכן, עומס עבודה או רמת מקביליות.
אירוח עצמי משנה את השאלה מי שולט בסביבת ההרצה של הסוכן. עם TrueForge, הארגון יכול למקם את ה-runtime בתוך תשתית שבבעלותו או בניהולו, להגדיר גבולות רשת משלו ולקבוע כיצד יטופלו פרומפטים, מסמכים, תוצאות כלים ו-traces. הדבר עשוי להקל על עמידה בדרישות של מיקום נתונים וגישה פנימית — אך אירוח עצמי אינו יוצר ציות רגולטורי באופן אוטומטי. בקרת גישה, שמירת נתונים, ביקורת, ממשל מודלים והרשאות בטוחות לכלים עדיין מחייבים תכנון ותפעול מצד הלקוח.
המחיר של השליטה הוא אחריות תפעולית. פריסת TrueForge עשויה לחייב את הארגון לטפל ב:
שירות מנוהל מסיר חלק גדול מהעבודה הזו ויכול לקצר את הדרך מאב-טיפוס לפרודקשן. בתמורה, הארגון מוותר על חלק מהשליטה ב-runtime ונקשר יותר לפלטפורמה של הספק. השוואות בין סוכנים מנוהלים לאירוח עצמי מציבות את ההחלטה סביב ציות, בעלות על נתונים, ניתוב מודלים, יכולת תפעול והתאמה לעומס העבודה — ולא סביב מחיר התוכנה בלבד.
TrueForge מועמד חזק יותר כאשר הארגון זקוק ל:
Claude Managed Agents מתאים יותר כאשר הצוות מעדיף:
אירוח עצמי אינו זול יותר באופן אוטומטי. שירותים מנוהלים עשויים להיות משתלמים יותר בנפח נמוך או בלתי צפוי, משום שהספק סופג קיבולת לא מנוצלת וחלק ניכר מעלות התפעול. אירוח עצמי נעשה אטרקטיבי יותר כאשר השימוש יציב ומתמשך, בחירת המודל מייצרת חיסכון משמעותי, וכבר קיימת בארגון יכולת תשתיתית לתפעל את המערכת.
TrueFoundry נוסדה בשנת 2021 בידי מהנדסים לשעבר של Meta: Nikunj Bajaj, Abhishek Choudhary ו-Anuraag Gutgutia.
החברה הודיעה על גיוס של 19 מיליון דולר בסבב A, בהובלת Intel Capital ובהשתתפות Peak XV, Eniac Ventures ו-Jump Capital, לצד משקיעים פרטיים.
בין המשתמשים המוקדמים של TrueForge בסביבת פרודקשן, לפי דיווחי החברה, נמצאים NetApp, Automatiq והמערכת הפנימית של TrueFoundry, Ask TFY. מדובר באינדיקציה לשימוש ארגוני מוקדם, אך לא בהוכחה בלתי תלויה לאמינות המוצר במגוון רחב של פריסות פרודקשן.
TrueForge פועל בשכבת ה-agent runtime — שכבה נפרדת מהמודל עצמו ומכלים שמטרתם העיקרית היא לסייע למפתחים לבנות את לוגיקת הסוכן.
ההצעה המשכנעת ביותר של TrueForge אינה ששירותים מנוהלים הפכו למיותרים. המסר הוא שחלק מהארגונים יעדיפו להחזיק בבעלותם את ה-harness שמתחת לסוכנים, כדי לבחור מודלים, לשלוט בפריסה ולהתאים את לולאת הסוכן לדרישות הממשל והאבטחה שלהם.
כותרת המבחן — כ-30% פחות עלות עם אותו מודל Opus ועד כ-75% פחות בעת מעבר ל-GLM-5.2 — מצדיקה ניסוי, אך צריכה להישאר בגדר השערה עד שתשוחזר על משימות שמייצגות את הארגון.
הערכה רצינית צריכה להשתמש בנתונים ובכלים אמיתיים ולהשוות בין שיעור הצלחה, סוגי כשלים, זמני תגובה בקצה העליון, צריכת טוקנים והקשר, עלות המודל והתשתית, בקרות אבטחה, מאמץ תפעולי וזמן בדיקה אנושי. עבור צוותים שאין להם את היכולת או הצורך להפעיל את כל המחסנית הזו, Claude Managed Agents עשוי עדיין להיות הבחירה המעשית יותר. עבור ארגונים שבהם שליטה, ניידות וכלכלת שימוש מתמשך חשובות במיוחד, TrueForge הוא מועמד רציני לפיילוט ארגוני מוגבל — אך לא קיצור דרך מובטח לאמינות בפרודקשן.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
במבחן שפרסמה TrueFoundry, TrueForge השלים כ 11 מתוך 14 משימות — בדומה ל Claude Managed Agents — בעלות נמוכה בכ 30% עם Opus 4.8, ועד כ 75% פחות כאשר נעשה שימוש ב GLM 5.2.
במבחן שפרסמה TrueFoundry, TrueForge השלים כ 11 מתוך 14 משימות — בדומה ל Claude Managed Agents — בעלות נמוכה בכ 30% עם Opus 4.8, ועד כ 75% פחות כאשר נעשה שימוש ב GLM 5.2. ההבדל המרכזי הוא שליטה מול נוחות: TrueForge מופץ תחת רישיון MIT, ניטרלי לספקיות מודלים וניתן לאירוח בתשתית הארגון; Claude Managed Agents מספק סביבת הרצה מנוהלת סביב המודלים של Anthropic.
TrueForge מתאים במיוחד לעומסי עבודה רגישים, עתירי שימוש או מותאמים מאוד — בתנאי שלארגון יש צוותי פלטפורמה, אבטחה ו SRE שיכולים לתפעל את המערכת.