הפוד הוא יחידת הסקה עצמאית שתוכננה מראש לעומסי עבודה של בינה מלאכותית. בתוך המכולה משולבים כ-1,200 מעבדי GPU, בדרך כלל במבנים של 2 עד 8 מעבדים לצומת. דגמי NVIDIA RTX PRO 6000 משמשים כמעבדי העבודה המרכזיים, ולצדם דגמי B200 ו-B300 עבור עומסים גדולים יותר .
מעל המכולה מותקן מצנן — בערך בגודל המכולה עצמה. בתוך המערכת נמצאים שרתים ללא מארזים, מסילות מותאמות אישית, מיתוג PCIe קנייני, מעבדים בתדר גבוה ואחסון NVMe מקומי. המטרה היא לצמצם רכיבים שאינם חיוניים ולהגדיל את צפיפות המחשוב ואת קצב העיבוד .
הפודים אינם יחידות מבודדות לחלוטין. Runware מחברת אותם לצי רשת אחד, שמנתב כל בקשת הסקה בזמן אמת אל הקיבולת הזמינה הקרובה ביותר. כך החברה מבקשת לקרב את כוח החישוב למשתמשים ולמקורות החשמל, במקום להעביר את כל התעבורה למרכזי ענק מרוחקים .
החום שנוצר מריכוז של כ-1,200 מעבדי GPU בשטח קטן הוא אחד האתגרים המרכזיים של המערכת. Runware משתמשת במערכת קירור נוזלית אטומה ובמעגל סגור, שממחזרת ללא הפסקה כ-1.5 מטרים מעוקבים של מים .
לדברי החברה, המים אינם נצרכים במהלך הפעולה הרגילה: אין צורך באספקת מים רציפה, אין שפכים ואין זיהום. שילוב של הקירור הנוזלי עם קירור יבש שומר, לפי Runware, על יציבות טמפרטורה של עד 2 מעלות צלזיוס תחת עומס מתמשך .
במועד ההשקה דיווחה Runware על 10 פודים שכבר הוצבו בארצות הברית, באירופה ובאזור אסיה-פסיפיק . אירופה כבר החלה לטפל בתעבורה, בעוד שהפריסה בחוף המערבי של ארצות הברית יצאה לדרך .
החברה זיהתה 160 אתרים לפריסה במחצית השנייה של 2026, ומכוונת להעלות לרשת עד 10,000 צומתי הסקה במהלך התקופה. היעד הרחב יותר הוא לעבור את רף 1 גיגה-ואט של קיבולת הסקה ב-2027 .
המספרים מצטרפים לפעילות שכבר קיימת בפלטפורמת Runware. החברה דיווחה כי השירותים שלה הפעילו יותר מ-10 מיליארד יצירות AI עבור יותר מ-200 אלף מפתחים ויותר מ-300 מיליון משתמשי קצה . בין הלקוחות ששמם פורסם נמצאות Wix, Together.ai, ImagineArt, Quora, OpenArt, Freepik ו-Higgsfield AI, לצד עשרות פריסות ארגוניות פרטיות .
באתר החברה, נכון לאמצע 2026, הופיעו נתונים של יותר מ-20 מיליארד בקשות שטופלו, יותר מ-500 מיליון משתמשי קצה, יותר ממיליון מפתחים ויותר מ-400 אלף מודלים בפלטפורמה .
Runware גייסה שני סבבי מימון מרכזיים:
לפי הסכומים שדווחו בסבבים אלה, החברה גייסה בסך הכול 63 מיליון דולר .
הטיעון של Runware אינו מסתכם בחיסכון בעלויות. מודל המכולות נועד גם להתמודד עם צווארי הבקבוק שמלווים את התרחבות תשתיות ה-AI:
Sonic Inference Pod מציג שינוי כיוון אפשרי בתשתיות הבינה המלאכותית: במקום לבנות עוד מרכזי ענק מרוחקים, Runware מבקשת לפרוס יחידות מחשוב מוכנות מראש בדיוק היכן שיש חשמל, קישוריות וביקוש.
ההבטחה — עלויות הסקה נמוכות משמעותית, פריסה בתוך שבועות וקירור ללא צריכת מים — עדיין נשענת על טענות החברה. אבל עם 10 פודים פעילים, 160 אתרים בתכנון ויעד של יותר מ-1 גיגה-ואט ב-2027, Runware מהמרת שמרכז הנתונים הבא לא יהיה בהכרח בניין עצום, אלא מכולה שאפשר לשנע למקום הנכון.