Yksi podi tarjoaa noin yhden megawatin IT-laskentatehoa ja sisältää noin 1 200 GPU:ta. Laitteet on järjestetty 2–8 GPU:n solmuiksi. Pääasiallisena työjuhtana toimivat NVIDIA RTX PRO 6000 -grafiikkasuorittimet, kun taas B200- ja B300-sarjan GPU:ita käytetään raskaampiin työkuormiin .
Kontin päälle asennetaan suunnilleen kontin kokoinen jäähdytin. Sisällä ei ole tavallisia palvelimia sellaisenaan, vaan Runware on suunnitellut kokonaisuuden tätä käyttötarkoitusta varten: palvelimet ovat kotelottomia, telineet räätälöityjä ja tiedonsiirto perustuu yhtiön omaan PCIe-kytkentään. Jokaisessa palvelimessa on myös paikallinen NVMe-tallennus .
Tavoitteena on ajaa tekoälymalleja mahdollisimman lähellä niiden käyttäjiä ja asiakkaita. Kaikki podit muodostavat yhden verkotetun kokonaisuuden, joka ohjaa pyynnöt reaaliajassa lähimpänä olevaan vapaaseen kapasiteettiin . Tässä yhteydessä inferenssi tarkoittaa valmiin tekoälymallin käyttämistä vastauksen, kuvan, videon tai muun tuloksen tuottamiseen.
Tekoälypalvelujen kysyntä kasvaa nopeasti, mutta suurten datakeskusten rakentamista rajoittavat muun muassa luvat, sähköverkon kapasiteetti, jäähdytys ja rakennusaika. Runwaren malli pyrkii kiertämään osan näistä pullonkauloista valmistamalla yksiköt valmiiksi ja viemällä ne paikkoihin, joissa sähköä ja verkkoyhteyksiä on jo saatavilla.
Yhtiön mukaan podi voidaan asentaa noin päivässä sen jälkeen, kun se on toimitettu. Se tarvitsee vain sopivan maa-alueen, sähkönsyötön ja verkkoyhteyden . Käyttöönotto kolmessa viikossa sisältää siis koko prosessin tilauksesta toimintavalmiiseen yksikköön, kun taas itse paikalle asennus on huomattavasti nopeampi vaihe.
Runware kertoi julkaisun yhteydessä, että sillä oli jo 10 podia käytössä Yhdysvalloissa, Euroopassa ja Aasian–Tyynenmeren alueella . Euroopassa liikennettä käsiteltiin jo, ja Yhdysvaltojen länsirannikon käyttöönotot olivat käynnissä .
Yhtiö on ilmoittanut tunnistaneensa 160 sijaintia laajentumista varten vuoden 2026 jälkipuoliskolla. Tavoitteena on tuoda vuoden aikana verkkoon yhteensä 10 000 inferenssisolmua ja kasvattaa kapasiteetti yli yhteen gigawattiin vuonna 2027 .
Nämä ovat Runwaren julkistamia tavoitteita, eivät vielä toteutuneita kapasiteettilukuja.
Sonic Pod -julkistusta edeltänyt Runware-alusta oli yhtiön mukaan tuottanut yli 10 miljardia tekoälygenerointia yli 200 000 kehittäjälle ja yli 300 miljoonalle loppukäyttäjälle . Asiakkaiksi on nimetty muun muassa Wix, Together.ai, ImagineArt, Quora, OpenArt, Freepik ja Higgsfield AI sekä kymmeniä yksityisiä yritysasiakkaita .
Runwaren verkkosivustolla ilmoitettiin heinäkuussa 2026 yli 20 miljardia käsiteltyä pyyntöä, yli 500 miljoonaa loppukäyttäjää, yli miljoona kehittäjää ja yli 400 000 alustalla olevaa mallia . Luvut kuvaavat yhtiön koko alustan käyttöä, eivät yksinomaan Sonic Inference Podien suorituskykyä.
Runware on kertonut kahdesta merkittävästä rahoituskierroksesta:
Näiden kahden kierroksen yhteenlaskettu arvo on 63 miljoonaa dollaria. Joissakin ulkopuolisissa rahoitusuutisissa kokonaismääräksi on ilmoitettu 66 miljoonaa dollaria, joten yhtiön kokonaisrahoituksesta esiintyy lähteissä pieni ero .
Runware nostaa esiin erityisesti neljä etua.
Vettä ei kulu jäähdytykseen. Suljettu järjestelmä kierrättää samaa noin 1,5 kuutiometrin vesimäärää jatkuvasti. Runwaren mukaan se ei kuluta vettä eikä tuota jätevettä normaalikäytössä. Järjestelmä pitää lämpötilan kahden celsiusasteen sisällä myös jatkuvassa kuormituksessa .
Sähköä voidaan käyttää lähempänä käyttäjiä. Podit voidaan sijoittaa esimerkiksi teollisuusalueille, datakeskuskampuksille tai sähköasemien läheisyyteen. Runwaren perustelun mukaan tämä voi lyhentää siirtomatkoja ja vähentää sähkönsiirron häviöitä verrattuna yhteen kaukana sijaitsevaan jättidatakeskukseen .
Olemassa olevaa sähkökapasiteettia voidaan hyödyntää. Malli on tarkoitettu paikkoihin, joissa sähköä on jo saatavilla, jolloin uuden verkkokapasiteetin rakentamista tai pitkiä verkkoyhtiöneuvotteluja ei välttämättä tarvita . Tämä ei kuitenkaan tarkoita, että jokainen sijainti olisi automaattisesti valmis 1 MW:n kuormalle.
Kapasiteetti voidaan tuoda sinne, missä sitä tarvitaan. Runware tiivistää lähestymistapansa ajatukseen, että laskentateho viedään sähkön ja käyttäjien luo sen sijaan, että kaikki liikenne ohjattaisiin kaukana sijaitseviin keskitettyihin datakeskuksiin .
Sonic Inference Pod on Runwaren veto siihen, että tekoälyn infrastruktuuri ei jatkossa tarkoita vain valtavia, vuosia rakennettavia datakeskuksia. Jos yhtiön kustannus- ja toimituslupaukset toteutuvat, standardoitu kontti voisi tarjota tavan lisätä inferenssikapasiteettia vaiheittain ja sijoittaa sitä lähemmäksi käyttäjiä.
Toistaiseksi merkittävimmät luvut – 160 sijaintia, 10 000 solmua vuoden 2026 aikana ja yli 1 GW vuonna 2027 – ovat Runwaren tavoitteita. Ensimmäiset 10 podia muodostavat vasta alkupisteen, mutta ne näyttävät, millä tavalla yhtiö aikoo vastata tekoälypalvelujen kasvavaan laskentatarpeeseen: rakentamalla datakeskuksen valmiiksi, pakkaamalla sen konttiin ja toimittamalla sen sinne, missä sähköä ja kysyntää jo on.