Sonic Inference Pod 係一個完全自給自足嘅推理運算單元。每個 Pod 塞滿大約 1,200 張 GPU——主力用 NVIDIA RTX PRO 6000,重型工作就用 B200 同 B300 系列 GPU——每 2 至 8 張 GPU 組成一個節點 。成個單位放到一個 20 呎貨櫃入面,上面再疊一個同貨櫃差唔多大細嘅冷水機。所有硬件都係由零開始自家設計:無機箱伺服器、自訂機架、專利 PCIe 交換器、高頻 CPU 同本地 NVMe 儲存 。
散熱方面用咗密封式閉環液體冷卻系統,持續循環大約 1.5 立方米嘅水,唔會消耗水、無廢水、無污染 。喺持續負載下,系統溫差可以維持喺 2°C 以內 。
截至 2026 年 8 月發表時,Runware 話已經有 10 個 Pod 部署咗喺美國、歐洲同亞太區 。公司已鎖定 160 個站點計劃喺 2026 年下半年擴充,歐洲已經投入服務,美國西岸嘅部署亦已經開始 。
發表 Sonic Pod 之前,Runware 已經累積咗相當多客戶。平台已經處理咗 超過 100 億次 AI 生成,服務 超過 20 萬個開發者 同 超過 3 億終端用戶 。已公開嘅客戶包括 Wix、Together.ai、ImagineArt、Quora、OpenArt、Freepik 同 Higgsfield AI,仲有幾十個私人企業部署 。到 2026 年年中,Runware 官網顯示已處理 超過 200 億次請求、超過 5 億終端用戶、超過 100 萬開發者,平台上有 超過 40 萬個模型 。
Runware 完成咗兩輪重要融資:
公司累計融資總額為 6,300 萬美元 。
Runware 強調 Sonic Inference Pod 有幾個環保優勢:
Sonic Inference Pod 代表一種完全唔同嘅 AI 基建思維:將運算力帶到去電力同用戶所在嘅地方,而唔係逼 traffic 走去偏遠嘅中央數據中心 。隨住 10 個 Pod 已經營運、160 個站點排緊隊、目標係 2027 年達到 1 GW 容量,Runware 賭緊模組化、可攜帶嘅數據中心會定義 AI 推理部署嘅下一個階段。