Sonic Inference Pod 是一個完全自足的推論運算單元。每個機組搭載約 1,200 顆 GPU——主要為 NVIDIA RTX PRO 6000 晶片,並針對較大工作負載配置 B200 和 B300 系列 GPU——以每節點 2 至 8 顆 GPU 的方式排列 。該單元裝在一個 20 呎海運貨櫃內,頂部疊放一台冷卻器,所有組件皆從零開始客製:無機殼伺服器、客製機架、專有 PCIe 交換、高頻 CPU 和本地 NVMe 儲存 。
該機組採用密封的封閉迴路液冷系統,持續循環約 1.5 立方米的水,實現零耗水、無廢水、無污染 。在持續負載下,系統能將溫度穩定維持在 2°C 以內 。
截至 2026 年 8 月發表時,Runware 已回報在美國、歐洲和亞太地區部署了 10 個機組 。該公司已為 2026 年下半年鎖定 160 個站點進行擴展,其中歐洲已上線,美國西岸部署正在進行中 。
在 Sonic Pod 推出前,Runware 已建立顯著的客戶基礎。該平台已為 超過 200,000 名開發者 和 超過 3 億終端用戶 驅動 超過 100 億次 AI 生成 。已公布的客戶包括 Wix、Together.ai、ImagineArt、Quora、OpenArt、Freepik 和 Higgsfield AI,以及數十個私人企業部署 。到 2026 年中,Runware 網站顯示已處理 超過 200 億次請求、服務 超過 5 億終端用戶、擁有 超過 100 萬名開發者 和平台上的 超過 40 萬個模型 。
Runware 已完成兩輪重要募資:
該公司累計募資總額為 6,300 萬美元 。
Runware 強調 Sonic Inference Pod 的多項環境優勢:
Sonic Inference Pod 代表了 AI 基礎設施的一種根本性不同做法:將運算帶到電力和使用者所在之處,而非將流量強制引導至偏遠的集中式資料中心 。隨著 10 個機組已上線、160 個站點排隊等候,以及 2027 年達到 1 GW 容量的目標,Runware 正押注模組化、可攜式資料中心將定義 AI 推論部署的下一個階段。