แนวคิดสำคัญคือการย้ายกำลังประมวลผลไปอยู่ใกล้แหล่งพลังงานและผู้ใช้งาน แทนการส่งคำขอทั้งหมดไปยังศูนย์ข้อมูลขนาดใหญ่ที่อยู่ห่างไกล โดยตัวพ็อดสามารถขนส่งด้วยรถบรรทุกไปติดตั้งในพื้นที่ที่มีพื้นรองรับ ระบบไฟฟ้า และการเชื่อมต่อเครือข่ายได้
Sonic Inference Pod เป็นหน่วยประมวลผลสำหรับ AI inference แบบครบวงจรในตัว ภายในตู้มี GPU ประมาณ 1,200 ตัว จัดเป็นโหนดที่มี GPU ตั้งแต่ 2–8 ตัว โดยใช้ NVIDIA RTX PRO 6000 เป็นฮาร์ดแวร์หลัก และมี GPU ตระกูล B200 และ B300 สำหรับงานขนาดใหญ่
ตัวพ็อดติดตั้งอยู่ในตู้คอนเทนเนอร์ยาว 20 ฟุต ส่วนระบบทำความเย็นแบบชิลเลอร์วางซ้อนอยู่ด้านบน Runware ระบุว่าชิ้นส่วนภายในได้รับการออกแบบเฉพาะทางทั้งหมด ตั้งแต่เซิร์ฟเวอร์แบบไม่มีเคส แร็กที่ออกแบบเอง ระบบสวิตชิ่ง PCIe ไปจนถึงซีพียูความถี่สูงและพื้นที่จัดเก็บข้อมูล NVMe ภายในเครื่อง
เมื่อจัดส่งถึงพื้นที่ปลายทาง พ็อดต้องการเพียงพื้นที่ติดตั้ง ไฟฟ้า และเครือข่าย โดยสามารถติดตั้งจริงได้ราวหนึ่งวัน ส่วนระยะเวลาตั้งแต่สั่งซื้อจนพร้อมให้บริการอยู่ที่ประมาณ 3 สัปดาห์
Runware ระบุว่า Sonic Inference Pod สามารถลดต้นทุนการประมวลผลคำขอ AI ได้ประมาณ 30–80% เมื่อเทียบกับผู้ให้บริการคลาวด์แบบดั้งเดิม ขณะที่เอกสารและคำกล่าวบางส่วนของบริษัทระบุช่วงการประหยัดสูงสุดไว้ถึง 90%
โครงสร้างแบบโมดูลาร์ยังช่วยลดขั้นตอนที่มักทำให้การสร้างศูนย์ข้อมูลขนาดใหญ่ล่าช้า ไม่ว่าจะเป็นการขอใบอนุญาต การก่อสร้าง หรือการรอเพิ่มกำลังส่งไฟฟ้า โดย Runware วางแผนให้พ็อดหลายชุดทำงานเป็นเครือข่ายเดียวกัน และส่งคำขอ inference ไปยังกำลังประมวลผลที่พร้อมใช้งานและอยู่ใกล้ที่สุดแบบเรียลไทม์
ณ วันที่เปิดตัว Runware ระบุว่ามี Sonic Inference Pod ติดตั้งแล้ว 10 ชุดในสหรัฐฯ ยุโรป และภูมิภาคเอเชียแปซิฟิก บริษัทระบุว่ายุโรปเริ่มรองรับทราฟฟิกแล้ว ขณะที่การติดตั้งบนชายฝั่งตะวันตกของสหรัฐฯ กำลังเดินหน้า
แผนขยายในช่วงครึ่งหลังของปี 2026 ครอบคลุมไซต์ที่ระบุไว้ 160 แห่ง พร้อมเป้าหมายเปิดใช้งานโหนด inference 10,000 โหนด สำหรับปี 2027 Runware ตั้งเป้ากำลังประมวลผลมากกว่า 1 กิกะวัตต์
บริษัทมีฐานลูกค้าและการใช้งานอยู่ก่อนแล้ว โดยระบุว่าแพลตฟอร์มเคยรองรับการสร้างผลงานจาก AI มากกว่า 10,000 ล้านครั้ง ให้แก่นักพัฒนามากกว่า 200,000 ราย และผู้ใช้งานปลายทางมากกว่า 300 ล้านคน ลูกค้าที่เปิดเผยชื่อ ได้แก่ Wix, Together.ai, ImagineArt, Quora, OpenArt, Freepik และ Higgsfield AI รวมถึงการใช้งานภายในองค์กรเอกชนอีกหลายสิบราย
ตัวเลขบนเว็บไซต์ Runware ณ ช่วงกลางปี 2026 ระบุว่าบริษัทให้บริการคำขอไปแล้วมากกว่า 20,000 ล้านครั้ง มีผู้ใช้งานปลายทางมากกว่า 500 ล้านคน นักพัฒนามากกว่า 1 ล้านราย และมีโมเดลบนแพลตฟอร์มมากกว่า 400,000 โมเดล
Runware ระดมทุนรอบสำคัญ 2 รอบ ได้แก่
เมื่อนับจากมูลค่าของสองรอบดังกล่าวจะอยู่ที่ 63 ล้านดอลลาร์ตามข้อมูลในบทความต้นทาง อย่างไรก็ตาม รายงานบางแห่งระบุยอดเงินทุนสะสมไว้ที่ 66 ล้านดอลลาร์ จึงควรถือว่าตัวเลขรวมยังแตกต่างกันตามวิธีนับหรือแหล่งข้อมูล
หนึ่งในจุดขายของ Sonic Inference Pod คือระบบหล่อเย็นแบบปิดสนิท ซึ่งหมุนเวียนน้ำเดิมประมาณ 1.5 ลูกบาศก์เมตรอย่างต่อเนื่อง ระบบจึงไม่ใช้น้ำเพิ่ม ไม่มีน้ำเสีย และไม่มีมลพิษจากการใช้น้ำตามที่ Runware ระบุ โดยสามารถควบคุมอุณหภูมิให้คงที่ภายใน 2 องศาเซลเซียสภายใต้โหลดต่อเนื่อง
บริษัทยังเสนอว่าพ็อดสามารถติดตั้งใกล้สถานีไฟฟ้าย่อย พื้นที่อุตสาหกรรม หรือแคมปัสศูนย์ข้อมูลที่มีไฟฟ้าอยู่แล้ว ช่วยลดการสูญเสียระหว่างการส่งไฟฟ้าระยะไกล และไม่จำเป็นต้องรอการสร้างกำลังผลิตหรือโครงข่ายใหม่ในทุกกรณี
อย่างไรก็ตาม ข้อได้เปรียบเหล่านี้ขึ้นอยู่กับพื้นที่ติดตั้งจริง แหล่งพลังงาน และความพร้อมของโครงข่ายในแต่ละแห่ง ไม่ได้หมายความว่าทุกไซต์จะสามารถติดตั้งพ็อดได้ทันทีโดยไม่มีข้อจำกัดด้านไฟฟ้าหรือการอนุญาต
Sonic Inference Pod สะท้อนแนวทางใหม่ในการสร้างโครงสร้างพื้นฐาน AI จากเดิมที่ต้องพึ่งศูนย์ข้อมูลขนาดใหญ่และใช้เวลาสร้างนาน สู่หน่วยประมวลผลที่ผลิตล่วงหน้า ขนส่งได้ และนำไปวางใกล้แหล่งพลังงานหรือผู้ใช้งานมากขึ้น
Runware กำลังทดสอบว่าศูนย์ข้อมูลแบบพกพาจะช่วยรองรับความต้องการ AI inference ที่เพิ่มขึ้นได้มากเพียงใด โดยมีพ็อดใช้งานแล้ว 10 ชุด ไซต์ที่เตรียมขยาย 160 แห่ง เป้าหมาย 10,000 โหนดภายในปี 2026 และกำลังประมวลผลมากกว่า 1 กิกะวัตต์ในปี 2027