L’objectif est de s’affranchir du rythme des grands centres de données. Plutôt que d’attendre des années pour obtenir les autorisations, construire un site et renforcer les infrastructures électriques, Runware veut livrer ses pods par camion. Une fois sur place, ils nécessitent essentiellement une surface au sol, une alimentation électrique et une connexion réseau pour commencer à traiter des charges d’inférence .
Le Sonic Inference Pod est une unité autonome, assemblée et testée avant expédition. À l’intérieur, Runware utilise des serveurs sans boîtier, des racks conçus sur mesure, un système propriétaire de commutation PCIe, des processeurs à haute fréquence et du stockage local NVMe .
Les quelque 1 200 GPU sont organisés en nœuds de deux à huit cartes. Les NVIDIA RTX PRO 6000 constituent la base de la configuration, tandis que les GPU des séries B200 et B300 sont destinés aux charges de travail plus lourdes . Le refroidisseur, d’une taille comparable à celle du conteneur, est installé au-dessus de celui-ci .
Cette spécialisation vise à limiter les temps de démarrage des modèles et à optimiser le traitement de requêtes d’inférence — c’est-à-dire la phase durant laquelle un modèle déjà entraîné produit une image, une vidéo, du texte ou une autre réponse.
Le système de refroidissement recircule en permanence environ 1,5 mètre cube d’eau dans un circuit scellé. Runware affirme qu’il n’y a donc ni consommation d’eau, ni eaux usées, ni pollution liée au fonctionnement du circuit . La température resterait stable à moins de 2 °C d’écart sous charge soutenue .
Cette approche distingue le pod des installations qui recourent au refroidissement évaporatif, même si l’empreinte environnementale globale dépend aussi de la source d’électricité, de la fabrication des équipements et de leur utilisation. Runware met notamment en avant la possibilité d’alimenter les pods avec des énergies renouvelables et de les installer près de capacités électriques existantes .
Au moment de l’annonce, Runware indiquait avoir déjà installé 10 pods aux États-Unis, en Europe et dans la région Asie-Pacifique . L’Europe était la première région opérationnelle, tandis que le déploiement sur la côte ouest des États-Unis commençait .
L’entreprise avait identifié 160 sites pour la deuxième moitié de 2026. Son calendrier prévoit également la mise en ligne de 10 000 nœuds d’inférence sur cette période, puis plus de 1 GW de capacité de calcul en 2027 .
Le modèle consiste à rapprocher les ressources informatiques des utilisateurs et des points d’alimentation disponibles. Selon Runware, des pods installés sur des sites industriels, des campus de centres de données ou à proximité de sous-stations électriques pourraient réduire les pertes liées au transport de l’électricité et éviter d’attendre la construction de nouvelles capacités du réseau .
Le lancement matériel intervient après plusieurs étapes de croissance pour la plateforme d’inférence de Runware. L’entreprise affirme avoir traité plus de 10 milliards de générations IA pour plus de 200 000 développeurs et plus de 300 millions d’utilisateurs finaux . Parmi les clients cités figurent Wix, Together.ai, ImagineArt, Quora, OpenArt, Freepik et Higgsfield AI, ainsi que des dizaines de déploiements privés en entreprise .
À la mi-2026, le site de Runware affichait plus de 20 milliards de requêtes traitées, 500 millions d’utilisateurs finaux, 1 million de développeurs et 400 000 modèles disponibles sur la plateforme . Ces chiffres sont des indicateurs déclarés par l’entreprise et couvrent l’activité de sa plateforme, au-delà des seuls Sonic Inference Pods.
Runware a annoncé deux principales opérations de financement :
Le bilan présenté porte le total levé par l’entreprise à 63 millions de dollars . Certaines publications externes avancent un montant différent, mais les deux tours détaillés ici représentent bien 63 millions de dollars.
Le Sonic Inference Pod propose une autre manière de développer l’infrastructure IA : au lieu de concentrer toujours davantage les GPU dans quelques mégacentres éloignés, Runware veut déployer des unités standardisées là où l’électricité et la demande sont déjà disponibles .
Le projet reste un pari industriel ambitieux. Il faudra vérifier, à mesure que les 160 sites annoncés entreront en service, si les promesses de rapidité, de coût et de sobriété en eau se maintiennent à grande échelle. Pour l’heure, Runware mise sur une flotte de microcentres de données capables d’ajouter rapidement de la capacité d’inférence, sans attendre le calendrier beaucoup plus long des infrastructures traditionnelles.