La base du système est OceanStor Pacific, une plateforme de stockage distribué conçue pour gérer des volumes massifs de données d’entraînement, de jeux de données multimodaux et d’embeddings vectoriels.
Huawei affirme que ce système peut atteindre jusqu’à 11 pétaoctets de capacité dans un châssis 2U, un niveau de densité destiné à réduire les coûts d’infrastructure dans les data centers IA à grande échelle.
Au‑dessus du stockage se trouve DME Omni‑Dataverse, une plateforme de gestion des données qui unifie les ensembles de données provenant de différents environnements.
Elle permet notamment :
Selon Huawei, la plateforme peut effectuer des recherches en quelques secondes dans des centaines de milliards de vecteurs, ce qui est essentiel pour les systèmes d’IA utilisant des bases de connaissances ou des embeddings à grande échelle.
La troisième couche concerne l’exécution et la gestion des modèles d’IA.
Deux technologies clés sont mises en avant :
CMS permet de mutualiser des ressources mémoire, notamment des KV‑cache partagés, et fonctionne avec des environnements de calcul hétérogènes. L’objectif est d’accélérer l’inférence et de réduire la latence lors de la génération du premier token.
ModelEngine sert quant à lui de passerelle et de plateforme de déploiement des modèles, permettant de lancer rapidement de nouveaux modèles avec peu de configuration.
Huawei a également introduit Nexent, une plateforme destinée à orchestrer des agents d’intelligence artificielle dans les processus métiers.
Connectée à ModelEngine, elle permet de relier les modèles IA aux applications et aux flux de travail de l’entreprise — par exemple pour l’automatisation, l’analyse décisionnelle ou l’assistance client.
Dans cette architecture, les modèles ne restent pas isolés : ils deviennent des agents capables d’interagir avec des données, des systèmes et des utilisateurs.
La dernière couche concerne la sécurité et la continuité d’activité. Huawei décrit un cadre de résilience destiné à protéger les données et les systèmes d’IA contre les défaillances et les cyberattaques.
Les fonctions mises en avant incluent :
Ces mécanismes visent notamment à contrer des menaces comme les ransomwares et d’autres attaques pouvant compromettre les pipelines de données utilisés par les systèmes d’IA.
Huawei affirme que l’intégration de ces différentes couches peut améliorer significativement les performances et la vitesse de déploiement des applications d’IA.
Parmi les chiffres cités :
Comme pour la plupart des benchmarks fournis par les fournisseurs, ces résultats proviennent de tests internes ou de charges de travail spécifiques et ne représentent pas nécessairement toutes les situations réelles.
Huawei a également mis en avant des exemples d’adoption par des entreprises.
Le distributeur français Auchan a notamment déployé des clusters d’infrastructure Huawei dans trois centres de données en France afin de moderniser son environnement informatique.
Les informations publiques confirment l’utilisation d’équipements et de plateformes Huawei dans ces data centers. En revanche, les sources disponibles ne permettent pas d’attribuer clairement d’éventuelles réductions de coûts cloud directement à cette plateforme spécifique, celles‑ci pouvant résulter d’autres initiatives technologiques parallèles.
L’annonce de Huawei s’inscrit dans une évolution plus large du secteur technologique : la montée des infrastructures IA verticalement intégrées.
Plutôt que de combiner des outils disparates pour le stockage, les données, l’inférence et l’orchestration, les fournisseurs cherchent à proposer des plateformes unifiées capables de soutenir :
Dans cette stratégie, Huawei met particulièrement l’accent sur la dimension “data infrastructure” — stockage, gestion des données, recherche vectorielle et gestion de la mémoire — considérée comme un élément clé des performances des systèmes d’intelligence artificielle.
Si cette approche est adoptée à grande échelle, ce type de plateforme pourrait devenir l’ossature technique des data centers conçus spécifiquement pour l’IA, reliant données, modèles et agents au sein d’une architecture unique.