Huawei menyebut OceanStor M900 memperluas cache KV SuperPoD ke lapisan SSD bersama dengan kapasitas hingga 64 PB per klaster. Cache berskala terabita yang dapat diakses tiap NPU berasal dari kapasitas bersama bertingkat, bukan tambahan memori fisik di dalam chip.
Diterbitkan olehDiedit dengan GPT-6 SolGambar dibuat dengan GPT Image 2
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: How does Huawei’s OceanStor M900 AI memory storage address the KV Cache memory wall in hyperscale, long-context and agentic inference SuperP. Article summary: Huawei positions OceanStor M900 as a shared, SSD-backed **KV-cache tier** for SuperPoD inference, not as a replacement for the NPU’s fast memory. Its aim is to keep and reuse more context across long-running and agentic . Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Saat AI menangani percakapan panjang atau menjalankan tugas lewat agen, proses inferensinya menghasilkan key-value cache (cache KV): data konteks yang dapat digunakan kembali. Masalahnya, kapasitas memori yang dekat dengan prosesor terbatas. Huawei merancang OceanStor M900 untuk menampung lebih banyak cache KV pada lapisan SSD bersama, di bawah memori dalam chip dan DRAM. SSD di sini menambah ruang penyimpanan konteks, bukan menggantikan memori tercepat milik NPU, yaitu prosesor yang menjalankan komputasi AI. 8
10
12
Menurut Huawei, jaringan interkoneksi Lingqu atau UnifiedBus menggabungkan cache KV di seluruh SuperPoD—sistem yang mengelompokkan banyak akselerator AI—dan mengatur penempatannya di memori dalam chip, DRAM, serta SSD. Huawei mengklaim kapasitas hingga 64 PB per klaster, sementara cache KV yang dapat diakses setiap NPU meningkat dari skala gigabita ke terabita. Artinya, NPU memperoleh akses ke kapasitas bersama yang bertingkat, bukan tambahan terabita memori fisik di dalam chip. 8
10
M900 diposisikan sebagai penyimpanan konteks untuk inferensi, bukan chip komputasi baru atau pengganti jaringan interkoneksi. Huawei menyebutnya dirancang untuk beban kerja berbasis agen dan konteks panjang; laporan industri mengidentifikasi Atlas 960 SuperPoD sebagai salah satu lingkungan sasarannya. 12
6
Huawei menyatakan integrasi fungsi CPU, pengendali jaringan, dan pengendali NAND memungkinkan akses satu lompatan dari NPU ke SSD, tanpa penerusan oleh CPU atau konversi protokol. Perusahaan mengklaim latensi akses turun 90% menjadi 60 mikrodetik. Huawei juga menyebut bandwidth gabungan 40 TB/detik per klaster, atau 1,5 kali angka solusi pembandingnya. Itu angka untuk seluruh klaster, bukan jaminan bandwidth bagi masing-masing NPU. 8
Dalam skenario yang Huawei sebut sebagai pemrograman AI tipikal, perusahaan mengklaim jumlah token yang dihasilkan klaster inferensi per satuan waktu menjadi dua kali lipat dan waktu hingga token pertama terpangkas separuh. Hasil pada skenario tersebut tidak berarti setiap permintaan berkonteks panjang atau berbasis agen akan mengalami peningkatan yang sama. 8
14
Teknologi KV-Aware pada M900, menurut Huawei, memperkirakan masa pakai data cache dan mengatur penempatannya pada berbagai media. Perusahaan mengklaim dukungan hingga 24 kali penulisan ulang kapasitas drive per hari (DWPD), umur media SSD 16 kali lebih panjang, serta operasi stabil selama tiga tahun. Huawei berpendapat berkurangnya penggantian SSD dan pekerjaan pemeliharaan dapat menekan biaya inferensi. Namun, bahan yang tersedia belum menunjukkan penghematan biaya per token yang terukur. 8
Jadi, ada perbedaan penting antara lebih banyak kapasitas cache yang dapat dijangkau dan inferensi yang terbukti lebih cepat serta lebih murah pada skala besar. Pengujian independen masih diperlukan untuk mengukur kapasitas yang benar-benar dapat dipakai dan tingkat keberhasilan penggunaan ulang cache pada beban kerja nyata; latensi dan bandwidth berkelanjutan saat akses bersaing; peningkatan produksi token dibandingkan acuan yang jelas; serta keausan SSD dan total biaya dari waktu ke waktu. Liputan pihak ketiga yang tersedia mengutip angka performa Huawei, bukan memvalidasinya lewat pengujian mandiri. 6
14
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Huawei menyebut OceanStor M900 memperluas cache KV SuperPoD ke lapisan SSD bersama dengan kapasitas hingga 64 PB per klaster.
Huawei menyebut OceanStor M900 memperluas cache KV SuperPoD ke lapisan SSD bersama dengan kapasitas hingga 64 PB per klaster. Cache berskala terabita yang dapat diakses tiap NPU berasal dari kapasitas bersama bertingkat, bukan tambahan memori fisik di dalam chip.
Klaim peningkatan kecepatan, ketahanan SSD, dan penurunan biaya masih membutuhkan pengujian independen.