Huawei mengklaim satu klaster OceanStor M900 menyediakan cache KV bersama hingga 64 PB; angka itu bukan kapasitas memori di dalam satu NPU. Huawei melaporkan latensi akses sekitar 60 mikrodetik dan bandwidth agregat 40 TB/detik per klaster, bukan kecepatan yang dijamin untuk setiap permintaan.
Diterbitkan olehDiedit dengan GPT-6 SolGambar dibuat dengan GPT Image 2
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What is Huawei’s OceanStor M900 Context Memory Storage, introduced at HUAWEI CONNECT 2026 for AI inference SuperPoDs, and how does its Unifi. Article summary: Huawei’s OceanStor M900 is a storage system for SuperPoD AI inference, introduced at HUAWEI CONNECT 2026. It uses UnifiedBus to make the key–value (KV) cache—a reusable record of attention calculations—available across a. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Saat percakapan AI makin panjang atau agen AI menjalankan tugas berulang, sistem inferensi perlu menyimpan lebih banyak hasil perhitungan yang mungkin dipakai lagi. OceanStor M900, yang diperkenalkan Huawei di HUAWEI CONNECT 2026, dirancang sebagai penyimpanan konteks bersama untuk sistem komputasi AI SuperPoD. Tujuannya adalah agar konteks yang berguna tidak hanya bergantung pada kapasitas memori di dekat tiap akselerator. 1
9
Cache key–value (KV) menyimpan informasi yang dihitung model saat memproses masukan. Jika permintaan berikutnya memiliki bagian awal yang cocok dengan data tersimpan, sistem dapat menggunakan kembali perhitungan itu alih-alih mengulanginya. Pada konteks panjang dan interaksi agen yang berkali-kali, cache ini makin berguna—sekaligus makin sulit ditampung seluruhnya di memori dekat neural processing unit (NPU), yaitu akselerator yang menjalankan komputasi AI. 1
3
6
OceanStor M900 memakai jaringan UnifiedBus untuk mengelola cache KV secara bertingkat, dari memori di chip dan DRAM hingga solid-state drive (SSD). Huawei menyebut satu klaster dapat menyediakan kapasitas cache KV 64 PB, sehingga kapasitas bersama yang dapat diakses sebuah NPU meningkat dari skala gigabita ke terabita. 64 PB adalah kapasitas penyimpanan bersama per klaster, bukan memori yang terpasang di dalam satu NPU. Semakin banyak konteks yang tersimpan berpotensi meningkatkan penggunaan ulang cache, tetapi hasilnya bergantung pada apakah permintaan memang memiliki bagian yang dapat digunakan kembali. 3
6
17
Agar lapisan SSD cukup cepat untuk inferensi, Huawei merancang jalur akses satu lompatan dari NPU SuperPoD ke SSD. Rancangan ini mengintegrasikan fungsi CPU, pengendali jaringan, dan pengendali NAND untuk menghindari sebagian langkah konversi protokol dan penerusan data melalui CPU. Huawei melaporkan latensi akses sekitar 60 mikrodetik dan bandwidth akses agregat 40 TB/detik per klaster. Keduanya merupakan angka yang dinyatakan untuk arsitektur dan sistem, bukan jaminan kecepatan setiap pencarian cache. 3
6
28
32
Ketika permintaan bisa memakai ulang konteks yang sudah dihitung, token pertama berpotensi muncul lebih cepat. Komputasi yang tidak perlu diulang juga dapat menyisakan kapasitas untuk memproses lebih banyak token. Dalam skenario pemrograman AI yang disebutnya sebagai contoh umum, Huawei mengklaim jumlah token yang dihasilkan klaster inferensi per satuan waktu menjadi dua kali lipat dan waktu hingga token pertama terpangkas separuh. Angka dari skenario tersebut tidak berarti setiap beban kerja akan memperoleh peningkatan serupa. 28
33
Huawei juga menjelaskan penempatan data yang mempertimbangkan karakter cache KV, termasuk berapa lama data disimpan pada tiap jenis media. Perusahaan menyebut ketahanan SSD hingga 24 kali penulisan kapasitas drive per hari, peningkatan umur pakai 16 kali lipat, serta target stabilitas tiga tahun. Harapannya, lebih sedikit komputasi ulang dan penggantian SSD dapat menurunkan biaya inferensi per token. Namun, sumber yang tersedia belum membuktikan secara independen bahwa capaian kinerja, umur pakai, atau penghematan tersebut terwujud pada SuperPoD yang digunakan dalam operasi nyata. 6
8
33
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Huawei mengklaim satu klaster OceanStor M900 menyediakan cache KV bersama hingga 64 PB; angka itu bukan kapasitas memori di dalam satu NPU.
Huawei mengklaim satu klaster OceanStor M900 menyediakan cache KV bersama hingga 64 PB; angka itu bukan kapasitas memori di dalam satu NPU. Huawei melaporkan latensi akses sekitar 60 mikrodetik dan bandwidth agregat 40 TB/detik per klaster, bukan kecepatan yang dijamin untuk setiap permintaan.
Manfaatnya bergantung pada seberapa banyak konteks yang dapat digunakan kembali; hasil kinerja dan ketahanan SSD belum terverifikasi secara independen.