Podczas konferencji Apsara 2026 dział projektowania układów scalonych Alibaby, T-Head, przedstawił Zhenwu V900. To akcelerator przeznaczony zarówno do trenowania modeli sztucznej inteligencji wymagającego wysokiej precyzji obliczeń, jak i do inferencji — czyli wykorzystania wytrenowanego modelu do generowania odpowiedzi. Według Alibaby V900 osiąga trzykrotnie wyższą wydajność niż wcześniejszy Zhenwu M890. To deklaracja producenta, a nie wynik potwierdzony niezależnym testem.
18
12
Co wiadomo o specyfikacji i terminie premiery?
Alibaba podaje, że V900 ma 216 GB pamięci oraz zapewnia 1200 GB/s przepustowości połączeń między układami. Natywnie obsługuje różne formaty liczbowe, w tym FP8 i FP4. T-Head przedstawia tę elastyczność jako sposób na wykorzystanie jednego typu akceleratora na różnych etapach pracy z modelami AI. Produkcja masowa i komercyjne udostępnienie układu są planowane na pierwszy kwartał 2027 roku.
18
19
Od pojedynczego układu do dużego klastra
Według T-Head układy komunikacyjne ICN Switch pozwalają łączyć akceleratory V900 w większe systemy, tzw. superwęzły, ze wspólnym sposobem adresowania pamięci. Alibaba twierdzi też, że klaster oparty na V900 mógłby obsługiwać do 500 tys. kart akceleratorowych na potrzeby trenowania i inferencji. To deklarowana możliwość skalowania, nie informacja o uruchomieniu klastra tej wielkości.
9
11
Firma informowała wcześniej, że z M890 korzystało za pośrednictwem usług Alibaba Cloud ponad 650 klientów zewnętrznych z przeszło 20 branż. Liczba ta dotyczy poprzedniego modelu i nie świadczy o wdrożeniach V900 przed jego planowaną premierą.
31
19
Czego nadal nie da się ocenić?
Ujawniona specyfikacja V900 nie zawiera liczby operacji zmiennoprzecinkowych na sekundę (FLOPS), poboru mocy ani informacji o procesie produkcyjnym. Przywołane doniesienia nie wskazują też niezależnego testu potwierdzającego trzykrotny wzrost wydajności. Na razie można więc opisać zamierzenia Alibaby i podane parametry, ale nie rzetelnie porównać osiągi V900 z konkurencyjnymi akceleratorami.
6
12