Pada 30 September 2026, DeepSeek menerbitkan versi Ascend bagi enam komponen infrastruktur AI yang merangkumi pengaturcaraan kernel, pengiraan, perhatian, pemilihan data dan komunikasi teragih. Ujian inferens yang dilaporkan menggunakan sistem Ascend 950 UBL128, strategi EP32 dan konteks 128K.
Diterbitkan olehDisunting dengan GPT-6 LunaImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did DeepSeek open-source for Huawei’s Ascend platform on September 30, 2026, how do its Ascend versions of TileLang, DeepGEMM, TileKern. Article summary: DeepSeek open-sourced an Ascend counterpart to its NVIDIA-oriented software stack on September 30, 2026. The releases establish corresponding programming, compute, attention, selection and communication components, but t. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Pada 30 September 2026, DeepSeek menerbitkan versi Ascend bagi enam komponen infrastruktur AI yang merangkumi pengaturcaraan kernel, pengiraan, perhatian, pemilihan data dan komunikasi teragih. Komponen ini menyediakan bahan asas untuk menjalankan beban kerja AI pada perkakasan Huawei. Namun, maklumat yang tersedia tidak menunjukkan prestasi setanding NVIDIA dalam ujian yang sama, dan tidak mengesahkan bahawa DeepSeek menyiapkan latihan V4 berskala penuh menggunakan Ascend. 2
5
Komponen untuk Ascend mempunyai peranan yang sepadan dengan perisian DeepSeek bagi platform NVIDIA, tetapi pelaksanaannya disesuaikan dengan perkakasan Huawei. 2
5
Kesepadanan API atau fungsi memudahkan pembangun menggunakan komponen yang sepadan. Namun, ia bukan bukti bahawa kedua-dua platform mempunyai dalaman yang sama, ciri yang seratus peratus setara atau kelajuan yang setanding.
Ujian DeepEP yang dilaporkan pada perkakasan Ascend mencatat 375 GB/s untuk dispatch dan 347 GB/s untuk combine. Angka ini merujuk kepada prestasi komunikasi Ascend, bukan perbandingan terus dengan NVIDIA. 19
47
Bagi inferens, satu ujian DeepSeek-V4.1-Flash yang dilaporkan menggunakan sistem Ascend 950 UBL128, strategi pelaksanaan EP32, konteks 128K dan inferens luar talian. Pada tetapan masa setiap token output (TPOT) 5 ms, kadar yang dilaporkan ialah 2,469 token output sesaat bagi setiap kad; pada TPOT 10 ms, angkanya 5,102 token sesaat bagi setiap kad. Pengiraan itu tidak merangkumi overhed penjadualan serving dan pengimbangan beban rangka kerja. 47
Angka tersebut khusus kepada konfigurasi ujian berkenaan, bukannya jaminan kadar pemprosesan untuk semua beban kerja. Repositori DeepEP menyatakan ukurannya menggunakan pakej pembangunan perkakasan bukti konsep (PoC) yang dikonfigurasi secara manual. Satu laporan lain pula menyebut angka itu menggunakan perisian tegar PoC, dengan keluaran komersial dirancang sekitar 15 Oktober. Oleh itu, jenis perisian tegar dan persediaan ujian penting apabila menilai atau cuba mengulangi keputusan tersebut. 12
19
Maklumat yang diberikan juga tidak cukup terperinci untuk membolehkan setiap tetapan inferens diulang secara bebas, dan tiada pengesahan pihak ketiga berskala besar diterangkan. Maka, keputusan itu tidak wajar dianggap sebagai perbandingan yang telah disahkan dengan sistem NVIDIA. 47
Huawei dan DeepSeek menerangkan reka bentuk SuperPoD Flex / UBL128 berasaskan Ascend 950 yang ditakrifkan bersama. Laporan menyatakan konfigurasi scale-up menggunakan 128 kad dengan rangkaian satu peringkat 3.2 Tbps, manakala reka bentuk scale-out dua peringkat dikatakan boleh diperluas sehingga 256,000 kad. Itu ialah keupayaan reka bentuk yang dinyatakan—bukan bukti bahawa sistem sebesar itu telah menjalankan latihan DeepSeek. 10
47
49
Huawei turut menyatakan hasil kerjasama akan dikongsi melalui komuniti CANN. Liputan yang dilaporkan merangkumi pelaksanaan model, latihan berskala besar, pengumpulan KV cache untuk konteks panjang dan pembelajaran pengukuhan berasaskan agen. 14
Penerbitan ini menunjukkan bahawa DeepSeek telah memperluas sokongan perisiannya kepada Ascend, manakala ujian inferens yang dilaporkan memberikan gambaran tentang satu konfigurasi luar talian tertentu. Namun, kesepadanan komponen dan reka bentuk rangkaian berskala besar yang diumumkan tidak mengesahkan bahawa latihan V4 berskala penuh telah dijalankan pada Ascend. Angka penanda aras yang dipetik juga tidak membuktikan prestasi setara NVIDIA: perkakasannya berbeza dan laporan yang tersedia tidak menunjukkan ujian silang platform dengan keadaan yang sama. 2
5
19
47
Kesimpulan paling berhati-hati ialah DeepSeek telah menerbitkan komponen perisian Ascend yang penting, sementara Huawei menerangkan seni bina sistem dan beberapa keputusan ujian. Sejauh mana keputusan itu boleh digunakan pada beban kerja lain—atau dibandingkan dengan NVIDIA dalam ujian terkawal—masih belum dipastikan.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Pada 30 September 2026, DeepSeek menerbitkan versi Ascend bagi enam komponen infrastruktur AI yang merangkumi pengaturcaraan kernel, pengiraan, perhatian, pemilihan data dan komunikasi teragih.
Pada 30 September 2026, DeepSeek menerbitkan versi Ascend bagi enam komponen infrastruktur AI yang merangkumi pengaturcaraan kernel, pengiraan, perhatian, pemilihan data dan komunikasi teragih. Ujian inferens yang dilaporkan menggunakan sistem Ascend 950 UBL128, strategi EP32 dan konteks 128K.