לעומת זאת, ערכת הכלים CANN (Compute Architecture for Neural Networks) של Huawei, גם לאחר שקוד המקור שלה שוחרר באוגוסט 2025, נותרה הרבה פחות בשלה מבחינת כיסוי אופרטורים, אופטימיזציה וכלים קהילתיים . מפתחים מדווחים שלגרעיני קוד (kernels) רבים המותאמים ל-CUDA אין מקבילה ישירה ב-CANN, מה שמחייב שכתוב ידני
.
זהו מעגל שמחזק את עצמו וקשה לשבירה: ככל שקהילת המפתחים של Nvidia גדולה יותר וספריית הקוד המותאם מראש עשירה יותר, כך קשה יותר לחלופות לצבור תאוצה .
חוקר AI במכון המזוהה עם שאנגחאי מעריך שמעבר אימון מ-Nvidia CUDA ל-Huawei Ascend יוסיף לפחות 50% בזמן ובעלויות . מקורות בתעשייה מאשרים נתון זה כמינימום ריאלי
.
זה כולל:
אולי הדוגמה הבולטת ביותר לפער התוכנה מגיעה מ-DeepSeek, אחת ממעבדות ה-AI הבולטות בסין. DeepSeek דיווחה כי נטשה תוכניות לאמן את המודל R2 שלה על מעבדי Ascend NPU של Huawei, תוך ציון בעיות ביצועים וכלים לא פתורות . זהו מקרה קונקרטי של מעבדה מהשורה הראשונה שהגיעה למסקנה שהחלופה המקומית אינה מוכנה לעומסי העבודה התובעניים ביותר שלה.
למרות שמעבד Ascend 910C של Huawei השתפר משמעותית, מפתחים מדווחים שהוא עדיין נופל מביצועי GPUs מדור Hopper של Nvidia במשימות אימון מבוזרות בקנה מידה גדול . ה-Ascend 910C, הבנוי על תהליך 7nm משופר של SMIC, מספק כשליש מתפוקת ה-BF16 של B200 של Nvidia . ה-Ascend 950 העתידי של Huawei צפוי לצמצם פער זה עוד יותר, כאשר נתוני מורגן סטנלי מראים שפער הביצועים בין שבבים סיניים לחומרה התואמת לייצוא של Nvidia הצטמצם משמעותית
.
באופן פרדוקסלי, מגבלות הייצוא האמריקאיות לא ניתקו לחלוטין את אספקת Nvidia לסין. ארה"ב אישרה את מכירת H200 לסין, ובייג'ין חסמה לאחר מכן את קבלתו — אבל המעבדות הסיניות כבר מחזיקות במלאי עתק של שבבי Nvidia . ByteDance, Alibaba וטנסנט השקיעו במשותף כ- 16 מיליארד דולר באגירת כ-1.3 עד 1.6 מיליון יחידות H20 בציפייה לאיסור
.
בסיס מותקן זה יוצר אינרציה חזקה: כל עוד חומרת Nvidia הקיימת ממשיכה לעבוד, עלות ההחלפה הגבוהה דוחה את המעבר לחלופות מקומיות .
סין אינה עומדת מנגד. בתגובה לחסמים אלה:
ההתקדמות אמיתית: נתח האימון על שבבים מקומיים גדל מ-8% בתחילת 2025 ל-42% באפריל 2026 . אך נראה שחלק ניכר מאימוץ זה מרוכז בעומסי עבודה פחות קריטיים ובמשימות הסקה (inference), ולא באימון מודלי קצה מתקדמים
.
שחרור קוד המקור של CANN על ידי Huawei הוא צעד משמעותי לקראת בניית מערכת אקולוגית למפתחים כמו זו של CUDA . אך רוב האנליסטים מסכימים שפער מערכת התוכנה — לא מפרטי החומרה הגולמיים — ייקח שנים לסגירה
. בטווח הקצר, מעבדות ה-AI המובילות בסין ימשיכו לאמן על שבבי Nvidia תוך ניסוי בפריסות היברידיות מקומיות לעומסי עבודה פחות קריטיים, ובעוד תוכנית הרשת של בייג'ין בהיקף 295 מיליארד דולר שואפת להאיץ את המעבר
.