อย่างไรก็ตาม Nvidia ยืนยันว่าการเปลี่ยนแปลงดังกล่าวไม่ใช่การลดสเปกเพราะขาดแคลน แต่เป็นการวางแผนผลิตภัณฑ์หลายรุ่นให้เหมาะกับกลุ่มลูกค้าและลักษณะงานที่แตกต่างกัน ความแตกต่างระหว่างสองมุมมองนี้สะท้อนประเด็นสำคัญของยุค AI ในขณะนี้ นั่นคือราคาและความพร้อมของ HBM4 กำลังเข้ามามีบทบาทต่อแผนผลิตภัณฑ์ของ Nvidia ในระดับกลยุทธ์
ตั้งแต่ไตรมาส 3 ปี 2026 Nvidia ได้ขยายขอบเขตการประเมินการติดตั้ง HBM ของ Rubin Ultra จากแผนเดิมที่ใช้ 12-Hi HBM4e เป็นตัวเลือกหลัก ไปทดสอบ 4 รูปแบบพร้อมกัน
คำว่า “Hi” หมายถึงจำนวนชั้นของชิป DRAM ที่นำมาซ้อนกันในแพ็กเกจ HBM ยิ่งมีจำนวนชั้นมาก ก็มีแนวโน้มให้ความจุสูงขึ้น แต่ก็ต้องพึ่งพากำลังการผลิตและกระบวนการรับรองที่ซับซ้อนกว่า
TrendForce ระบุว่ายังไม่มีการตัดสินใจเลือกสเปกสุดท้าย การเปิดทางเลือกหลายแบบเกิดขึ้นท่ามกลางความกังวลว่าอุปทาน DRAM ในปี 2027 อาจจำกัดกำลังการผลิตเวเฟอร์สำหรับ HBM รวมถึงความไม่แน่นอนเกี่ยวกับกำหนดการรับรอง HBM4e ของผู้ผลิตหน่วยความจำรายใหญ่ทั้งสามราย
ดังนั้น สิ่งที่เกิดขึ้นในตอนนี้ยังไม่ใช่การยืนยันว่า Rubin Ultra จะถูกลดสเปก แต่เป็นสัญญาณว่า Nvidia กำลังเตรียมแผนสำรอง หาก HBM4e รุ่นระดับสูงผลิตได้ไม่ทันหรือมีจำนวนไม่เพียงพอ
สำหรับแพลตฟอร์ม Vera Rubin การเปลี่ยนแปลงที่ถูกรายงานมีรายละเอียดชัดเจนกว่า โดย Nvidia อาจลดความจุ SOCAMM ซึ่งเป็นหน่วยความจำแบบโมดูลสำหรับฝั่ง CPU ในระบบแร็กสเกล Vera Rubin NVL72 จาก 192 GB เหลือ 96 GB ต่อโมดูล
จากการวิเคราะห์ที่ TrendForce อ้างถึง หากใช้โมดูล 96 GB ความจุหน่วยความจำรวมของ Vera CPU ต่อแร็กอาจลดลงจากราว 55 TB เหลือประมาณ 28 TB ขณะที่ความจุ GPU HBM4 ยังคงอยู่ที่ 20.7 TB ต่อแร็ก
เป้าหมายของการปรับนี้คือการลดต้นทุนและบรรเทาข้อจำกัดด้านอุปทาน โดยมีรายงานว่าหน่วยความจำ ซึ่งรวมทั้ง HBM และ SOCAMM อาจคิดเป็นประมาณ 29% ของต้นทุนวัสดุรวม หรือ BOM (bill of materials) ของระบบ Vera Rubin นั่นทำให้หน่วยความจำไม่ได้เป็นเพียงส่วนประกอบสนับสนุนอีกต่อไป แต่กลายเป็นหนึ่งในต้นทุนหลักของทั้งระบบ
บางแหล่งมองว่าสิ่งที่ดูเหมือนการ “ลดหน่วยความจำ” อาจเป็นการทดสอบ SKU เฉพาะลูกค้า หลายระดับมากกว่า กล่าวคือ Nvidia อาจเสนอความจุหน่วยความจำต่างกันตามประเภทงานและงบประมาณ แทนที่จะมีสเปกเรือธงเพียงแบบเดียว
แนวทางนี้ช่วยให้ Nvidia ยังคงจัดส่งระบบได้ แม้หน่วยความจำรุ่นสูงสุดจะมีจำกัด ตัวอย่างเช่น หาก HBM4e แบบ 12-Hi ยังผ่านการรับรองหรือผลิตได้ช้า บริษัทก็อาจเลือกส่ง Rubin Ultra รุ่น 8-Hi HBM4e หรือ HBM4 แทน แม้ประสิทธิภาพต่อชิปอาจแตกต่างกัน
ในบล็อกโพสต์วันที่ 7 สิงหาคม 2026 Nvidia ออกมาชี้แจงว่า Vera และ Rubin ไม่ได้ถูกลดสเปกเนื่องจากการขาดแคลน HBM บริษัทระบุว่าการกำหนดค่าที่ถูกพูดถึงเป็น SKU ที่แตกต่างกันและการปรับแต่งให้เหมาะกับลูกค้าแต่ละราย ไม่ใช่การลดสเปกที่ถูกบังคับด้วยข้อจำกัดด้านซัพพลาย
Nvidia ยังระบุด้วยว่าบริษัทปรับสมดุลระหว่างการประมวลผล เครือข่าย และหน่วยความจำอยู่เป็นประจำ เพื่อให้ได้ประสิทธิภาพและประสิทธิผลที่เหมาะสมกับความต้องการของลูกค้า
Jensen Huang ซีอีโอของ Nvidia กล่าวในเดือนมิถุนายน 2026 ว่า Samsung, SK Hynix และ Micron ซึ่งเป็นผู้ผลิตหน่วยความจำรายใหญ่ทั้งสามราย ได้รับการรับรองให้จัดหา HBM4 แล้ว โดย Vera Rubin อยู่ในสถานะ ผลิตเต็มรูปแบบ ส่วนเซิร์ฟเวอร์ Rubin, Rubin Ultra และ Kyber ยังเป็นไปตามแผน
ต่อมาในเดือนกรกฎาคม Huang ปฏิเสธรายงานเกี่ยวกับความล่าช้า โดยระบุว่าการผลิต Vera Rubin เดินหน้าในระดับ “ปริมาณมหาศาล”
จุดขัดแย้งจึงอยู่ที่การตีความ TrendForce และนักวิเคราะห์มองว่าการเปิดทดสอบ HBM หลายรูปแบบเป็นแผนรับมือจากแรงกดดันด้านอุปทาน ขณะที่ Nvidia มองว่าเป็นการวางแผนผลิตภัณฑ์หลายรุ่นตามลักษณะงานของลูกค้า
รายงานระบุว่า HBM4 ถูกขายหมดสำหรับการผลิตตลอดปี 2026 และภาวะขาดแคลน DRAM อาจลากยาวถึงปี 2027 สถานการณ์นี้สร้างแรงกดดันทั้งด้านราคาและความพร้อมของชิ้นส่วนให้กับแพลตฟอร์ม Nvidia รุ่นถัดไป ตั้งแต่ Vera Rubin ไปจนถึง Rubin Ultra
เมื่อหน่วยความจำมีสัดส่วนราว 29% ของ BOM ในระบบ Vera Rubin NVL72 การเลือกว่าจะใช้ HBM กี่ชั้น หรือใส่ SOCAMM ความจุเท่าใด ย่อมส่งผลโดยตรงต่อต้นทุนและจำนวนระบบที่ผลิตได้ Nvidia จึงต้องชั่งน้ำหนักระหว่างประสิทธิภาพสูงสุด ต้นทุนต่อระบบ และความสามารถในการส่งมอบสินค้า
เพื่อรักษาแหล่งผลิต Nvidia และ SK Group ประกาศความร่วมมือเชิงกลยุทธ์มูลค่ามากกว่า 500,000 ล้านดอลลาร์ ซึ่งรวมถึงความร่วมมือระยะยาวด้านการจัดหา HBM4 จาก SK Hynix สำหรับ Vera Rubin
หลังจากนั้นไม่นาน Samsung Electronics และ Broadcom ก็ประกาศความร่วมมืออีกฉบับมูลค่า 200,000 ล้านดอลลาร์ แม้ตัวเลขเหล่านี้ครอบคลุมความร่วมมือในวงกว้าง ไม่ใช่ต้นทุน HBM เพียงอย่างเดียว แต่ก็สะท้อนว่าการล็อกกำลังการผลิตหน่วยความจำให้เพียงพอและมีต้นทุนที่ควบคุมได้ กลายเป็นวาระเชิงกลยุทธ์ระดับหลายแสนล้านดอลลาร์ของอุตสาหกรรมชิป AI
แทนที่จะผูกอนาคตไว้กับ HBM4e รุ่นเรือธงเพียงรูปแบบเดียว Nvidia ดูเหมือนกำลังเตรียม SKU ที่หลากหลายขึ้น ทั้งในแง่จำนวนชั้น HBM และขนาดหน่วยความจำ
กลยุทธ์นี้ช่วยให้บริษัทเดินหน้าจัดส่งสินค้าในปริมาณมากได้ แม้ HBM4e ระดับสูงจะขาดตลาดหรือผ่านการรับรองล่าช้า และยังเปิดทางให้ Nvidia รองรับลูกค้าหลายกลุ่ม ตั้งแต่ระบบที่ต้องการประสิทธิภาพสูงสุด ไปจนถึงระบบที่ให้ความสำคัญกับต้นทุนและการส่งมอบ
รายงานที่มีอยู่ชี้ว่าแรงกดดันด้านอุปทานและต้นทุนกำลังทำให้ Nvidia ประเมิน Rubin Ultra หลายรุ่นที่ใช้ HBM ต่างกัน และอาจลดความจุ SOCAMM ในระบบ Vera Rubin NVL72 ลงจริง ขณะเดียวกัน Nvidia ปฏิเสธว่าไม่ได้ถูกบังคับให้ลดสเปก โดยยืนยันว่าความแตกต่างเหล่านี้เป็น SKU และการปรับแต่งสำหรับลูกค้าแต่ละกลุ่ม
แม้สเปกหน่วยความจำสุดท้ายของ Rubin Ultra จะยังไม่ประกาศ แต่ทิศทางของอุตสาหกรรมค่อนข้างชัดเจนแล้ว ฮาร์ดแวร์ AI รุ่นต่อไปจะไม่ได้แข่งขันกันด้วยพลังประมวลผลของ GPU เพียงอย่างเดียว หากยังขึ้นอยู่กับว่าใครสามารถจัดหา HBM ได้มากพอ ในราคาที่เหมาะสม และส่งมอบได้ตามกำหนด