AMD menetapkan matlamat untuk meningkatkan kecekapan tenaga rak AI sebanyak 20 kali ganda menjelang 2030, menggunakan 2024 sebagai tahun asas. Sasaran ini meliputi kedua-dua latihan dan inferens AI—iaitu proses menghasilkan jawapan atau ramalan selepas model dilatih.
Dalam unjuran ilustratif AMD, kira-kira dua rak AI AMD pada 2030 boleh menyampaikan keupayaan pengkomputeran yang sama seperti 570 rak berasaskan Instinct MI300X pada 2024.
Jika tugasan yang sama benar-benar memerlukan tenaga 20 kali lebih rendah, implikasinya ialah pengurangan penggunaan elektrik sekitar 95 peratus untuk kerja yang setara. Satu lagi laporan yang memetik senario AMD menyatakan intensiti karbon boleh berkurang sehingga 28 kali ganda.
Angka karbon itu wajar dianggap sebagai unjuran, bukan hasil yang terjamin untuk setiap pusat data. Intensiti karbon turut bergantung pada campuran elektrik yang digunakan—contohnya bahagian tenaga boleh diperbaharui berbanding bahan api fosil—selain kecekapan perkakasan. Bahan utama yang tersedia tidak menyokong pengiraan bebas yang lebih tepat bagi pengurangan karbon tersebut.
Program AMD sebelum ini, 30x25, menilai kecekapan pada peringkat node—gabungan CPU dan pemecut GPU dalam satu nod pengkomputeran. AMD berkata ia mengatasi sasaran itu dengan peningkatan kecekapan sebanyak 38 kali ganda antara 2020 dan 2025, yang disamakan dengan penggunaan tenaga 97 peratus lebih rendah bagi prestasi yang sama.
Sasaran baharu mengambil kira keseluruhan rak, bukan cip semata-mata. Ini termasuk:
Pendekatan ini penting kerana jumlah FLOPS—bilangan operasi titik apungan sesaat—tidak semestinya menunjukkan berapa banyak tenaga diperlukan untuk menyiapkan satu tugasan latihan atau inferens.
AMD mengaitkan kemajuan tersebut dengan beberapa lapisan reka bentuk yang perlu berfungsi serentak:
Platform Helios ialah usaha AMD menawarkan sistem AI bersepadu pada peringkat rak, sekali gus mencabar kedudukan Nvidia dalam infrastruktur AI berskala besar. Konfigurasi yang diumumkan merangkumi:
AMD turut menyatakan satu rak boleh mencapai sehingga 2.9 exaFLOPS FP4. Berbanding rak Nvidia Vera Rubin NVL72, tuntutan AMD sendiri menyebut sehingga 15 peratus lebih prestasi FP4 puncak, 50 peratus lebih kapasiti HBM dan 50 peratus lebih lebar jalur scale-out. Itu semua ialah tuntutan vendor dan bukan keputusan penanda aras bebas.
AMD berkata Helios sudah berada dalam pengeluaran penuh pada Julai 2026, dengan penghantaran pertama dijadualkan pada penghujung suku ketiga dan peningkatan jumlah pengeluaran selepas itu, termasuk momentum lebih besar pada suku keempat.
Bukti yang tersedia tidak menetapkan pencapaian pengeluaran khusus pada 2027. Oleh itu, sebarang rujukan kepada garis masa “2026–2027” lebih tepat dianggap sebagai jangkaan peningkatan penggunaan, bukannya jadual 2027 yang telah disahkan.
Taruhan ini hadir ketika perniagaan pusat data AMD berkembang pesat. Hasil pusat datanya dilaporkan mencecah sekitar AS$6.7 bilion pada suku kedua 2026, meningkat 107 peratus berbanding tahun sebelumnya. Angka tersebut merangkumi jualan pemproses EPYC dan pemecut Instinct, jadi ia tidak boleh dianggap sebagai hasil GPU AI semata-mata.
Helios menunjukkan persaingan AMD dengan Nvidia kini bukan hanya tentang siapa yang menghasilkan GPU terpantas. Ia turut melibatkan memori, rangkaian, kuasa, penyejukan, perisian, kos setiap token dan keupayaan menghantar keseluruhan sistem kepada pelanggan.
Sumber yang tersedia tidak memberikan bukti mencukupi untuk mengukur atau menerangkan strategi pembiayaan Nvidia dan hasil sistem TPU Google secara boleh dipercayai. Kedua-duanya kekal sebagai dinamika persaingan yang relevan, tetapi tidak wajar dinyatakan sebagai fakta khusus tanpa laporan berasingan yang disokong sumber kukuh.
Kesimpulannya, tuntutan 4 kali ganda AMD menandakan kemajuan awal yang lebih pantas daripada sasaran interimnya. Tetapi cabaran sebenar ialah mengekalkan kadar itu sehingga mencapai sasaran 20 kali ganda pada 2030—dalam sistem sebenar yang turut berdepan had bekalan elektrik, penyejukan, rangkaian dan kos operasi.