Platform ini menggunakan pendekatan bertingkat untuk inferens. CPU EPYC dan GPU Instinct AMD (dalam rak Helios) mengendalikan peringkat hadapan: prapemprosesan gesaan, tokenisasi, dan pemprosesan tetingkap konteks yang besar. Seterusnya, WSE Cerebras mengambil alih untuk fasa yang paling intensif dari segi pengiraan — penjanaan token pantas, yang memerlukan lebar jalur memori yang besar dan daya pemprosesan selari .
Reka bentuk teragregat ini membolehkan setiap subtugas inferens dijalankan pada silikon yang paling sesuai untuknya. AMD menyediakan logik CPU/GPU berlatensi rendah untuk peringkat umum, manakala cip berskala wafer Cerebras menyampaikan kuasa tembakan selari yang besar untuk pelaksanaan model teras . Ketua Pegawai Eksekutif AMD, Lisa Su, menggambarkan perkongsian ini sebagai sebahagian daripada peralihan yang lebih luas ke arah penggunaan cip yang berbeza untuk peringkat saluran paip inferens yang berbeza .
Kedua-dua syarikat mendakwa platform bersama ini menyampaikan masa respons yang jauh lebih rendah untuk aplikasi AI yang kompleks berbanding inferens berasaskan GPU monolitik. Bahasa rasmi menggambarkannya sebagai menyampaikan "inferens AI latensi ultra-rendah dan daya pemprosesan tinggi yang terkemuka dalam industri" . Angka penanda aras khusus — seperti token sesaat atau latensi dalam milisaat — tidak diterbitkan secara terperinci pada acara tersebut. Saham Cerebras meningkat kira-kira 6% pada hari pengumuman .
Tawaran bersama ini dijangka tersedia melalui Cerebras Cloud pada akhir tahun 2026. Cerebras merancang untuk menggunakan sistem AMD Helios di pusat datanya sendiri untuk mengehos perkhidmatan tersebut .
AMD juga secara rasmi melancarkan Helios, sistem AI peringkat rak pertamanya, pada acara tersebut. CEO Lisa Su menyebutnya sebagai "rak AI paling berkuasa di dunia" dan mengesahkan ia dalam pengeluaran penuh . Spesifikasi utama termasuk:
Helios diposisikan sebagai pesaing langsung kepada sistem rak DGX dan HGX Nvidia, dengan AMD mendakwa prestasi unggul merentas kedua-dua beban kerja latihan dan inferens AI .
Mesej menyeluruh dari Advancing AI 2026 ialah pasaran inferens AI beralih daripada hanya bergantung pada satu jenis GPU untuk setiap peringkat beban kerja. Sebaliknya, industri beralih ke arah seni bina teragregat dan dioptimumkan mengikut beban kerja yang membahagikan prapemprosesan, pelaksanaan inferens, dan pasca-pemprosesan merentas silikon khusus daripada vendor berbeza. AMD merangka Helios dan perkongsian Cerebras sebagai alternatif multi-vendor, ekosistem terbuka kepada pendekatan bersepadu secara menegak Nvidia .
Selain perkongsian Cerebras dan pelancaran Helios, AMD membuat beberapa pengumuman penting lain:
AMD mendedahkan bahawa ia telah memperoleh perjanjian pelanggan dengan Anthropic pada awal minggu yang sama, sebelum acara Advancing AI. Anthropic menyertai senarai makmal AI utama yang berjanji untuk menggunakan perkakasan AMD (termasuk sistem Helios) pada skala besar, sebahagian daripada trend yang lebih luas syarikat AI peringkat teratas mempelbagaikan daripada monopoli GPU Nvidia .
Cerebras telah melalui tahun yang hebat secara bebas daripada perkongsiannya dengan AMD. Syarikat itu telah diumumkan ke pasaran awam pada 14 Mei 2026, di Nasdaq di bawah ticker CBRS. Ia menetapkan harga 30 juta saham pada $185.00 sesaham, jauh melebihi julat $115–$125 yang dijangkakan pada awalnya, mengumpul $5.55 bilion dalam IPO teknologi A.S. terbesar pada tahun 2026. Saham itu melonjak 68% pada hari dagangan pertamanya, ditutup pada $311.07 .
Pada Januari 2026, OpenAI dan Cerebras mengumumkan perjanjian pelbagai tahun untuk kapasiti pengkomputeran sehingga 750 megawatt. Komitmen awal dilaporkan kira-kira $10 bilion, kemudian diperluaskan kepada lebih $20 bilion (dengan potensi had $30 bilion). OpenAI juga dilaporkan menerima pegangan ekuiti sehingga 10% dalam Cerebras sebagai sebahagian daripada perjanjian itu .