Langkah ini membawa AMD lebih dekat kepada persaingan sengit dengan Nvidia dalam pasaran perkakasan yang digunakan untuk menjalankan model AI pada skala besar.
Dalam GPU konvensional, termasuk GPU Nvidia, model AI biasanya disimpan dalam High Bandwidth Memory (HBM). Semasa inferens, pemberat model perlu dipindahkan berulang kali dari memori ke teras pengiraan. Pergerakan data ini menjadi apa yang sering dipanggil “dinding memori” — had yang mengehadkan kelajuan pemprosesan dan pada masa sama menggunakan banyak tenaga.
Taalas cuba menghapuskan masalah itu melalui cip yang dipanggil model-specific integrated circuit (MSIC). Ketika cip dihasilkan, bukan sahaja aliran data model, malah nilai berangka pemberat model turut dimasukkan terus ke dalam lapisan logik dan logam cip. Ini bermakna cip tidak perlu memuatkan pemberat daripada memori ketika beroperasi.
Kesan prestasinya kelihatan ketara dalam ujian awal. Cip ujian HC1 Taalas, yang dibina menggunakan proses 6 nanometer TSMC, menjalankan model Llama 3.1 8B milik Meta pada 16,960 token sesaat pada Februari 2026. Angka itu dilaporkan sehingga 48 kali lebih pantas berbanding inferens pada GPU Nvidia yang setara. Sesetengah perbandingan lain menyebut angka sehingga 73 kali ganda, bergantung pada GPU Nvidia yang dijadikan penanda aras.
Kelebihan utama Taalas juga merupakan batasan terbesarnya. Oleh sebab pemberat model “dibakar” secara fizikal ke dalam silikon ketika proses pembuatan, setiap cip hanya boleh menjalankan satu model tertentu. Pengguna tidak boleh memuatkan model lain ke dalam cip yang sama seperti mereka boleh berbuat demikian pada GPU serba guna.
Namun begitu, Taalas membangunkan rantaian alat yang dapat mempercepatkan penghasilan cip untuk model baharu. Syarikat itu hanya memuktamadkan dua lapisan logam teratas daripada susunan cip yang mempunyai kira-kira 100 lapisan. Reka bentuk wafer asas dikekalkan, membolehkan cip baharu untuk model sasaran disediakan dalam tempoh kira-kira dua bulan selepas model ditetapkan.
Pendekatan ini tidak menghapuskan keperluan menghasilkan cip fizikal baharu, tetapi menjadikan proses “pusingan semula” lebih pantas berbanding pembangunan ASIC tradisional.
AMD merancang untuk memasukkan MSIC Taalas ke dalam seni bina pengkomputeran terpisah dan heterogen, bersama GPU Instinct serta sistem berskala rak Helios.
Dalam susunan ini, GPU Instinct yang lebih fleksibel boleh mengendalikan latihan model dan tugas inferens yang pelbagai. Sementara itu, cip Taalas akan digunakan sebagai pemecut khusus berkelajuan tinggi dan kependaman rendah untuk model yang paling popular serta menerima jumlah permintaan tertinggi. Platform Helios pula menghubungkan komponen-komponen itu dalam satu fabrik pengkomputeran berskala rak.
Secara mudah, AMD mahu menawarkan dua lapisan perkakasan:
Strategi ini membolehkan AMD mengekalkan kelebihan GPU serba guna sambil menyediakan cip khusus untuk kerja inferens yang berulang dan besar-besaran.
AMD dan Taalas tidak mendedahkan nilai pengambilalihan tersebut. Perjanjian itu menyusuli beberapa pembelian besar AMD yang lain, termasuk pengambilalihan ZT Systems bernilai AS$4.9 bilion pada Julai 2024 dan Silo AI bernilai AS$665 juta pada Ogos 2024.
Dari sudut persaingan, pembelian Taalas turut meletakkan AMD berhadapan dengan langkah Nvidia dalam bidang inferens. Nvidia dilaporkan memeterai perjanjian pelesenan bernilai AS$20 bilion dengan Groq pada awal 2026 untuk mendapatkan akses kepada seni bina LPU syarikat tersebut.
Pertaruhan AMD ialah cip yang dikhususkan untuk model tertentu mungkin menawarkan prestasi per watt yang lebih baik bagi beban kerja inferens yang tetap dan bervolum tinggi.
Taalas diasaskan di Toronto pada 2023 oleh Ljubisa Bajic, bekas ketua pegawai eksekutif Tenstorrent, bersama pasukan yang turut merangkumi bekas jurutera AMD.
Sebelum diambil alih, syarikat itu mengumpulkan AS$219 juta dalam pembiayaan modal teroka daripada pelabur termasuk Eclipse Ventures, Makers Fund dan Radical Ventures.
Pada Februari 2026, Taalas memperkenalkan cip ujian HC1 yang menjalankan Llama 3.1 8B pada kadar 16,960 token sesaat — demonstrasi yang membantu menarik perhatian AMD.
Pengambilalihan Taalas menunjukkan AMD sedang mempertaruhkan idea bahawa masa depan inferens AI bukan semata-mata bergantung pada GPU serba guna yang semakin pantas. Untuk model yang sangat popular dan digunakan berulang kali, cip khusus yang mengorbankan fleksibiliti mungkin menawarkan kelajuan serta kecekapan tenaga yang lebih baik.
Dengan menggabungkan MSIC Taalas bersama GPU Instinct dan sistem Helios, AMD cuba membina susunan yang boleh mengendalikan kedua-dua hujung pasaran: model yang pelbagai dan berubah-ubah, serta model teras yang menerima trafik tinggi. Itulah asas cabaran baharunya terhadap dominasi Nvidia dalam infrastruktur inferens AI.