Podejście Taalas atakuje fundamentalne wąskie gardło w wnioskowaniu AI. W konwencjonalnych konfiguracjach GPU, wagi modelu AI – parametry liczbowe określające zachowanie modelu – muszą być stale przenoszone z pamięci o wysokiej przepustowości do jednostek obliczeniowych. Taalas eliminuje tę podróż, wytrawiając wagi bezpośrednio w układzie tranzystorów chipa na etapie produkcji .
„Model to chip” – jak opisuje to Taalas. Firma nazywa te procesory „Modelem Hardcore” lub modelowo specyficznymi układami scalonymi (MSIC) – niestandardowymi matrycami, które odlewają wagi i przepływ danych modelu bezpośrednio w okablowaniu, zamiast ładować je w czasie wykonywania .
Jej pierwszy testowy chip, HC1, jest zbudowany w procesie N6 TSMC z około 53 miliardami tranzystorów na matrycy 815 mm². Jest zaprojektowany specjalnie dla modelu Meta Llama 3.1-8B i przechowuje wagi w układzie pamięci mask-ROM zamiast zewnętrznego HBM lub DRAM. Pamięci podręczne KV i adaptery do dostrajania znajdują się w SRAM na chipie .
Taalas zademonstrował HC1 działający z szybkością wnioskowania do 17 000 tokenów na sekundę na użytkownika – około 10 razy szybciej niż porównywalne konfiguracje GPU – przy 20-krotnie niższym koszcie i około 10 razy mniejszej mocy . Kompromis jest wyraźny: chip Taalas uruchamia dokładnie jeden model. Zmiana modelu wymaga nowego chipa. Ale Taalas twierdzi, że jego zautomatyzowany proces może przekształcić wcześniej nieznany model w gotowy projekt chipa w ciągu kilku tygodni, a TSMC może wyprodukować niestandardową część w około dwa miesiące .
Oficjalny komunikat prasowy AMD stwierdza, że zintegruje technologię Taalas w całej swojej platformie AI, aby zapewnić „przełomową wydajność i efektywność wnioskowania” . Plan obejmuje łączenie wyspecjalizowanych akceleratorów wnioskowania Taalas z GPU AMD Instinct, procesorami EPYC, oprogramowaniem ROCm i systemami typu rack Helios w rozwiązania na poziomie systemowym .
Przewidywany przepływ pracy jest hybrydowy: AMD zamierza kierować fazę wstępnego wypełniania wnioskowania (przetwarzanie promptów, gdzie intensywność arytmetyczna jest wysoka) do GPU Instinct, a następnie przekazać fazę generowania tokenów do akceleratorów Taalas, gdzie architektura specyficzna dla modelu może zmaksymalizować przepustowość .
Współzałożyciel Taalas i były dyrektor generalny Tenstorrent Ljubisa Bajic – sam były dyrektor AMD – oraz zespół Taalas dołączą do AMD w ramach organizacji AI Vamsiego Boppany .
Taalas to najnowszy z rosnącej linii obiecujących kanadyjskich startupów półprzewodnikowych przejmowanych przez amerykańskie firmy, obok Hyperlume, Untether AI i bliskiego chipom CentML . Ten wzór przyciągnął uwagę obserwatorów branży i decydentów politycznych.
Paul Slaby, dyrektor zarządzający Kanadyjskiej Rady ds. Półprzewodników, nazwał przejęcie Taalas „prawdziwym głosem zaufania” dla kanadyjskich talentów w dziedzinie chipów AI. „AMD nie kupuje zespołu takiego jak Taalas, jeśli ludzie tutaj nie są światowej klasy” – powiedział Slaby BetaKit . Ale jednocześnie ostrzegł, że umowa podkreśla walkę Kanady o utrzymanie najbardziej obiecujących firm półprzewodnikowych i własności intelektualnej w nich rozwijanej .
Rada wielokrotnie sygnalizowała, że bez lepszego kapitału na wczesnym etapie i krajowych ścieżek skalowania, Kanada będzie nadal obserwować migrację swoich rodzimych startupów chipowych – i stojących za nimi talentów – do USA . Raport Rady z 2025 roku zidentyfikował niedobory talentów jako główną barierę wzrostu w kanadyjskim sektorze półprzewodników . Ponad połowa całego kapitału wysokiego ryzyka inwestowanego w kanadyjskie startupy pochodzi z USA, co daje amerykańskim inwestorom nieproporcjonalny wpływ na to, które kanadyjskie pomysły przetrwają, a które zostaną przejęte .
Warunki finansowe transakcji nie zostały ujawnione przez żadną ze stron . Umowa podlega standardowym warunkom zamknięcia i zatwierdzeniom regulacyjnym .