Taalas' Ansatz greift den fundamentalen Engpass der KI-Inferenz an. In herkömmlichen GPU-Setups müssen die Gewichte eines KI-Modells – die numerischen Parameter, die sein Verhalten bestimmen – ständig aus dem High-Bandwidth-Speicher in die Recheneinheiten verschoben werden. Taalas eliminiert diesen Transport, indem es die Gewichte bereits bei der Fertigung direkt in die Transistorstruktur des Chips einbrennt .
„Das Modell ist der Chip“, beschreibt es Taalas. Das Unternehmen nennt diese Prozessoren „Model Hardcore“ oder modellspezifische integrierte Schaltkreise (MSICs) – kundenspezifische Dies, die die Gewichte und den Datenfluss eines Modells in die Verdrahtung selbst gießen, anstatt sie zur Laufzeit zu laden .
Der erste Testchip, der HC1, wird im TSMC-N6-Verfahren gefertigt und hat rund 53 Milliarden Transistoren auf einer Fläche von 815 mm². Er ist speziell für Metas Llama 3.1-8B ausgelegt und speichert die Gewichte in einem masken-ROM-basierten Array – ohne externen HBM- oder DRAM-Speicher. KV-Caches und Feintuning-Adapter liegen im integrierten SRAM .
Taalas hat den HC1 mit einer Inferenzleistung von bis zu 17.000 Tokens pro Sekunde pro Nutzer vorgeführt – etwa zehnmal schneller als vergleichbare GPU-Setups, bei 20-fach niedrigeren Kosten und etwa zehnmal weniger Stromverbrauch . Der Preis dieser Spezialisierung: Ein Taalas-Chip kann genau ein Modell ausführen. Ein neues Modell erfordert einen neuen Chip. Taalas gibt jedoch an, ein bisher unbekanntes Modell innerhalb weniger Wochen in ein fertiges Chip-Design umsetzen zu können, und TSMC braucht für die Serienfertigung eines kundenspezifischen Bauteils etwa zwei Monate .
In der offiziellen Pressemitteilung heißt es, AMD werde die Taalas-Technologie in seine gesamte KI-Plattform einbinden, um „eine bahnbrechende Inferenzleistung und Effizienz“ zu erzielen . Konkret ist geplant, die spezialisierten Inferenzbeschleuniger von Taalas mit AMD Instinct GPUs, EPYC CPUs, der ROCm-Software und den Helios-Racksystemen zu kombinieren .
Der angestrebte Workflow ist ein hybrider: AMD beabsichtigt, die Prefill-Phase der Inferenz (Prompt-Verarbeitung mit hoher Arithmetikintensität) auf die Instinct-GPUs zu verlagern und dann die Token-Generierung an die Taalas-Beschleuniger zu übergeben, wo die modellspezifische Architektur den Durchsatz maximieren kann .
Taalas-Mitbegründer und ehemaliger Tenstorrent-CEO Ljubisa Bajic – selbst ein früherer AMD-Manager – wird mit dem Taalas-Team in AMDs KI-Organisation unter Vamsi Boppana wechseln .
Taalas ist das jüngste Beispiel einer wachsenden Reihe vielversprechender kanadischer Halbleiter-Startups, die von US-Firmen übernommen wurden – darunter Hyperlume, Untether AI und das chipnahe Unternehmen CentML . Dieses Muster hat die Aufmerksamkeit von Branchenbeobachtern und Politikern auf sich gezogen.
Paul Slaby, Managing Director des Canada Semiconductor Council, nannte die Übernahme von Taalas „eine echte Vertrauensbekundung“ in kanadische KI-Chip-Talente. „AMD kauft kein Team wie Taalas, wenn die Leute hier nicht Weltklasse sind“, sagte Slaby gegenüber BetaKit . Zugleich warnte er jedoch, dass der Deal erneut unterstreiche, wie schwer es Kanada fällt, seine vielversprechendsten Halbleiterunternehmen und das dort entwickelte geistige Eigentum zu halten .
Der Council hat wiederholt darauf hingewiesen, dass Kanada ohne bessere Frühphasenfinanzierung und heimische Skalierungspfade weiterhin seine Chip-Startups – mitsamt den Talenten – in die USA verlieren wird . Ein Bericht des Councils aus dem Jahr 2025 identifizierte den Fachkräftemangel als das größte Wachstumshemmnis im kanadischen Halbleitersektor . Mehr als die Hälfte des gesamten Wagniskapitals, das in kanadische Startups fließt, stammt aus den USA, was US-Investoren einen überproportionalen Einfluss darauf gibt, welche kanadischen Ideen überleben und welche übernommen werden .
Die finanziellen Bedingungen der Transaktion wurden von keiner Seite offengelegt . Die Transaktion unterliegt den üblichen Vollzugsbedingungen und behördlichen Genehmigungen .