GMKtec en Acemagic hebben op IFA 2026 in Berlijn compacte workstations getoond rond AMD's Ryzen AI Max+ PRO 495, voorheen bekend onder de codenaam Gorgon Halo. Het opvallendste onderdeel is niet een losse videokaart, maar één grote gedeelde geheugenpool van maximaal 192 GB. Die is bedoeld voor ontwikkelaars die grote, gequantiseerde taalmodellen lokaal willen gebruiken, zonder prompts of documenten naar een clouddienst te sturen.
1
8
43
De kern: 192 GB gedeeld geheugen
De Ryzen AI Max+ PRO 495 heeft 16 Zen 5-processorkernen en 32 threads, een boostklok tot 5,2 GHz en geïntegreerde Radeon 8065S-graphics met 40 compute units. AMD vermeldt ondersteuning voor maximaal 192 GB LPDDR5X-8533 via een 256-bits geheugeninterface. De NPU is goed voor maximaal 55 TOPS; fabrikanten noemen voor het hele platform maximaal 131 AI-TOPS.
1
3
43
CPU, iGPU en AI-hardware gebruiken daarbij dezelfde geheugenpool, in plaats van afzonderlijk systeemgeheugen en videogeheugen. In geschikte configuraties kan maximaal 160 GB van de 192 GB aan de geïntegreerde GPU worden toegewezen. De theoretische bandbreedte van LPDDR5X-8533 op die 256-bits interface komt uit op ongeveer 273 GB/s.
3
35
43
Dat is precies waarom deze machines interessant zijn voor lokale AI: niet omdat de geïntegreerde Radeon een datacenter-GPU vervangt, maar omdat er veel meer geheugen beschikbaar is dan bij de meeste compacte pc's of losse gpu's.
EVO-X5 Pro en F9A: wat is er bekend?
- GMKtec EVO-X5 Pro: GMKtec bevestigde een mini-pc met Ryzen AI Max+ PRO 495, maximaal 192 GB geheugen en maximaal 160 GB toewijsbaar aan de GPU. Volgens het bedrijf start de verkoop in oktober 2026.
8
- Acemagic F9A: De F9A PRO 495 werd op IFA getoond met dezelfde processorfamilie, maximaal 192 GB unified memory en Radeon 8065S-graphics. Volgens een bericht meet de behuizing ongeveer 158,5 × 158,5 × 81,5 mm en heeft deze een inhoud van circa twee liter.
1
29
Voor beide systemen ontbreken nog volledige, definitieve gegevens over aansluitingen, koeling, vermogenslimieten en regionale uitvoeringen. Dat zijn geen bijzaken: bij langdurige AI-inference in een mini-pc bepalen koeling en ingestelde vermogenslimiet mede de werkelijke prestaties.
Waarom een 300B-model alleen met INT4 enigszins past
Een parameteraantal zegt op zichzelf niet genoeg. Het gebruikte quantisatieformaat en de overhead van de software bepalen of een model werkelijk in het beschikbare geheugen past. Alleen de gewichten van een model met 300 miljard parameters nemen ruwweg het volgende in beslag:
| Gewichtformaat |
Ruwe grootte van de gewichten |
Past praktisch binnen 160 GB GPU-geheugen? |
| FP16 |
600 GB |
Nee |
| INT8 |
300 GB |
Nee |
| INT4 |
150 GB decimaal |
Mogelijk, maar met weinig speelruimte |
Bij 4 bits per parameter nemen 300 miljard gewichten ongeveer 150 GB in, nog zonder quantisatiemetadata, runtimebuffers en de key-value-cache die nodig is voor de context. Daarom is AMD's positionering rond modellen in de 300B-klasse afhankelijk van sterke quantisatie en de gekozen workloadconfiguratie. AMD koppelt die claim zelf eveneens aan modelarchitectuur, quantisatie en workload.
15
31
De praktische conclusie: deze mini-pc's kunnen mogelijk bepaalde INT4-modellen van grofweg 300 miljard parameters laden en uitvoeren, maar dat is iets heel anders dan een 300B-model draaien in FP16 of INT8. Ook is het geen belofte van een hoge tokensnelheid. Een grote GPU-geheugentoewijzing laat bovendien weinig ruimte over voor het besturingssysteem en taken aan CPU-zijde.
Voor een demonstratie of model met de naam Qwen3.8-Flash-Next is in het aangeleverde bronmateriaal geen betrouwbare primaire onderbouwing te vinden. Die naam kan daarom niet als onafhankelijk geverifieerde benchmark of productdemonstratie worden behandeld.
Vooral meer capaciteit, niet een compleet nieuwe rekenarchitectuur
Vergeleken met de eerdere Ryzen AI Max 300-generatie, die maximaal 128 GB LPDDR5X-8000 unified memory ondersteunde, gaat de PRO 400-reeks naar 192 GB: een stijging van 50%. De maximale GPU-geheugentoewijzing groeit volgens berichtgeving van 96 GB naar 160 GB.
11
De bandbreedte stijgt minder spectaculair. Een 256-bits LPDDR5X-8000-configuratie haalt theoretisch ongeveer 256 GB/s; LPDDR5X-8533 komt uit op circa 273 GB/s, oftewel ongeveer 6,6% meer. De processor blijft een 16-core Zen 5-ontwerp en het topmodel behoudt Radeon 8065S-graphics. Het gaat dus vooral om een geheugenupgrade, niet om een volledig nieuwe compute-architectuur.
9
33
36
Voor kopers is dat onderscheid belangrijk. Het extra geheugen verandert welke modellen lokaal in het geheugen kunnen blijven staan, maar maakt van de geïntegreerde GPU geen datacenteraccelerator met HBM-geheugen en veel hogere bandbreedte.
Meer systemen op het 192GB-platform
De PRO 400-familie bestaat uit de Ryzen AI Max PRO 485, 490 en Max+ PRO 495. De 495 is de topversie met 16 kernen en Radeon 8065S; de 485 en 490 gebruiken Radeon 8050S-graphics.
16
32
Andere aangekondigde systemen rond dit platform zijn:
- Minisforum MS-S1 MAX P495, een mini-workstation met maximaal 192 GB LPDDR5X unified memory en maximaal 160 GB toewijsbaar als VRAM.
3
4
- Framework Desktop, een compacte desktopconfiguratie met PRO 495, 192 GB geheugen, een opgegeven bandbreedte van 273 GB/s en maximaal 160 GB beschikbaar voor de iGPU.
14
33
- Lenovo ThinkCentre X Ultra, dat is gemeld met maximaal een PRO 495, maar met een lagere geheugenlimiet van 128 GB en maximaal 96 GB toegewezen grafisch geheugen. De verwachte startprijs was $ 3.669 en levering stond gepland voor november 2026.
34
Voor wie zijn deze mini-workstations bedoeld?
Een Gorgon Halo-mini-workstation met 192 GB is vooral een machine voor lokale inference en ontwikkeling, waarbij modelcapaciteit en gegevens op het eigen apparaat houden zwaarder wegen dan maximale snelheid. Denk aan teams die gequantiseerde LLM's testen, vertrouwelijke documentworkflows bouwen of offline AI ontwikkelen zonder voor elke taak een cloudinstance te gebruiken.
De beperkingen blijven duidelijk. Een Radeon-iGPU met gedeeld geheugen en ongeveer 273 GB/s bandbreedte is fundamenteel iets anders dan een krachtige accelerator met HBM-geheugen. Ook zegt de NPU-score van 55 TOPS niet rechtstreeks hoeveel tokens per seconde een groot taalmodel produceert. De softwarestack, het uitvoeringspad via de GPU, het modelformaat, de contextlengte en het langdurig beschikbare vermogen zijn allemaal van invloed.
1
35
Ook de prijs vormt een drempel. Acemagic zou volgens berichtgeving een F9A met 192 GB RAM en 2 TB opslag voor € 8.000 via de eigen winkel en Amazon willen aanbieden in september 2026. Zie dat als een gemelde geplande adviesprijs, niet als een bevestigde marktprijs.
6
De EVO-X5 Pro en F9A laten wel zien waar compacte AI-workstations naartoe bewegen: systemen met genoeg unified memory om aanzienlijk grotere gequantiseerde modellen op één bureaucomputer te houden. De nuttigste vraag voor een koper is daarom niet alleen of een machine '300B' belooft, maar vooral: welk gequantiseerd model, met welke contextlengte, draait hij op een bruikbare snelheid?