GMKtec의 EVO-X5 Pro와 Acemagic의 F9A는 AMD의 Ryzen AI Max+ PRO 495를 기반으로 한 소형 워크스테이션이다. 이 칩의 이전 코드명은 **고르곤 헤일로(Gorgon Halo)**다. 핵심은 별도 그래픽카드가 아니라 CPU와 내장 GPU가 함께 쓰는 최대 192GB의 고대역폭 통합 메모리다. 대형 언어 모델(LLM)을 클라우드에 올리지 않고 로컬에서 적재·추론하려는 개발자와 조직이 주된 대상이다.
1
8
43
IFA 2026에서 공개된 사양
Ryzen AI Max+ PRO 495는 Zen 5 CPU 16코어·32스레드, 최대 5.2GHz 부스트, 40 CU의 Radeon 8065S 내장 그래픽을 결합한다. AMD 사양상 최대 192GB의 256비트 LPDDR5X-8533 메모리를 지원한다. NPU 성능은 최대 55 TOPS이며, 제조사 자료에는 플랫폼 전체 기준 최대 131 AI TOPS가 제시된다.
1
3
43
이 구조에서 메모리는 시스템 RAM과 그래픽카드 VRAM으로 물리적으로 나뉘지 않는다. 지원되는 구성에서는 총 192GB 가운데 최대 160GB를 내장 GPU의 그래픽 메모리로 할당할 수 있다. 256비트 인터페이스의 LPDDR5X-8533은 이론상 약 273GB/s의 메모리 대역폭에 해당한다.
3
35
43
두 제품의 공개 정보는 다음과 같다.
- GMKtec EVO-X5 Pro: GMKtec은 Ryzen AI Max+ PRO 495 기반 미니 PC, 최대 192GB 메모리, 최대 160GB GPU 메모리 할당을 확인했다. 판매 개시는 2026년 10월로 예고했다.
8
- Acemagic F9A: Acemagic은 IFA에서 같은 프로세서 계열과 최대 192GB 통합 메모리, Radeon 8065S를 탑재한 F9A PRO 495를 선보였다. 보도에 따르면 크기는 158.5 × 158.5 × 81.5mm, 부피는 약 2L다.
1
29
다만 두 시스템 모두 포트 구성, 냉각 설계, 전력 제한, 지역별 사양에 대한 최종적이고 동등한 수준의 문서는 아직 충분하지 않다. 특히 미니 PC에서 장시간 AI 추론 성능은 칩 이름만큼이나 냉각 성능과 설정된 전력 한도에 좌우된다.
3,000억 파라미터 LLM은 왜 INT4에서만 가능한가
파라미터 수만으로 모델 탑재 가능 여부를 판단할 수는 없다. 양자화 형식과 실행 시 필요한 추가 메모리도 함께 봐야 한다. 가중치만 계산하면 3,000억 파라미터 모델에는 대략 다음 용량이 필요하다.
| 가중치 형식 |
가중치의 대략적 원시 크기 |
160GB GPU 할당 영역에서의 실용적 탑재 여부 |
| FP16 |
600GB |
불가 |
| INT8 |
300GB |
불가 |
| INT4 |
150GB(10진 기준) |
여유가 매우 제한적인 조건에서 가능성 있음 |
파라미터당 4비트를 쓰는 INT4에서는 3,000억 개 가중치가 약 150GB를 차지한다. 그러나 여기에는 양자화 메타데이터, 런타임 버퍼, 긴 문맥 처리를 위한 KV 캐시가 포함되지 않는다. AMD가 3,000억 파라미터급 실행 가능성을 언급할 때도 모델 구조, 양자화 방식, 워크로드 구성을 조건으로 다는 이유다.
15
31
따라서 현실적인 해석은 이렇다. 이들 시스템은 일부 3,000억 파라미터급 INT4 모델을 로드하고 실행할 가능성이 있지만, FP16이나 INT8의 3,000억 파라미터 모델을 구동한다는 뜻은 아니다. 높은 토큰 생성 속도도 보장하지 않는다. GPU에 160GB를 할당하면 운영체제와 CPU 작업에 남는 메모리도 제한된다.
제공된 자료에서는 **‘Qwen3.8-Flash-Next’**라는 모델 또는 시연에 관한 신뢰할 만한 1차 근거를 확인할 수 없다. 따라서 이를 독립적으로 검증된 벤치마크나 제품 시연으로 간주해서는 안 된다.
세대 교체의 핵심은 연산량보다 메모리 용량
이전 Ryzen AI Max 300 계열은 LPDDR5X-8000 통합 메모리를 최대 128GB까지 지원했다. PRO 400 플랫폼은 이를 최대 192GB로 끌어올렸는데, 50% 증가다. 보도에 따르면 그래픽 메모리 최대 할당량도 96GB에서 160GB로 높아졌다.
11
대역폭 증가는 상대적으로 작다. 256비트 LPDDR5X-8000은 이론상 약 256GB/s이고, LPDDR5X-8533은 약 273GB/s로 약 6.6% 높다. CPU는 여전히 16코어 Zen 5 설계이며, 최상위 모델도 Radeon 8065S 그래픽을 유지한다. 즉 전면적인 연산 아키텍처 교체라기보다, 주로 메모리 용량을 확장한 업데이트에 가깝다.
9
33
36
구매자에게는 이 차이가 중요하다. 늘어난 메모리는 더 큰 모델을 한 대의 시스템에 상주시킬 수 있게 하지만, 내장 GPU를 HBM 메모리를 탑재한 데이터센터용 가속기로 바꾸지는 않는다.
192GB 고르곤 헤일로 생태계
PRO 400 계열에는 Ryzen AI Max PRO 485, 490, Max+ PRO 495가 포함된다. 495는 16코어와 Radeon 8065S를 탑재한 최상위 구성이고, 485와 490은 Radeon 8050S를 사용한다.
16
32
같은 플랫폼을 둘러싼 다른 제품도 공개됐다.
- Minisforum MS-S1 MAX P495: 최대 192GB LPDDR5X 통합 메모리와 최대 160GB VRAM 할당을 내세운 미니 워크스테이션.
3
4
- Framework Desktop: PRO 495, 192GB 메모리, 명시된 273GB/s 대역폭, iGPU에 최대 160GB 할당을 지원하는 소형 데스크톱 구성.
14
33
- Lenovo ThinkCentre X Ultra: PRO 495 탑재 가능성이 보도됐지만, 메모리 최대치는 128GB, 전용 그래픽 메모리 할당은 최대 96GB로 제시됐다. 2026년 11월 출시 예정 및 시작가 3,669달러로 보도됐다.
34
누구에게 적합한가
192GB 고르곤 헤일로 미니 워크스테이션은 최고 처리량보다 모델 수용량과 데이터 로컬리티가 중요한 로컬 추론·개발 장비로 보는 편이 맞다. 강하게 양자화한 LLM을 실험하거나, 민감한 문서 기반 워크플로, 오프라인 AI 개발처럼 데이터를 외부 클라우드 서비스로 보내고 싶지 않은 환경에서 의미가 있다.
한계도 분명하다. 약 273GB/s 대역폭의 통합 메모리를 쓰는 Radeon iGPU는 HBM 기반의 고성능 가속기와 성격이 다르다. NPU의 55 TOPS도 대형 LLM 토큰 생성 성능을 직접 나타내는 수치가 아니다. 실제 성능은 소프트웨어 스택, GPU 실행 경로, 모델 형식, 컨텍스트 길이, 지속 전력 설정에 따라 달라진다.
1
35
가격도 변수다. Acemagic은 192GB 메모리와 2TB SSD를 갖춘 F9A를 자사 스토어와 아마존에서 2026년 9월 8,000유로에 판매할 계획인 것으로 보도됐다. 이는 실제 거래가가 아닌 보도된 예정 판매가로 봐야 한다.
6
그럼에도 EVO-X5 Pro와 F9A는 소형 AI 워크스테이션의 방향을 보여준다. 책상 위에 둘 수 있는 한 대의 시스템에서 훨씬 큰 양자화 모델을 유지할 수 있을 정도로 통합 메모리 용량을 끌어올리는 흐름이다. 구매 전에는 ‘300B 지원’이라는 문구보다 어떤 양자화 모델을, 어느 컨텍스트 길이에서, 어느 정도 속도로 실행할 수 있는지를 확인하는 것이 더 중요하다.