IFA 2026에서 분명해진 흐름이 하나 있다. 충분히 큰 **통합 메모리(unified memory)**를 갖춘다면 작은 데스크톱도 로컬 AI 작업용 장비가 될 수 있다는 점이다. 레노버 ThinkCentre X Ultra와 에이스매직 F9A Pro는 모두 AMD Ryzen AI Max+ PRO 495를 기반으로 한다. 이 플랫폼은 16코어 CPU, Radeon 8065S 내장 그래픽, 55 TOPS NPU를 결합하며, AMD 기준 총 AI 성능은 최대 131 TOPS다.
3
5
두 제품을 가르는 가장 중요한 요소는 메모리다. 일반적인 내장 GPU 시스템처럼 제한된 그래픽 메모리를 따로 쓰는 대신, CPU·GPU·NPU가 대형 LPDDR5X 메모리 풀을 함께 사용한다. 작은 본체에서도 더 큰 언어 모델, 긴 컨텍스트 추론, 개발용 워크로드를 로컬에서 다룰 가능성이 생기는 이유다.
핵심 사양 비교
| 항목 |
Lenovo ThinkCentre X Ultra |
Acemagic F9A Pro 495 |
| 폼팩터 |
1.6L 데스크톱 32 |
약 2L, 158.5 × 158.5 × 81.5mm 2 6 |
| 프로세서 |
최대 Ryzen AI Max+ PRO 495 32 |
Ryzen AI Max+ PRO 495 5 |
| AI 성능 |
최대 131 TOPS, NPU 55 TOPS 3 5 |
최대 131 TOPS, NPU 55 TOPS 3 5 |
| 통합 메모리 |
최대 128GB 32 |
최대 192GB LPDDR5X-8533 2 5 |
| GPU용 메모리 할당 |
최대 96GB 그래픽 메모리 18 |
발표 관련 보도 기준 최대 160GB를 GPU에 할당 가능 3 4 |
| 확장 구성 |
최대 4대 클러스터 32 |
동등한 클러스터 구성 발표 없음 |
| 출시 |
2026년 11월 예정 37 |
미정 2 |
| 시작 가격 |
3,699달러부터 예정 37 |
미정 2 |
로컬 LLM에서 통합 메모리가 중요한 이유
로컬 LLM을 돌리려면 모델 가중치뿐 아니라 컨텍스트 캐시와 실행 오버헤드까지 가속기가 접근 가능한 메모리에 담아야 한다. 이들 시스템의 Radeon 내장 GPU는 별도 그래픽카드의 고정 VRAM 용량에 묶이지 않고, CPU와 동일한 대형 LPDDR5X 메모리 풀을 활용할 수 있다.
특히 F9A Pro의 최대 192GB는 용량 측면에서 강력한 사양이다. 에이스매직은 2,840억 파라미터 규모의 DeepSeek V4 Flash를 로컬에서 구동해 보였다고 밝혔고, 다른 보도에서는 최대 160GB를 그래픽 메모리로 할당할 수 있다고 전했다. 다만 이는 모델 탑재 가능 용량에 관한 주장이지, 특정 응답 속도·프레임워크 호환성·파인튜닝 성능을 보장하는 수치는 아니다.
3
5
실사용 가능성은 여전히 양자화 방식, 메모리 대역폭, 모델 구조, 컨텍스트 길이, 배치 크기, 냉각 성능, 소프트웨어 지원에 좌우된다. 대형 모델을 메모리에 올릴 수 있다고 해도, 대화형 작업에서 빠른 응답을 보장하는 것은 아니다.
ThinkCentre X Ultra의 최대 메모리는 128GB로 더 작지만, 1.6L 본체 기준으로는 여전히 이례적으로 큰 용량이다. 최대 96GB의 그래픽 메모리 할당은 운영체제와 애플리케이션용 메모리를 남겨 두면서 로컬 AI 및 워크스테이션 작업을 겨냥한다.
18
32
레노버의 강점: 최대 4대 클러스터
ThinkCentre X Ultra는 더 기업 지향적인 설계다. 레노버는 최대 4대를 하나의 클러스터로 연결해 연산 자원과 메모리를 확장할 수 있다고 설명한다. 더 큰 AI 모델, 긴 컨텍스트 윈도우, 멀티 에이전트 워크플로, 동시 요청 처리에 초점을 둔 구성이다. 최대로 구성하면 통합 메모리는 합산 최대 512GB에 이른다.
32
36
단, 4대 장비가 자동으로 단일 GPU나 하나의 512GB 메모리 풀처럼 동작하는 것은 아니다. 분산 실행을 고려한 소프트웨어와 워크로드 설계가 필요하며, 성능은 소프트웨어 스택과 장비 간 연결 방식에 영향을 받는다. 즉, 핵심 가치는 96GB 그래픽 메모리 할당 4개를 하나의 매끄러운 가속기로 합치는 데 있지 않고, 작은 설치 면적에서 용량과 병렬성을 확보하는 데 있다.
레노버는 X Ultra를 2026년 11월부터, 3,699달러부터 출시할 예정이다. 회사 발표와 보도에 따르면 Windows 11 및 Linux를 지원하며, 최대 2개의 M.2-2280 SSD와 최대 4TB SSD 2개 구성도 언급됐다.
37
38
44
에이스매직의 강점: 한 대당 최대 메모리
F9A Pro는 한 대의 소형 시스템에 가능한 한 큰 통합 메모리를 담으려는 개발자에게 초점이 맞춰져 있다. Ryzen AI Max+ PRO 495 구성은 약 2L 섀시에서 최대 192GB LPDDR5X-8533 통합 메모리를 지원한다.
2
5
연결성도 미니 워크스테이션치고 넓다. USB4 2개, 2.5GbE 유선 LAN 2개, Wi‑Fi 7, Bluetooth 5.4, HDMI 2.1, DisplayPort 2.1, OCuLink 확장을 제공한다. OCuLink은 외장 GPU 등을 연결할 수 있는 PCIe 기반 외부 확장 경로다. 그러나 이 기능이 시스템의 통합 LPDDR5X 메모리를 외장 GPU의 전용 VRAM으로 바꿔 주는 것은 아니다.
4
5
스토리지 사양은 주의가 필요하다. 이전 Ryzen AI Max+ 395 기반 F9A 제품 페이지에는 PCIe 4.0 x4 M.2 NVMe 슬롯 2개가 명시돼 있지만, PRO 495 버전 관련 보도에서는 M.2 슬롯 수가 1개 또는 2개로 엇갈린다. 구매 전 판매 지역별 최종 사양을 확인해야 한다.
9
12
15
IFA 공개 시점까지 에이스매직은 F9A Pro 495의 최종 SKU, 판매 지역, 가격, 정식 출시일을 발표하지 않았다. 따라서 192GB 구성은 사양표상 매력적이지만, 11월 출시 계획을 공개한 레노버 제품과 당장 같은 조건에서 비교할 수 있는 판매 제품은 아니다.
2
RTX Spark와 다른 AMD 미니 PC 사이에서의 위치
이 제품들은 고성능 GPU 워크스테이션을 단순히 작게 줄인 형태는 아니다. 핵심은 더 많은 AI 작업을 기기 내부에 머물게 하는, 대용량 통합 메모리 기반 x86 데스크톱이다. 매력 포인트는 모델 수용 용량, 작은 설치 공간, 일반 데스크톱으로서의 유연성이지, Nvidia CUDA 생태계 장비를 모든 순수 성능 지표에서 앞선다는 뜻은 아니다.
Nvidia의 RTX Spark 시스템도 2026년 10월부터 미니 PC와 노트북에 등장할 예정이다. Nvidia는 Grace CPU와 Blackwell GPU를 결합한 구성을 설명하고 있어, CUDA 중심의 GPU 소프트웨어 생태계를 중시하는 개발팀에는 직접적인 경쟁 구도가 될 수 있다.
24
25
AMD 진영도 빠르게 넓어지고 있다. GMKtec은 같은 Ryzen AI Max+ PRO 495 기반 EVO-X5 Pro를 발표했지만, 발표 당시 가격은 공개하지 않았다.
17 결국 이 시장은 작은 데스크톱에 제한된 그래픽 메모리를 붙이는 전통적 방식에서 벗어나, 메모리 용량이 큰 로컬 추론 환경을 우선하는 방향으로 움직이고 있다.
어떤 제품이 더 적합할까?
ThinkCentre X Ultra는 명확한 출시 일정, Windows·Linux 지원, 소형 장비의 조직 단위 배포, 4노드 클러스터 선택지가 중요한 기업에 더 적합하다. 최대 128GB도 상당한 용량이며, 여러 시스템을 활용하는 로컬 AI 운용을 염두에 둔 제품이다.
32
44
F9A Pro는 한 대에서 확보할 수 있는 최대 메모리가 첫 번째 조건인 개발자에게 더 흥미로운 선택지다. 최대 192GB 통합 메모리와 OCuLink 확장은 분명한 차별점이다. 다만 실제 구매 판단은 최종 스토리지 구성, 운영체제 지원, 지역별 판매 여부, 가격이 공개된 뒤 내리는 편이 안전하다.
2
4
5