엔비디아가 차세대 AI 가속기 루빈 울트라의 메모리 구성을 낮춘 설계를 검토 중이라는 보도가 나왔습니다. 전해진 시제품 용량은 GPU당 192GB 또는 256GB입니다. 다만 엔비디아가 최종 사양을 발표한 것은 아니며, 두 용량 모두 표준 루빈의 288GB보다 낮고 당초 거론된 루빈 울트라의 약 1TB 목표와도 차이가 큽니다.
1
4
5
어떤 HBM 구성을 검토하나
트렌드포스에 따르면 엔비디아는 당초 기준으로 삼았던 12단 HBM4E뿐 아니라 8단 HBM4E, 12단 HBM4, 8단 HBM4 구성도 평가하고 있습니다. 최종 설계는 아직 결정되지 않았습니다.
2
별도 보도에서는 GPU당 192GB 또는 256GB를 탑재한 루빈 울트라 시제품이 언급됐으며, 일부는 최신 HBM4E 대신 HBM4를 사용하는 것으로 전해졌습니다. 이는 검토 중인 설계에 관한 보도이지, 양산 제품의 확정 사양은 아닙니다.
1
5
보도된 용량 비교
| 구성 |
GPU당 보도된 HBM 용량 |
보도 내용 |
| 표준 루빈 |
288GB |
루빈 울트라와 비교 대상으로 언급된 용량입니다. 1 |
| 루빈 울트라 시제품 |
192~256GB |
시험 중인 제품에 관한 보도이며, 최종 사양으로 확인되지는 않았습니다. 5 |
| 루빈 울트라의 당초 목표 |
약 1TB |
초기 설계 구상으로 보도된 수치입니다. 4 |
192GB 구성이라면 표준 루빈보다 메모리가 3분의 1 적습니다. 256GB도 표준 루빈의 보도된 288GB보다 낮습니다. 두 수치 모두 약 1TB 목표와 큰 차이가 있지만, 초기 목표와 최근 시제품 보도가 서로 다른 설계 전제를 반영했을 수 있어 확정된 양산 사양의 전후 비교로 단정해서는 안 됩니다.
1
4
5
메모리 부족은 왜 설계 변경으로 이어질까
트렌드포스는 2027년에도 이어질 것으로 예상되는 DRAM 공급 부족과 12단 HBM4E의 인증·검증 불확실성을 공급 측 제약으로 꼽았습니다. 최신 메모리를 충분히 확보하기 어렵다면 적층 수를 낮추거나 이전 세대 메모리를 검토하는 것이 공급 선택지를 넓히는 방법이 될 수 있습니다.
2
GPU 한 개에 필요한 HBM이 줄면 해당 가속기의 메모리 부품 부담은 낮아질 수 있습니다. 그러나 현재 보도만으로는 최종 칩 가격이나 고객 가격이 인하될지, 엔비디아가 실제로 더 많은 GPU를 출하할 수 있을지 알 수 없습니다. 공급 유연성이 커질 가능성과 전체 시스템·클라우드 비용이 내려가는지는 별개의 문제입니다.
4
6
13
대규모 AI 모델에는 어떤 의미가 있나
GPU 메모리 용량은 모델 데이터와 작업 중간 상태를 한 장치 안에 얼마나 담을 수 있는지에 영향을 줍니다. GPU당 HBM이 줄면 메모리를 많이 쓰는 일부 작업은 여러 가속기에 나눠 실행하거나 배치 방식을 바꿔야 할 수 있습니다. 더 많은 GPU를 투입해야 한다면 메모리 용량 감소로 얻는 공급상 이점이 일부 상쇄될 수도 있습니다.
5
6
이는 보도된 용량을 바탕으로 예상할 수 있는 영향이지, 최종 루빈 울트라 제품의 성능을 측정한 결과는 아닙니다. 현재 자료만으로는 특정 모델이나 작업에서 실제 성능이 어떻게 달라질지 판단하기 어렵습니다.
소비자용 그래픽카드 출시 지연설과는 별개
별도의 보도에서는 루빈 아키텍처 기반 RTX 60 시리즈 게이밍 그래픽카드가 당초 예상된 2027년 말이 아니라 2028년에 나올 수 있다는 관측이 나왔습니다. 이는 하드웨어 유출 정보에 근거한 보도이며, 엔비디아는 미확인 제품이나 소문에 대해 언급하지 않는다고 밝혔습니다. 이 내용만으로 루빈 울트라의 HBM 설계 검토가 소비자용 GPU 출시 지연을 일으켰다고 볼 근거는 없습니다.
18