반도체: NVIDIA, Rubin Ultra 및 멀티랙 확장 추진; Kyber 상용화는 지연될 수 있어
Vera Rubin Strata는 7월 말 생산에 돌입했지만, Rubin Ultra의 칩, HBM 및 랙 솔루션은 계속 개발 중이다. NVIDIA는 급증하는 컴퓨팅 수요를 충족하기 위해 2027년 하반기에 여러 Oberon 랙을 우선 활용할 수 있다.
요약
Vera Rubin Strata는 7월 말 생산에 돌입했지만, Rubin Ultra의 칩, HBM 및 랙 솔루션은 계속 개발 중이다. NVIDIA는 급증하는 컴퓨팅 수요를 충족하기 위해 2027년 하반기에 여러 Oberon 랙을 우선 활용할 수 있다.
- Vera Rubin Strata는 짧은 지연 후 7월 말 상업 생산에 돌입했으며, 향상된 Vera CPU와 Rubin GPU는 2026년 4분기 말까지 출시될 것으로 예상된다.
- 듀얼 칩렛 및 쿼드 칩렛 Rubin Ultra 구성은 병행 개발되고 있다. 듀얼 칩렛 버전은 기존 Oberon NVL72에 적합할 수 있으며, 쿼드 칩렛 버전은 Kyber 시스템을 목표로 한다.
- 여러 Oberon 랙은 구리 또는 광 인터커넥트를 통해 144개, 288개 또는 576개 GPU까지 확장할 수 있으며, 리서치팀은 이르면 2027년 하반기에 프로토타입 하드웨어가 도착할 것으로 예상한다.
- Rubin Ultra용 HBM 선택은 아직 결정되지 않았다. 학습은 대역폭을 더 중시하는 반면, 롱컨텍스트 에이전트 추론은 메모리 용량과 고속 외부 KV 캐시에 더 의존한다.
- 듀얼 GPU Rubin Ultra Strata의 BOM은 2026년 하반기 Rubin Strata 대비 약 30% 증가할 것으로 예상된다. 매출총이익률이 75%~80%로 유지될 경우 ASP는 $170,000을 초과할 수 있다.
보고서 해설
개요
이 보고서는 NVIDIA Vera Rubin 및 Rubin Ultra 플랫폼의 칩 및 랙 수준 개발 진척도를 업데이트한다. 핵심 견해는 Vera Rubin이 생산에 돌입해 성능 최적화를 계속하고 있는 반면, Rubin Ultra의 설계와 시스템 아키텍처는 아직 확정되지 않았다는 것이다. Kyber의 높은 복잡성을 고려할 때 NVIDIA는 제품 진화 공백을 메우기 위해 먼저 멀티 Oberon 랙 솔루션을 사용할 수 있다.
핵심 견해
Vera Rubin의 경우, 리서치팀은 NVIDIA가 테이프아웃 반복을 통해 Vera CPU와 Rubin GPU를 계속 최적화하여 약 2,300W의 피크 TDP와 GB300의 약 3.3배인 50PF의 공시 FP4 추론 성능을 목표로 할 것으로 예상한다. 표준 1,800W SKU의 FP4 성능은 40PF를 넘지 않을 수 있다. Rubin Ultra의 경우 듀얼 GPU 버전은 Oberon NVL72 폼팩터를 유지할 수 있으며, 쿼드 GPU 버전은 Kyber에 해당한다. 쿼드 칩렛 SKU는 취소되지 않았으나 상용화는 더 느릴 수 있다. 멀티랙 시스템은 통합 GPU 풀을 최대 576개 GPU까지 확장할 수 있으며, 네트워킹 및 스토리지 랙과 함께 토큰당 대역폭, 컴퓨팅 성능 및 비용 경쟁력을 개선할 수 있다.
분석 프레임워크
보고서는 업계 조사, 제품 로드맵 추론, 공개 시연 사례 및 BOM 추정치를 바탕으로 칩 토폴로지, HBM 사양, 랙 인터커넥트, 시스템 대역폭 및 가격에 대한 시나리오 분석을 수행한다.
방법론 메모
Vera CPU, Rubin GPU, HBM, 패키징 및 랙 시스템을 계층별로 평가한다.
듀얼 칩렛, 쿼드 칩렛, Oberon, Kyber 및 멀티랙 솔루션을 비교하여 성능 업그레이드 경로와 상용화 시점을 평가한다.
부품 비용, 메모리 비중 및 목표 매출총이익률로부터 모듈 판매가격을 도출한다.
리서치팀은 Rubin Ultra Strata의 비용 증가가 주로 HBM, SoCAAM, 로직 디바이스 및 패키징 관련 부품에서 비롯될 것으로 예상하며, 이를 통해 잠재 ASP를 도출한다.
학습 워크로드는 메모리 대역폭을 중시하는 반면, 롱컨텍스트 에이전트 추론은 용량과 KV 캐시 스토리지를 중시한다.
보고서는 HBM 대역폭을 단순히 높이는 것만으로는 메모리 용량 부족을 해결할 수 없으며, CMX/eSSD 스토리지 아키텍처가 롱컨텍스트 추론을 보완할 수 있다고 주장한다.
자산 매핑 및 비교
투자 논리에서 명시된 자산으로의 구조화 매핑(강점, 약점, 비교 대상, 위험).
- NVDA.US핵심 커버리지 종목 및 플랫폼 공급업체
- 강점
- Vera Rubin은 이미 양산 중이며 CPU/GPU 성능은 지속적으로 최적화되고 있다. 회사는 칩, 패키징, 네트워킹 및 스토리지 랙을 아우르는 시스템 수준 제품 역량을 보유하고 있으며, 멀티랙 아키텍처는 총 대역폭과 유연성을 개선할 수 있다.
- 약점
- 듀얼 GPU Rubin Ultra 성능은 아직 공개되지 않았고, HBM 용량 및 사양도 확정되지 않았으며, 고급 시스템의 비용과 전력 소비는 계속 증가하고 있다.
- 비교
- 단일 NVL72 랙과 비교하면 멀티랙 시스템은 더 높은 총 대역폭을 제공할 수 있다. 복잡한 Kyber와 비교하면 기존 Oberon 기반 확장 솔루션이 더 빠르게 배치될 수 있다.
- 위험
- 테이프아웃 및 시스템 통합 지연, Kyber 상용화 연기, HBM 공급 및 비용 압박, 약 30% 가격 인상에 대한 불확실한 고객 수용성, 그리고 고객의 자체 ASIC 개발 가속이다.
핵심 데이터
- Vera Rubin Strata 양산 시점2026년 7월 말보고서는 짧은 지연 후 상업 생산에 돌입했다고 밝힌다.
- 향상된 Vera Rubin 피크 TDP약 2,300W향상된 CPU와 GPU 조합에 대해 리서치팀이 예상하는 목표 수준이다.
- Vera Rubin FP4 추론 성능50PF이는 회사가 제시한 목표치이며, 보고서는 GB300의 약 3.3배라고 설명한다.
- 예상 Rubin Ultra 테이프아웃2026년 4분기GPU 칩렛 테이프아웃에 대한 보고서의 예상이며, 구체적인 시점은 불확실하다.
- Rubin Ultra 피크 TDP약 2,600W리서치팀이 추정한 Vera Rubin Ultra 듀얼 GPU 구성에 적용된다.
- Rubin Ultra 쿼드 칩렛 성능 목표100PF FP4NVIDIA는 GTC 2026에서 1T HBM4E와 결합한 쿼드 GPU 버전을 언급했으며, 듀얼 GPU 성능은 공개하지 않았다.
- 멀티랙 GPU 규모144~576개 GPU2랙, 4랙 또는 8랙 구성으로 확장할 수 있다.
- 잠재적 멀티랙 배치 시점2027년 하반기Rubin Ultra와 결합한 프로토타입 하드웨어에 관한 업계 조사 추론을 바탕으로 한다.
- 스택당 HBM4E 대역폭최대 약 4.1TBps16Gbps 속도와 2,048비트 버스 폭을 적용한 사례에 근거한다.
- 12개 HBM4E 스택의 총 대역폭약 49.2TBps보고서는 이것이 8개 HBM 모듈 대비 50% 높다고 추정한다.
- Rubin Ultra Strata 비용 변화약 +30%2026년 하반기 Rubin Strata 전망치 대비이다.
- 잠재적 Rubin Ultra Strata ASP$170,000 초과NVIDIA가 75%~80%의 매출총이익률을 유지한다고 가정한다.
영향과 시사점
NVIDIA에 멀티랙 확장은 Kyber가 진전되는 동안 컴퓨팅 공급과 시스템 수준 차별화를 유지하고, 고대역폭 인터커넥트 및 CMX 스토리지를 통해 다양한 AI 워크로드를 지원할 수 있다. 클라우드 서비스 제공업체와 하이퍼스케일 고객에게는 개선된 시스템 성능이 토큰당 비용을 낮출 수 있지만, 총 자본지출도 2027~2028년에 추가로 증가하여 외부 자금조달 수요를 유발하거나 자체 ASIC 개발을 가속할 가능성이 있다.
위험
- Rubin Ultra 칩과 랙 아키텍처는 아직 개발 중이며, 테이프아웃, 검증 및 양산 일정이 지연될 수 있다.
- Kyber의 쿼드 칩렛 GPU 및 랙 시스템 설계는 복잡하며, 상용화가 멀티 Oberon 솔루션보다 더 느리게 진행될 수 있다.
- HBM4E 용량, 속도 및 대역폭 구성은 확정되지 않았으며, 낮은 용량은 롱컨텍스트 에이전트 추론을 제약할 수 있다.
- HBM, SoCAAM, 패키징 및 기타 부품의 가격 상승은 BOM 비용을 높이고 가격 책정 유연성을 낮출 수 있다.
- 듀얼 GPU Rubin Ultra의 성능 향상이 충분하지 않으면 고객은 약 30%의 잠재적 가격 인상을 수용하지 않을 수 있다.
- 멀티랙 시스템은 고객의 자본지출을 늘리며, 하이퍼스케일 고객이 상용 GPU 의존도를 낮추기 위해 자체 ASIC 개발을 가속하도록 유도할 수 있다.
주시할 점
- 2026년 4분기 향상된 Vera CPU 및 Rubin GPU의 테이프아웃, 성능 및 공급 진척도.
- 듀얼 칩렛 및 쿼드 칩렛 Rubin Ultra SKU의 공식 사양, FP4 성능 및 HBM4E 구성.
- Kyber 랙의 제품 확정 및 상용화 시점과 2027년 하반기 멀티 Oberon/Polyphe 시스템 배치.
- CMX 및 BlueField 4 STX 스토리지 랙의 배치 진척도와 eSSD 공급업체 인증 결과.
- HBM, SoCAAM 및 패키징 비용 변화와 Rubin Ultra 가격 및 고객 조달 피드백.
- 클라우드 서비스 제공업체와 하이퍼스케일 고객의 자본지출, 자금조달 활동 및 자체 ASIC 전략.