top of page

NVIDIA 루빈(Rubin) 탑재 GPU 서버 가격 및 구매 가이드

NVIDIA가 직접 설계 및 제조한 루빈 x 72장이 탑재된 랙 시스템 DGX Vera Rubin NVL72, 루빈 x 8장이 탑재된 DGX Rubin NVL8을 포함하여 벤더 제조 HGX Rubin x 8 GPU 서버의 사양, 가격 및 구매 가이드를 제공합니다.

에이전틱 AI와 대규모 추론을 위한, NVIDIA Rubin GPU

NVIDIA 루빈(Rubin)은,

 

2026년 1월 5일, 라스베이거스에서 열린 2026 CES 키노트에서 젠슨 황 CEO가 아키텍처를 최초 공개했습니다.

업계 최초 고대역폭 HBM4 메모리 탑재로 GPU 1장 당 288GB의 메모리 용량을 제공하며, 대역폭은 22TB/s 입니다.

NVLink 6세대 기반으로 GPU 간 양방향 대역폭은 3.6TB/s를 지원합니다.

차세대 데이터 타입, NVFP4를 지원하며, 연산 성능은 35 PFLOPS, FP8은 17.5 PFLOPS 입니다.

​1장 당 전력 소모량은 2,300W이며, 냉각 방식은 수냉입니다.

퀀텀브릭스는 합리적인 가격으로 GPU 서버를 공급합니다.

Rubin GPU 8장이 탑재된 HGX Rubin 메인 보드 전면 이미지

#이미지: 루빈(Rubin) x 8장이 탑재된 NVIDIA HGX Rubin x 8 GPU 보드

루빈(Rubin) 탑재 GPU 서버 가격

엔비디아 Rubin(루빈) 탑재수량별 GPU 서버 및 랙 시스템의 가격 정보를 제공합니다.

(단위: 원 / 부가세 별도)

구분

​탑재수량

가격

​제조사

8

15억

벤더

8

15억

엔비디아

72

150억

엔비디아

참고사항 : 본 가격은 대략적인 평균 가격으로, 실제 견적 및 계약 시, 더 낮을 수도, 더 높을 수도 있습니다. 항목 클릭 시, 사양 및 가격 섹션으로 이동합니다.

Q1. 루빈(Rubin)은 언제 출시됐나요?

2025년 3월 쯤 최초 로드맵 발표, 2026년 1월 5일 라스 베이거스에서 열린 2026 CES 키노트에서 NVIDIA 젠슨 황 CEO가 루빈(Rubin) 아키텍처를 상세하게 공개했고, 2026년 하반기부터 본격적으로 공급을 시작했습니다.

2026년 1월 5일 CES 키노트 NVIDIA CEO 젠슨 황, 최초 루빈 아키텍처 발표
  • YouTube

CES 2026 | NVIDIA CEO 젠슨 황 키노트 동영상 보기

2026년 1월 5일, 2026 CES 키노트에서 NVIDIA CEO 젠슨 황, 최초 루빈(Rubin) 아키텍처 발표 / 이미지 출처: 엔비디아 블로그

Q2. 루빈(Rubin) 가격은 얼마인가요?

루빈(Rubin)이 탑재된 GPU 서버 가격은,

 

이전 세대인 H200 141GB, B200 180GB, B300 288GB 등과 달리, GPU 서버 및 인프라 구축 시, 수냉 전용 랙, CDU(Coolant Distribution Unit, 냉각수 분배 장치), In-Row Cooler 등 필수 부대 장비 등을 같이 구매하여 AI 인프라를 구축해야 하므로, 차원이 달라졌습니다.

따라서, 루빈(Rubin) x 8장이 탑재된 GPU 서버 1대 가격은, 수 천만원에서 수 억원까지, Rubin 72장이 탑재된 DGX Vera Rubin NVL72의 경우, 수 십억 또는 수백 억원까지 차이가 발생할 수 있습니다.

상기 가격표의 공급 가격은 선택 또는 필수 부대 장비를 제외한 순수하게 GPU 서버 1대의 평균적인 단가이며, GPU 연산 랙 1대의 경우, 대략적인 단가입니다.

탑재수량별 GPU 서버 가격표

실시간 문의하기 | 48시간 내 견적서 제공

Q3. 루빈(Rubin), 단품으로 구매할 수 있나요?

아니오!

루빈(Rubin)은, H200 141GB, H100 94GB, A100 80G 등 이전 버전과 달리, 단품으로 판매 및 공급되지 않습니다.

기본적으로 8장이 탑재되며, NVIDIA 직접 제조 DGX Rubin NVL8 구매 또는, HPE, Dell 등 벤더가 제조한 HGX Rubin x 8 GPU 서버 제품을 구매할 수 있습니다.

 

Q4. DGX Rubin NVL8 가격은 얼마인가요?

상기 가격표 또는 하기 링크, DGX Rubin NVL8 사양 및 가격을 참고 바랍니다.

DGX Rubin NVL8 사양 및 가격
 

루빈 탑재 GPU 서버는, B300 288GB, B200 180GB, H200 141GB 등 이전 세대와 달리, GPU 서버 뿐만 아니라, 수냉 인프라를 위한 부대 장비들도 구매해야 하므로, 수 천만원에서 수 억원까지 차이가 발생합니다.

DGX Rubin NVL8은 엔비디아가 직접 설계하고 제조한 완제품 GPU 서버로, Rubin x 8장 탑재, 운영체제, CPU, 시스템 메모리, 스토리지 등 모든 부품이 최적화 되어 공급됩니다.

NVIDIA 스타트업 프로그램에 가입하면, DGX Rubin NVL8, DGX B200, DGX B300 등 DGX 시리즈 구매 시, 최대 30%까지 할인을 받을 수 있습니다. 

Q5. DGX Rubin NVL8 과 벤더 제조 HGX Rubin x 8 GPU 서버, 가격 차이가 있나요?

네!

서로 가격 차이도 있고 같은 타입(DGX, HGX)의 제품이라도 제조사에 따라 가격 차이가 있습니다.

다양한 환경과 요인에 따라, DGX Rubin NVL8 가격이 더 높을 수도 있고, HGX Rubin x 8GPU 서버 가격이 더 높을 수도 또는 낮을 수도 있습니다.

다만, DGX Rubin NVL8은 사양 및 스펙이 확정되어 있어 가격의 인상 및 인하폭이 좁지만, HGX Rubin x 8 GPU 서버는 운영체제, CPU, 시스템 메모리, 스토리지 등 사양 및 용량에 따라 가격 차이가 매우 큽니다.

Q6. DGX Vera Rubin NVL72의 구성요소와 장비는 무엇이고, 가격은 얼마인가요?

DGX Vera Rubin NVL72 랙 1대에는, 기능과 역할이 다른 4개의 장비가 탑재됩니다.

1. Compute Tray x 18개 : 총 Rubin GPU x 72장 및 Vera CPU x 36장이 18개 컴퓨트 트레이에 탑재됩니다. 각 컴퓨트 트레이 당 Vera Rubin 슈퍼칩 2장 탑재, 슈퍼칩 1장 당 Rubin GPU 2장 및 Vera CPU 1장이 탑재됩니다.

2. NVLink Switch(6세대) x 9개 : Rubin GPU 72장(슈퍼칩 36장)을 하나로 묶어주는 스위치로, 마치 단 1장의 GPU처럼 사용할 수 있습니다.

3. Top of the Rack Switches x N개 : 랙 전체를 관리 및 모니터링을 위한 스위치로, NVIDIA GB300 NVL72 처럼 2개 탑재가 예상되나, 2026년 8월 기준, 공식 문서로 아직 발표되지 않았습니다.

4. Power Shelves x 4개 : 전원 공급 장비로, GB300 NVL72는 총 8개 였으나, Vera Rubin NVL72는 4개 입니다.

Vera Rubin NVL72의 사양 및 가격은 아래를 참고 바랍니다.

Vera Rubin NVL72 사양 및 가격

Q7. DGX Vera Rubin NVL72로 AI 인프라(팩토리) 구축하려면 비용이 얼마나 소요되나요?

​Vera Rubin NVL72를 포함하여, 용도가 다른 5개의 랙을, AI 인프라 요구 사항 및 워크 로드 성격 등에 따라 필수 또는 선택할 수 있으며, 메인 GPU 연산 랙 및 추가로 구축할 랙 대수에 따라, 구축 비용은 수 십억원 또는 수 백억원까지 달라집니다.

NVIDIA Rubin 기반 5가지 랙 제품:

1. Vera Rubin NVL72 GPU 랙 : 루빈 GPU x 72장, Vera CPU 36장 탑재, 학습과 추론 같은 핵심 작업을 담당하는 메인 엔진 랙.

2. Vera CPU 랙 : Vera CPU x 256개 탑재, GPU가 만든 결과를 실제로 실행 및 시뮬레이션해서 맞는지 검증하는 CPU 전용 랙.

3. NVIDIA Groq 3 LPX inference accelerator 랙 : 학습이 끝난 AI 모델이 사용자에게 답을 내놓을 때, 그 응답 속도를 극대화하는 추론 전용 랙.

4. NVIDIA BlueField-4 STX storage 랙 : 맥락과 중간 계산 결과(KV 캐시)를 따로 저장, 처음부터 다시 계산하지 않고 빠르게 이어갈 수 있게 해주는 AI 네이티브 스토리지 랙.

5. NVIDIA Spectrum-6 SPX Ethernet 랙 : 여러 랙들을 하나의 네트워크로 묶어서, 한 대의 시스템처럼 서로 데이터를 주고받을 수 있게 해주는 네트워크 랙.

 

더 자세한 사항은 실시간 문의하기를 참고 바랍니다.

DGX Vera Rubin NVL72 사양 및 가격

Vera Rubin NVL72 GPU 랙

Vera Rubin NVL72 GPU 랙

학습, 추론 등 Rubin x 72장 탑재 메인 GPU 연산 랙

Vera CPU 랙 : Vera CPU x 256개 탑재

Vera CPU 랙

GPU 결과물, 실행 검증 시뮬레이션을 위한 CPU 랙

Groq 3 LPX inference accelerator 랙

Groq 3 LPX inference 랙

응답 속도를 극대화, 추론을 가속화하는 랙

NVIDIA BlueField-4 STX storage 랙

BlueField-4 STX storage 랙

GPU 메모리를 원활하게 확장하는 AI 네이티브 스토리지 랙

NVIDIA Spectrum-6 SPX Ethernet 랙

Spectrum-6 SPX 랙

여러 랙들을 하나로 클러스터링 하는 랙

Q8. DGX Vera Rubin NVL72를 구성하는 핵심 칩은 무엇인가요?

 7가지의 핵심 칩들이, DGX Vera Rubin NVL72 연산 랙 포함, 총 5개의 랙에 분산 탑재됩니다.

NVIDIA Rubin GPU,

NVIDIA Vera CPU,

NVIDIA NVLink 6 스위치,

NVIDIA ConnectX-9 SuperNIC,

NVIDIA BlueField-4 DPU,

NVIDIA Spectrum-6 이더넷 스위치,

NVIDIA Groq 3 LPU.

NVIDIA Rubin GPU

NVIDIA Rubin GPU

HBM4와 50 PF NVFP4 트랜스포머 엔진을 탑재한 Rubin GPU

NVIDIA Spectrum-X 이더넷

NVIDIA Spectrum-X 이더넷

랙과 랙, 데이터센터와 데이터센터를 연결하는 스위치/칩

NVIDIA Vera CPU

NVIDIA Vera CPU

데이터 이동과 에이전틱 추론을 위해 특별히 제작된 CPU

NVIDIA Groq 3 LPU

NVIDIA Groq 3 LPU

초저지연 실시간 추론에 특화된 별도 전문 가속기 칩

NVIDIA NVLink 6 Switch

NVIDIA NVLink 6 Switch

GPU를 하나의 거대한 가속기처럼 묶어주는 스위치

NVIDIA ConnectX-9 SuperNIC

NVIDIA ConnectX-9 SuperNIC

랙을 넘어 바깥 네트워크로 데이터를 내보내는 출입구

NVIDIA BlueField-4 DPU

NVIDIA BlueField-4 DPU

네트워킹, 스토리지 등 잡무를 전담, GPU 부담을 덜어주는 칩

Q9. 견적 요청은 어떻게 하나요?

퀀텀브릭스 탑재수량별 GPU 서버 가격표를 참고하면, 빠르게 가격에 대한 '감' 을 잡을 수 있습니다.

또는, 실시간 문의하기에 메세지를 남겨주시면, 빠르게 답을 드립니다.

퀀텀브릭스는 합리적인 가격으로 GPU 서버를 공급, 고객사 / 파트너의 AI 비지니스를 지원합니다.

 

​​​최단 24시간, 최대 48시간 내 견적서를 보내드립니다.

루빈(Rubin) 탑재 GPU 서버 구매 가이드 및 Tip

가이드 #01. 루빈 GPU x 1장, 2장 또는 4장만 탑재해서 구매할 수 있습니까?

아니오!

엔비디아 Rubin GPU 단품 가격은 대략 7,000 ~ 8,000만원(부가세 별도) 정도로 추산됩니다.

 

단, 루빈 GPU는 단품으로 판매 및 공급되지 않으며 기본적으로 8장이 탑재됩니다.

H200을 포함, A100, H100, RTX 6000 등은 단품으로 판매 및 공급이 가능하며, 최초 구매 시, 원하는 수량을 탑재할 수 있습니다.

단품으로 구매 가능한 GPU 타입은 NVL(PCIe), 불가능한 타입은 HGX(SXM) GPU 입니다.

단품구매 가능여부 비교표

가이드 #02. 루빈(Rubin) 탑재 GPU 서버, 공냉인가요? 수냉인가요?

DGX Rubin NVL8 및 벤더 제조 HGX Rubin x 8 GPU 서버, 2가지 타입 모두 수냉입니다.

루빈 GPU 1장 당 전력 소모량은 2,300W이며, 8장이 탑재된 DGX Rubin NVL8의 최대 전력 소모량은 24kW입니다.

막대한 전력 소모량, 발열 등으로 인하여 냉각 방식은 수냉이 인프라 구축의 필수 요건이 됩니다.

젼력 소모량에 대한 더 자세한 내용은 하기 페이지를 참고 바랍니다.

GPU 제품별 전력소모량 비교표

가이드 #03. DGX 와 HGX 8GPU 서버, 어떤 것을 선택해야 하나요?

2가지 옵션 중, 하나를 선택할 수 있습니다.

첫번째 옵션,

엔비디아가 직접 설계 및 제조한 루빈 x 8장이 탑재된 DGX Rubin NVL8을 선택하는 것으로, 스펙이 확정되어서 공급되므로, 가격 편차가 크지 않습니다.

두번째, 옵션,

HPE, Dell 등 벤더가 제조한 HGX Rubin x 8 GPU 서버를 선택하는 것입니다. 각 제조사 및 사양에 따라, 가격의 차이가 매우 크게 발생합니다.

HGX Rubin x 8 GPU 서버 사양 및 가격

루빈(Rubin) 및 B300 성능 비교표 : 루빈(Rubin) 성능, B300 대비 얼마나 더 좋아졌나요?

B300과 루빈(Rubin) GPU 1장 당 메모리 용량, 대역폭, 연산 성능 등 비교표로, 얼마나 더 성능이 더 좋아졌는지 지금 바로 확인할 수 있습니다.

구분

B300

루빈(Rubin)

최초 공개

2026년 1월

2025년 3월

메모리 용량

288GB

288GB

메모리 타입

HBM3e

HBM4

메모리 대역폭

8TB/s

22TB/s

NVLink 대역폭

1.8TB/s

3.6TB/s

FP8 연산 성능

9 PFOLPS

17.5 PFLOPS

FP4 연산 성능

18 PFOLPS

35 PFOLPS

추론 성능(30B/FP8)

260TPS

730TPS

전력소모랑

1,400W

2,300W

냉각 방식

​공냉

수냉

* 연산 성능 수치는 Dense(밀집) 기준입니다.

메모리 용량: Rubin의 메모리 용량은 B300의 288GB와 동일합니다. 단, B300의 메모리 타입은  HBM3e, 루빈은 차세대 HBM4 입니다.

메모리 대역폭: B300의 8TB/s 대비, Rubin의 메모리 대역폭은 최대 22TB/s로 대략 3배 이상 넓어져, 데이터 처리 및 추론 속도가 더 빨라졌습니다..

연산 성능: FP4 기준 B300의 18 PFLOPS 대비, Rubin은 연산 성능은 35 PFLOPS로 약 3배 증가했으며, FP8 역시 9 PFLOPS에서 17.5 PFLOPS로 약 2배 강력해졌습니다.

추론 성능: FP8 및 30B 모델 기준으로, 루빈은 약 700tps, B300은 대략 260tps 이며, 대략 3배 정도 빠릅니다.

NVLink 대역폭: NVLink 5세대 1.8TB/s에서 6세대로 업그레이드 되면서 루빈은 2배 더 넓어진 3.6TB/s를 제공하여, GPU 간 데이터 처리 속도가 더 빠릅니다.

전력 소모량 및 냉각 방식: B300 1장 당 1,400W로 공냉이며, Rubin의 전력 소모량은 2,300W이고 수냉 전용입니다.

루빈 x 72장 탑재, DGX Vera Rubin NVL72 사양 및 가격

DGX Vera Rubin NVL72는,

 

72개의 Rubin GPU가 탑재된 AI 랙 시스템입니다.

72개의 Rubin GPU 및 36개의 Vera CPU 탑재, 총 GPU 메모리는 최대 20.7TB, GPU 대역폭은 1,580TB/s, NVLink 대역폭은 260TB/s입니다.

CPU는 3,168개 코어가 탑재됐고, NVFP4 학습 성능은 2,520 PFLOPS, NVFP4 추론 성능은 3,600 PFLOPS 를 지원합니다.

​단순히 계산하면, 루빈 x 8장 탑재 GPU 서버 9대가 하나로 묶여있는 거대한 랙 시스템입니다.

DGX Vera Rubin NVL72는 AI 데이터 센터 구축 기간을 획기적으로 단축하고 공간 점유율을 최소화 할 수 있는 최적의 인프라 시스템입니다.

퀀텀브릭스는 합리적인 가격으로 GPU 서버를 공급합니다.

엔비디아 루빈 72장, Vera CPU 36장이 탑재된 NVIDIA Vera Rubin NVL72 랙 시스템

#이미지: 엔비디아 루빈 72장, Vera CPU 36장이 탑재된 NVIDIA DGX Vera Rubin NVL72 랙 시스템

DGX GB300 NVL72(B300 x 72장 탑재)와 DGX GB200 NVL72(B200 x 72장 탑재)의 사양 및 가격을 알아볼까요?

B300 x 72장이 탑재된 DGX GB300 NVL72 및 B200 x 72장이 탑재된 DGX B200 NVL72의 사양 및 가격, 지금 바로 확인할 수 있습니다.

B200 x 72장 및 Grace CPU 36장이 탑재된 랙 시스템 NVIDIA DGX GB200 NVL72

B200 x 72장 | NVIDIA 직접 제조

DGX B200 NVL72

NVIDIA DGX GB200 NVL72는 ​B200 GPU 72장이 탑재된 랙 시스템입니다.

B300 x 72장 및 Grace CPU 36장이 탑재된 랙 시스템 NVIDIA DGX GB300 NVL72

B300 x 72장 | NVIDIA 직접 제조

DGX B300 NVL72

NVIDIA DGX GB300 NVL72는 ​​B300 GPU 72장이 탑재된 랙 시스템입니다.

루빈 x 8장 탑재, DGX Rubin NVL8 사양 및 가격

DGX Rubin NVL8은,

 

NVIDIA가 설계 및 제조한 AI 전용 완제품 GPU 서버입니다.

Rubin GPU 8장 탑재 및 2.3TB GPU 메모리, 총 288코어의 인텔 듀얼 CPU와 2TB의 시스템 메모리가 탑재됩니다.

160TB/s 속도의 GPU 메모리 대역폭 및 28.8TB/s의 NVLink 대역폭을 지원합니다.

NVFP4 추론 성능은 400PFLOPS, NVFP4 학습 성능은 280PFLOPS 입니다.

AI 프로젝트에 필요한 모든 소프트웨어와 하드웨어를 탑재, 검증 및 테스트, 최적화를 거쳐 공급되므로, 즉시, AI R&D와 프로젝트에 투입됩니다.

퀀텀브릭스는 합리적인 가격으로 GPU 서버를 공급합니다.

NVIDIA Rubin GPU x 8장이 탑재된 DGX Rubin NVL8 전면 이미지

#이미지: NVIDIA Rubin GPU x 8장이 탑재된 엔비디아가 직접 설계 및 제조한 완제품 GPU 서버, DGX Rubin NVL8

​자주 묻는 질문(FAQs)

루빈 탑재 GPU 서버에 대해 질문이 더 있으세요?

실시간 문의하기 페이지에 질문, 메세지를 남겨주시면 빠르게 답변 드립니다.

대략적인 가격은 탑재수량별 GPU 서버 가격 페이지를 참고 바랍니다.

퀀텀브릭스는 고객사 및 파트너의 AI 비지니스를 지원합니다.

오늘 또는 내일, GPU 서버 견적서가 필요하세요?

최단 24시간, 최대 48시간 이내 (영업일 기준) 견적서를 보내 드립니다.

NVIDIA 직접 제조 DGX 시리즈부터, HPE, Dell 등 벤더 제조 HGX GPU 서버까지, 모든 타입의 GPU 서버를 공급합니다.

퀀텀브릭스는 합리적인 가격으로 GPU 서버를 공급합니다.

bottom of page