에이전틱 AI와 대규모 추론을 위한, NVIDIA Rubin GPU
NVIDIA 루빈(Rubin)은,
2026년 1월 5일, 라스베이거스에서 열린 2026 CES 키노트에서 젠슨 황 CEO가 아키텍처를 최초 공개했습니다.
업계 최초 고대역폭 HBM4 메모리 탑재로 GPU 1장 당 288GB의 메모리 용량을 제공하며, 대역폭은 22TB/s 입니다.
NVLink 6세대 기반으로 GPU 간 양방향 대역폭은 3.6TB/s를 지원합니다.
차세대 데이터 타입, NVFP4를 지원하며, 연산 성능은 35 PFLOPS, FP8은 17.5 PFLOPS 입니다.
1장 당 전력 소모량은 2,300W이며, 냉각 방식은 수냉입니다.
퀀텀브릭스는 합리적인 가격으로 GPU 서버를 공급합니다.

#이미지: 루빈(Rubin) x 8장이 탑재된 NVIDIA HGX Rubin x 8 GPU 보드
루빈(Rubin) 탑재 GPU 서버 가격
엔비디아 Rubin(루빈) 탑재수량별 GPU 서버 및 랙 시스템의 가격 정보를 제공합니다.
(단위: 원 / 부가세 별도)
참고사항 : 본 가격은 대략적인 평균 가격으로, 실제 견적 및 계약 시, 더 낮을 수도, 더 높을 수도 있습니다. 항목 클릭 시, 사양 및 가격 섹션으로 이동합니다.
Q1. 루빈(Rubin)은 언제 출시됐나요?
2025년 3월 쯤 최초 로드맵 발표, 2026년 1월 5일 라스 베이거스에서 열린 2026 CES 키노트에서 NVIDIA 젠슨 황 CEO가 루빈(Rubin) 아키텍처를 상세하게 공개했고, 2026년 하반기부터 본격적으로 공급을 시작했습니다.

CES 2026 | NVIDIA CEO 젠슨 황 키노트 동영상 보기
2026년 1월 5일, 2026 CES 키노트에서 NVIDIA CEO 젠슨 황, 최초 루빈(Rubin) 아키텍처 발표 / 이미지 출처: 엔비디아 블로그
Q2. 루빈(Rubin) 가격은 얼마인가요?
루빈(Rubin)이 탑재된 GPU 서버 가격은,
이전 세대인 H200 141GB, B200 180GB, B300 288GB 등과 달리, GPU 서버 및 인프라 구축 시, 수냉 전용 랙, CDU(Coolant Distribution Unit, 냉각수 분배 장치), In-Row Cooler 등 필수 부대 장비 등을 같이 구매하여 AI 인프라를 구축해야 하므로, 차원이 달라졌습니다.
따라서, 루빈(Rubin) x 8장이 탑재된 GPU 서버 1대 가격은, 수 천만원에서 수 억원까지, Rubin 72장이 탑재된 DGX Vera Rubin NVL72의 경우, 수 십억 또는 수백 억원까지 차이가 발생할 수 있습니다.
상기 가격표의 공급 가격은 선택 또는 필수 부대 장비를 제외한 순수하게 GPU 서버 1대의 평균적인 단가이며, GPU 연산 랙 1대의 경우, 대략적인 단가입니다.
Q3. 루빈(Rubin), 단품으로 구매할 수 있나요?
아니오!
루빈(Rubin)은, H200 141GB, H100 94GB, A100 80G 등 이전 버전과 달리, 단품으로 판매 및 공급되지 않습니다.
기본적으로 8장이 탑재되며, NVIDIA 직접 제조 DGX Rubin NVL8 구매 또는, HPE, Dell 등 벤더가 제조한 HGX Rubin x 8 GPU 서버 제품을 구매할 수 있습니다.
Q4. DGX Rubin NVL8 가격은 얼마인가요?
상기 가격표 또는 하기 링크, DGX Rubin NVL8 사양 및 가격을 참고 바랍니다.
루빈 탑재 GPU 서버는, B300 288GB, B200 180GB, H200 141GB 등 이전 세대와 달리, GPU 서버 뿐만 아니라, 수냉 인프라를 위한 부대 장비들도 구매해야 하므로, 수 천만원에서 수 억원까지 차이가 발생합니다.
DGX Rubin NVL8은 엔비디아가 직접 설계하고 제조한 완제품 GPU 서버로, Rubin x 8장 탑재, 운영체제, CPU, 시스템 메모리, 스토리지 등 모든 부품이 최적화 되어 공급됩니다.
NVIDIA 스타트업 프로그램에 가입하면, DGX Rubin NVL8, DGX B200, DGX B300 등 DGX 시리즈 구매 시, 최대 30%까지 할인을 받을 수 있습니다.
Q5. DGX Rubin NVL8 과 벤더 제조 HGX Rubin x 8 GPU 서버, 가격 차이가 있나요?
네!
서로 가격 차이도 있고 같은 타입(DGX, HGX)의 제품이라도 제조사에 따라 가격 차이가 있습니다.
다양한 환경과 요인에 따라, DGX Rubin NVL8 가격이 더 높을 수도 있고, HGX Rubin x 8GPU 서버 가격이 더 높을 수도 또는 낮을 수도 있습니다.
다만, DGX Rubin NVL8은 사양 및 스펙이 확정되어 있어 가격의 인상 및 인하폭이 좁지만, HGX Rubin x 8 GPU 서버는 운영체제, CPU, 시스템 메모리, 스토리지 등 사양 및 용량에 따라 가격 차이가 매우 큽니다.
Q6. DGX Vera Rubin NVL72의 구성요소와 장비는 무엇이고, 가격은 얼마인가요?
DGX Vera Rubin NVL72 랙 1대에는, 기능과 역할이 다른 4개의 장비가 탑재됩니다.
1. Compute Tray x 18개 : 총 Rubin GPU x 72장 및 Vera CPU x 36장이 18개 컴퓨트 트레이에 탑재됩니다. 각 컴퓨트 트레이 당 Vera Rubin 슈퍼칩 2장 탑재, 슈퍼칩 1장 당 Rubin GPU 2장 및 Vera CPU 1장이 탑재됩니다.
2. NVLink Switch(6세대) x 9개 : Rubin GPU 72장(슈퍼칩 36장)을 하나로 묶어주는 스위치로, 마치 단 1장의 GPU처럼 사용할 수 있습니다.
3. Top of the Rack Switches x N개 : 랙 전체를 관리 및 모니터링을 위한 스위치로, NVIDIA GB300 NVL72 처럼 2개 탑재가 예상되나, 2026년 8월 기준, 공식 문서로 아직 발표되지 않았습니다.
4. Power Shelves x 4개 : 전원 공급 장비로, GB300 NVL72는 총 8개 였으나, Vera Rubin NVL72는 4개 입니다.
Vera Rubin NVL72의 사양 및 가격은 아래를 참고 바랍니다.
Q7. DGX Vera Rubin NVL72로 AI 인프라(팩토리) 구축하려면 비용이 얼마나 소요되나요?
Vera Rubin NVL72를 포함하여, 용도가 다른 5개의 랙을, AI 인프라 요구 사항 및 워크 로드 성격 등에 따라 필수 또는 선택할 수 있으며, 메인 GPU 연산 랙 및 추가로 구축할 랙 대수에 따라, 구축 비용은 수 십억원 또는 수 백억원까지 달라집니다.
NVIDIA Rubin 기반 5가지 랙 제품:
1. Vera Rubin NVL72 GPU 랙 : 루빈 GPU x 72장, Vera CPU 36장 탑재, 학습과 추론 같은 핵심 작업을 담당하는 메인 엔진 랙.
2. Vera CPU 랙 : Vera CPU x 256개 탑재, GPU가 만든 결과를 실제로 실행 및 시뮬레이션해서 맞는지 검증하는 CPU 전용 랙.
3. NVIDIA Groq 3 LPX inference accelerator 랙 : 학습이 끝난 AI 모델이 사용자에게 답을 내놓을 때, 그 응답 속도를 극대화하는 추론 전용 랙.
4. NVIDIA BlueField-4 STX storage 랙 : 맥락과 중간 계산 결과(KV 캐시)를 따로 저장, 처음부터 다시 계산하지 않고 빠르게 이어갈 수 있게 해주는 AI 네이티브 스토리지 랙.
5. NVIDIA Spectrum-6 SPX Ethernet 랙 : 여러 랙들을 하나의 네트워크로 묶어서, 한 대의 시스템처럼 서로 데이터를 주고받을 수 있게 해주는 네트워크 랙.
더 자세한 사항은 실시간 문의하기를 참고 바랍니다.

Vera Rubin NVL72 GPU 랙
학습, 추론 등 Rubin x 72장 탑재 메인 GPU 연산 랙

Vera CPU 랙
GPU 결과물, 실행 검증 시뮬레이션을 위한 CPU 랙

Groq 3 LPX inference 랙
응답 속도를 극대화, 추론을 가속화하는 랙

BlueField-4 STX storage 랙
GPU 메모리를 원활하게 확장하는 AI 네이티브 스토리지 랙

Spectrum-6 SPX 랙
여러 랙들을 하나로 클러스터링 하는 랙
Q8. DGX Vera Rubin NVL72를 구성하는 핵심 칩은 무엇인가요?
총 7가지의 핵심 칩들이, DGX Vera Rubin NVL72 연산 랙 포함, 총 5개의 랙에 분산 탑재됩니다.
NVIDIA Rubin GPU,
NVIDIA Vera CPU,
NVIDIA NVLink 6 스위치,
NVIDIA ConnectX-9 SuperNIC,
NVIDIA BlueField-4 DPU,
NVIDIA Spectrum-6 이더넷 스위치,
NVIDIA Groq 3 LPU.

NVIDIA Rubin GPU
HBM4와 50 PF NVFP4 트랜스포머 엔진을 탑재한 Rubin GPU

NVIDIA Spectrum-X 이더넷
랙과 랙, 데이터센터와 데이터센터를 연결하는 스위치/칩

NVIDIA Vera CPU
데이터 이동과 에이전틱 추론을 위해 특별히 제작된 CPU

NVIDIA Groq 3 LPU
초저지연 실시간 추론에 특화된 별도 전문 가속기 칩

NVIDIA NVLink 6 Switch
GPU를 하나의 거대한 가속기처럼 묶어주는 스위치

NVIDIA ConnectX-9 SuperNIC
랙을 넘어 바깥 네트워크로 데이터를 내보내는 출입구

NVIDIA BlueField-4 DPU
네트워킹, 스토리지 등 잡무를 전담, GPU 부담을 덜어주는 칩
Q9. 견적 요청은 어떻게 하나요?
퀀텀브릭스 탑재수량별 GPU 서버 가격표를 참고하면, 빠르게 가격에 대한 '감' 을 잡을 수 있습니다.
또는, 실시간 문의하기에 메세지를 남겨주시면, 빠르게 답을 드립니다.
퀀텀브릭스는 합리적인 가격으로 GPU 서버를 공급, 고객사 / 파트너의 AI 비지니스를 지원합니다.
최단 24시간, 최대 48시간 내 견적서를 보내드립니다.
루빈(Rubin) 탑재 GPU 서버 구매 가이드 및 Tip
가이드 #01. 루빈 GPU x 1장, 2장 또는 4장만 탑재해서 구매할 수 있습니까?
아니오!
엔비디아 Rubin GPU 단품 가격은 대략 7,000 ~ 8,000만원(부가세 별도) 정도로 추산됩니다.
단, 루빈 GPU는 단품으로 판매 및 공급되지 않으며 기본적으로 8장이 탑재됩니다.
H200을 포함, A100, H100, RTX 6000 등은 단품으로 판매 및 공급이 가능하며, 최초 구매 시, 원하는 수량을 탑재할 수 있습니다.
단품으로 구매 가능한 GPU 타입은 NVL(PCIe), 불가능한 타입은 HGX(SXM) GPU 입니다.
가이드 #02. 루빈(Rubin) 탑재 GPU 서버, 공냉인가요? 수냉인가요?
DGX Rubin NVL8 및 벤더 제조 HGX Rubin x 8 GPU 서버, 2가지 타입 모두 수냉입니다.
루빈 GPU 1장 당 전력 소모량은 2,300W이며, 8장이 탑재된 DGX Rubin NVL8의 최대 전력 소모량은 24kW입니다.
막대한 전력 소모량, 발열 등으로 인하여 냉각 방식은 수냉이 인프라 구축의 필수 요건이 됩니다.
젼력 소모량에 대한 더 자세한 내용은 하기 페이지를 참고 바랍니다.
가이드 #03. DGX 와 HGX 8GPU 서버, 어떤 것을 선택해야 하나요?
2가지 옵션 중, 하나를 선택할 수 있습니다.
첫번째 옵션,
엔비디아가 직접 설계 및 제조한 루빈 x 8장이 탑재된 DGX Rubin NVL8을 선택하는 것으로, 스펙이 확정되어서 공급되므로, 가격 편차가 크지 않습니다.
두번째, 옵션,
HPE, Dell 등 벤더가 제조한 HGX Rubin x 8 GPU 서버를 선택하는 것입니다. 각 제조사 및 사양에 따라, 가격의 차이가 매우 크게 발생합니다.
루빈(Rubin) 및 B300 성능 비교표 : 루빈(Rubin) 성능, B300 대비 얼마나 더 좋아졌나요?
B300과 루빈(Rubin) GPU 1장 당 메모리 용량, 대역폭, 연산 성능 등 비교표로, 얼마나 더 성능이 더 좋아졌는지 지금 바로 확인할 수 있습니다.
구분
B300
루빈(Rubin)
최초 공개
2026년 1월
2025년 3월
메모리 용량
288GB
288GB
메모리 타입
HBM3e
HBM4
메모리 대역폭
8TB/s
22TB/s
NVLink 대역폭
1.8TB/s
3.6TB/s
FP8 연산 성능
9 PFOLPS
17.5 PFLOPS
FP4 연산 성능
18 PFOLPS
35 PFOLPS
추론 성능(30B/FP8)
260TPS
730TPS
전력소모랑
1,400W
2,300W
냉각 방식
공냉
수냉
* 연산 성능 수치는 Dense(밀집) 기준입니다.
메모리 용량: Rubin의 메모리 용량은 B300의 288GB와 동일합니다. 단, B300의 메모리 타입은 HBM3e, 루빈은 차세대 HBM4 입니다.
메모리 대역폭: B300의 8TB/s 대비, Rubin의 메모리 대역폭은 최대 22TB/s로 대략 3배 이상 넓어져, 데이터 처리 및 추론 속도가 더 빨라졌습니다..
연산 성능: FP4 기준 B300의 18 PFLOPS 대비, Rubin은 연산 성능은 35 PFLOPS로 약 3배 증가했으며, FP8 역시 9 PFLOPS에서 17.5 PFLOPS로 약 2배 강력해졌습니다.
추론 성능: FP8 및 30B 모델 기준으로, 루빈은 약 700tps, B300은 대략 260tps 이며, 대략 3배 정도 빠릅니다.
NVLink 대역폭: NVLink 5세대 1.8TB/s에서 6세대로 업그레이드 되면서 루빈은 2배 더 넓어진 3.6TB/s를 제공하여, GPU 간 데이터 처리 속도가 더 빠릅니다.
전력 소모량 및 냉각 방식: B300 1장 당 1,400W로 공냉이며, Rubin의 전력 소모량은 2,300W이고 수냉 전용입니다.
루빈 x 72장 탑재, DGX Vera Rubin NVL72 사양 및 가격
DGX Vera Rubin NVL72는,
72개의 Rubin GPU가 탑재된 AI 랙 시스템입니다.
72개의 Rubin GPU 및 36개의 Vera CPU 탑재, 총 GPU 메모리는 최대 20.7TB, GPU 대역폭은 1,580TB/s, NVLink 대역폭은 260TB/s입니다.
CPU는 3,168개 코어가 탑재됐고, NVFP4 학습 성능은 2,520 PFLOPS, NVFP4 추론 성능은 3,600 PFLOPS 를 지원합니다.
단순히 계산하면, 루빈 x 8장 탑재 GPU 서버 9대가 하나로 묶여있는 거대한 랙 시스템입니다.
DGX Vera Rubin NVL72는 AI 데이터 센터 구축 기간을 획기적으로 단축하고 공간 점유율을 최소화 할 수 있는 최적의 인프라 시스템입니다.
퀀텀브릭스는 합리적인 가격으로 GPU 서버를 공급합니다.

#이미지: 엔비디아 루빈 72장, Vera CPU 36장이 탑재된 NVIDIA DGX Vera Rubin NVL72 랙 시스템
DGX GB300 NVL72(B300 x 72장 탑재)와 DGX GB200 NVL72(B200 x 72장 탑재)의 사양 및 가격을 알아볼까요?
B300 x 72장이 탑재된 DGX GB300 NVL72 및 B200 x 72장이 탑재된 DGX B200 NVL72의 사양 및 가격, 지금 바로 확인할 수 있습니다.
루빈 x 8장 탑재, DGX Rubin NVL8 사양 및 가격
DGX Rubin NVL8은,
NVIDIA가 설계 및 제조한 AI 전용 완제품 GPU 서버입니다.
Rubin GPU 8장 탑재 및 2.3TB GPU 메모리, 총 288코어의 인텔 듀얼 CPU와 2TB의 시스템 메모리가 탑재됩니다.
160TB/s 속도의 GPU 메모리 대역폭 및 28.8TB/s의 NVLink 대역폭을 지원합니다.
NVFP4 추론 성능은 400PFLOPS, NVFP4 학습 성능은 280PFLOPS 입니다.
AI 프로젝트에 필요한 모든 소프트웨어와 하드웨어를 탑재, 검증 및 테스트, 최적화를 거쳐 공급되므로, 즉시, AI R&D와 프로젝트에 투입됩니다.
퀀텀브릭스는 합리적인 가격으로 GPU 서버를 공급합니다.

#이미지: NVIDIA Rubin GPU x 8장이 탑재된 엔비디아가 직접 설계 및 제조한 완제품 GPU 서버, DGX Rubin NVL8
자주 묻는 질문(FAQs)
루빈 탑재 GPU 서버에 대해 질문이 더 있으세요?
실시간 문의하기 페이지에 질문, 메세지를 남겨주시면 빠르게 답변 드립니다.
대략적인 가격은 탑재수량별 GPU 서버 가격 페이지를 참고 바랍니다.
퀀텀브릭스는 고객사 및 파트너의 AI 비지니스를 지원합니다.


