Data Center GPU
AI와 HPC 워크로드를 가속하는 데이터센터 GPU 라인업입니다.
생성형 AI·대규모 언어모델·그래픽·시뮬레이션을 가속하는 핵심 컴퓨팅 엔진입니다. 최신 Blackwell 세대(B200·B300)부터 검증된 Hopper(H200·H100), 범용 가속(L40S)과 전문가용(NVIDIA RTX™ PRO 6000)까지 워크로드별로 제공합니다.
데이터센터 GPU란
데이터센터 GPU는 NVIDIA Tensor Core™로 AI 행렬 연산을 가속하는 가속기입니다. Blackwell 세대는 FP4/FP6 저정밀 연산과 2세대 Transformer Engine, 5세대 NVIDIA NVLink™로 조 단위 파라미터 모델의 학습·추론을 극대화하고, Hopper(H100·H200) 세대는 검증된 안정성과 대용량 HBM으로 여전히 폭넓게 쓰입니다.
GPU 라인업 (라인별 스펙)
B200
Blackwell 플래그십 · 192GB HBM3e · 8TB/s · FP4 최대 ~20 PFLOPS — H100 대비 약 4배 AI 성능
B300 (Blackwell Ultra)
약 288GB HBM3e — B200 대비 확장 메모리·추론 성능으로 대규모 추론·에이전틱 AI에 최적화
GB200 Grace Blackwell Superchip
Grace CPU + 2× B200(384GB HBM3e)을 NVLink-C2C로 결합한 슈퍼칩 — GB200 NVL72 랙의 기본 단위
H200
Hopper · 141GB HBM3e · 4.8TB/s — 대용량 메모리로 LLM 추론에 최적화된 H100 상위 호환
H100
Hopper Tensor Core · 80GB HBM3 · 3.35TB/s · FP8 — 대규모 학습·추론의 검증된 표준
L40S
Ada Lovelace · 48GB GDDR6 — AI 추론·그래픽·가상화를 아우르는 범용 유니버설 GPU
RTX PRO 6000 Blackwell
Blackwell · 96GB GDDR7 — 전문가용 최상위 워크스테이션·서버 GPU
차세대 로드맵 — Rubin
Rubin GPU (2026)
차세대 — HBM4 · NVLink 6, Vera CPU와 결합해 Rubin NVL144 랙을 구성
Rubin Ultra (2027) · Feynman (2028)
Rubin Ultra NVL576(2027) 이후 Feynman 세대(2028)로 로드맵 지속 (발표 기준, 세부 스펙 추후 공개)
핵심 스펙 비교
| 모델 | 아키텍처 | 메모리 | 대역폭 | AI 성능 | 용도 |
|---|---|---|---|---|---|
| B200 | Blackwell | 192GB HBM3e | 8TB/s | FP4 ~20 PFLOPS * | 대규모 학습·추론 |
| B300 | Blackwell Ultra | ~288GB HBM3e | ~8TB/s | FP4 상향 * | 대규모 추론·에이전틱 |
| H200 | Hopper | 141GB HBM3e | 4.8TB/s | FP8 (H100급) | 대용량 메모리 추론 |
| H100 | Hopper | 80GB HBM3 | 3.35TB/s | FP8 ~4 PFLOPS(희소) | 검증된 학습·추론 |
| L40S | Ada Lovelace | 48GB GDDR6 | 864GB/s | FP8 ~1.5 PFLOPS(희소) | 범용·그래픽·추론 |
| RTX PRO 6000 | Blackwell | 96GB GDDR7 | — | 전문가용 | 워크스테이션·서버 |
※ 성능은 Tensor Core 기준 NVIDIA 발표값이며 정밀도(FP4/FP8)·희소성 조건에 따라 달라집니다. * 표시는 근사치·로드맵 기준입니다.