Accelerated Computing

Data Center GPU

AI와 HPC 워크로드를 가속하는 데이터센터 GPU 라인업입니다.

생성형 AI·대규모 언어모델·그래픽·시뮬레이션을 가속하는 핵심 컴퓨팅 엔진입니다. 최신 Blackwell 세대(B200·B300)부터 검증된 Hopper(H200·H100), 범용 가속(L40S)과 전문가용(NVIDIA RTX™ PRO 6000)까지 워크로드별로 제공합니다.

데이터센터 GPU란

데이터센터 GPU는 NVIDIA Tensor Core™로 AI 행렬 연산을 가속하는 가속기입니다. Blackwell 세대는 FP4/FP6 저정밀 연산과 2세대 Transformer Engine, 5세대 NVIDIA NVLink™로 조 단위 파라미터 모델의 학습·추론을 극대화하고, Hopper(H100·H200) 세대는 검증된 안정성과 대용량 HBM으로 여전히 폭넓게 쓰입니다.

GPU 라인업 (라인별 스펙)

B200

Blackwell 플래그십 · 192GB HBM3e · 8TB/s · FP4 최대 ~20 PFLOPS — H100 대비 약 4배 AI 성능

B300 (Blackwell Ultra)

약 288GB HBM3e — B200 대비 확장 메모리·추론 성능으로 대규모 추론·에이전틱 AI에 최적화

GB200 Grace Blackwell Superchip

Grace CPU + 2× B200(384GB HBM3e)을 NVLink-C2C로 결합한 슈퍼칩 — GB200 NVL72 랙의 기본 단위

H200

Hopper · 141GB HBM3e · 4.8TB/s — 대용량 메모리로 LLM 추론에 최적화된 H100 상위 호환

H100

Hopper Tensor Core · 80GB HBM3 · 3.35TB/s · FP8 — 대규모 학습·추론의 검증된 표준

L40S

Ada Lovelace · 48GB GDDR6 — AI 추론·그래픽·가상화를 아우르는 범용 유니버설 GPU

RTX PRO 6000 Blackwell

Blackwell · 96GB GDDR7 — 전문가용 최상위 워크스테이션·서버 GPU

차세대 로드맵 — Rubin

Rubin GPU (2026)

차세대 — HBM4 · NVLink 6, Vera CPU와 결합해 Rubin NVL144 랙을 구성

Rubin Ultra (2027) · Feynman (2028)

Rubin Ultra NVL576(2027) 이후 Feynman 세대(2028)로 로드맵 지속 (발표 기준, 세부 스펙 추후 공개)

핵심 스펙 비교

모델아키텍처메모리대역폭AI 성능용도
B200Blackwell192GB HBM3e8TB/sFP4 ~20 PFLOPS *대규모 학습·추론
B300Blackwell Ultra~288GB HBM3e~8TB/sFP4 상향 *대규모 추론·에이전틱
H200Hopper141GB HBM3e4.8TB/sFP8 (H100급)대용량 메모리 추론
H100Hopper80GB HBM33.35TB/sFP8 ~4 PFLOPS(희소)검증된 학습·추론
L40SAda Lovelace48GB GDDR6864GB/sFP8 ~1.5 PFLOPS(희소)범용·그래픽·추론
RTX PRO 6000Blackwell96GB GDDR7전문가용워크스테이션·서버

※ 성능은 Tensor Core 기준 NVIDIA 발표값이며 정밀도(FP4/FP8)·희소성 조건에 따라 달라집니다. * 표시는 근사치·로드맵 기준입니다.

제품 문의하기