Data Center GPU
AI와 HPC 워크로드를 가속하는 데이터센터 GPU 라인업입니다.
생성형 AI·대규모 언어모델·그래픽·시뮬레이션을 가속하는 핵심 컴퓨팅 엔진입니다. 최신 Blackwell 세대(B200·B300)부터 검증된 Hopper(H200·H100), 범용 가속(L40S)과 전문가용(RTX PRO 6000)까지 워크로드별로 제공합니다.
데이터센터 GPU란
데이터센터 GPU는 Tensor Core로 AI 행렬 연산을 가속하는 가속기입니다. Blackwell 세대는 FP4/FP6 저정밀 연산과 2세대 Transformer Engine, 5세대 NVLink로 조 단위 파라미터 모델의 학습·추론을 극대화하고, Hopper(H100·H200) 세대는 검증된 안정성과 대용량 HBM으로 여전히 폭넓게 쓰입니다.
GPU 라인업 (라인별 스펙)
B200
Blackwell 플래그십 · 192GB HBM3e · 8TB/s · FP4 최대 ~20 PFLOPS — H100 대비 약 4배 AI 성능
B300 (Blackwell Ultra)
약 288GB HBM3e — B200 대비 확장 메모리·추론 성능으로 대규모 추론·에이전틱 AI에 최적화
GB200 Grace Blackwell Superchip
Grace CPU + 2× B200(384GB HBM3e)을 NVLink-C2C로 결합한 슈퍼칩 — GB200 NVL72 랙의 기본 단위
H200
Hopper · 141GB HBM3e · 4.8TB/s — 대용량 메모리로 LLM 추론에 최적화된 H100 상위 호환
H100
Hopper Tensor Core · 80GB HBM3 · 3.35TB/s · FP8 — 대규모 학습·추론의 검증된 표준
L40S
Ada Lovelace · 48GB GDDR6 — AI 추론·그래픽·가상화를 아우르는 범용 유니버설 GPU
RTX PRO 6000 Blackwell
Blackwell · 96GB GDDR7 — 전문가용 최상위 워크스테이션·서버 GPU
차세대 로드맵 — Rubin
Rubin GPU (2026)
차세대 — HBM4 · NVLink 6, Vera CPU와 결합해 Rubin NVL144 랙을 구성
Rubin Ultra (2027) · Feynman (2028)
Rubin Ultra NVL576(2027) 이후 Feynman 세대(2028)로 로드맵 지속 (발표 기준, 세부 스펙 추후 공개)
핵심 스펙 비교
| 모델 | 아키텍처 | 메모리 | 대역폭 | AI 성능 | 용도 |
|---|---|---|---|---|---|
| B200 | Blackwell | 192GB HBM3e | 8TB/s | FP4 ~20 PFLOPS * | 대규모 학습·추론 |
| B300 | Blackwell Ultra | ~288GB HBM3e | ~8TB/s | FP4 상향 * | 대규모 추론·에이전틱 |
| H200 | Hopper | 141GB HBM3e | 4.8TB/s | FP8 (H100급) | 대용량 메모리 추론 |
| H100 | Hopper | 80GB HBM3 | 3.35TB/s | FP8 ~4 PFLOPS(희소) | 검증된 학습·추론 |
| L40S | Ada Lovelace | 48GB GDDR6 | 864GB/s | FP8 ~1.5 PFLOPS(희소) | 범용·그래픽·추론 |
| RTX PRO 6000 | Blackwell | 96GB GDDR7 | — | 전문가용 | 워크스테이션·서버 |
※ 성능은 Tensor Core 기준 NVIDIA 발표값이며 정밀도(FP4/FP8)·희소성 조건에 따라 달라집니다. * 표시는 근사치·로드맵 기준입니다.