Vai al contenuto
GPU.it
Archivio in revisione
Tutte le GPU

NVIDIA · Scheda tecnica

NVIDIA H200 SXM 141 GB

NVIDIA H200 SXM 141 GB: architettura Hopper, 141 GB di memoria HBM3e, TDP dichiarato di 700 W, CUDA Compute Capability 9.0 riportata dal dataset. Nessun campione Blender con almeno 10 test compatibili disponibile.

Confronta questa GPU

VRAM / memoria

141 GB

TDP dichiarato

700 W

FP32 teorici

66,91 TFLOPS

Banda memoria

4.890 GB/s

Identità e architettura

Architettura
Hopper
Generazione
Server Hopper(Hxx)
Data riportata dalla fonte
2024-11-18
Chip
GH100
Fonderia
TSMC
Processo produttivo
5 nm
Transistor
80 miliardi
Superficie chip
814 mm²

Memoria

Capacità memoria
141 GB
Tipo memoria
HBM3e
Memoria unificata
No
Banda memoria
4.890 GB/s
Bus memoria
6.144 bit
Clock memoria
1.593 MHz

Calcolo e potenza

Unità shader
16.896
Tensor Core NVIDIA
528
Unità ray tracing (vendor-specific)
0 · NVIDIA
Clock base
1.500 MHz
Clock boost
1.980 MHz
FP16 teorici
267,6 TFLOPS
FP32 teorici
66,91 TFLOPS
FP64 teorici
33,45 TFLOPS
TDP dichiarato
700 W
Interfaccia
PCIe 5.0 x16

API e compatibilità

CUDA Compute Capability
9.0
DirectX
Vulkan
OpenGL
OpenCL
3.0
Shader model

FP32 e FP16 sono capacità teoriche, non prestazioni nei giochi. «—» indica un dato assente. «N.A.» indica terminologia non applicabile, non assenza di accelerazione AI. I Tensor Core sono NVIDIA; le unità ray tracing hanno definizioni specifiche del produttore e non sono equivalenti automaticamente.

Benchmark Blender

Non ci sono test Blender associati con corrispondenza univoca a questa GPU.

MLPerf · benchmark AI per configurazione

Configurazioni MLPerf contenenti NVIDIA H200 SXM 141 GB

Risultati dell’intero sistema, mai divisi per il numero di GPU. Modello, scenario, precisione, categoria, versione e software devono essere compatibili per un confronto: questa non è una classifica della GPU. Risultati inferiti e conteggi incoerenti restano fuori da questa tabella.

109 risultati di configurazione

Sistema e acceleratoriWorkload e protocolloRisultato del sistemaSoftware e fonte

LLM-D v0.5.0,OpenShift 4.21,IBM cloud gx3d-160x1792x8h200,NVIDIA 8xH200-SXM-141GB

NVIDIA H200-SXM-141GB

8 acceleratori/nodo · 1 nodi

Totale dichiarato: 8

Intel Xeon Processor (SapphireRapids)

gpt-oss-120b

Offline · mxfp4

v6.0 · closed · datacenter

Accuratezza riportata

exact_match: 84.206

28.680

Tokens/s

Red Hat Enterprise Linux 9.6

Software stack

LLM-D v0.5.0 ,OpenShift 4.21, RHEL 9.6

MLCommons · 6.0-0092

LLM-D v0.5.0,OpenShift 4.21,IBM cloud gx3d-160x1792x8h200,NVIDIA 8xH200-SXM-141GB

NVIDIA H200-SXM-141GB

8 acceleratori/nodo · 1 nodi

Totale dichiarato: 8

Intel Xeon Processor (SapphireRapids)

gpt-oss-120b

Server · mxfp4

v6.0 · closed · datacenter

Accuratezza riportata

exact_match: 83.680

24.103,2

Tokens/s

Red Hat Enterprise Linux 9.6

Software stack

LLM-D v0.5.0 ,OpenShift 4.21, RHEL 9.6

MLCommons · 6.0-0092

IBM Cloud qx3d-160x1792x8h200,NVIDIA 8xH200-SXM-141GB,vLLM 0.15.1

NVIDIA H200-SXM-141GB

8 acceleratori/nodo · 1 nodi

Totale dichiarato: 8

Intel Xeon Processor (Sapphire Rapids)

whisper

Offline · bfloat16

v6.0 · closed · datacenter

Accuratezza riportata

ACCURACY: 98.11090914281908

36.395,7

Samples/s

Red Hat Enterprise Linux 9.6 (Plow), Kernel 5.14.0-570.79.1.el9_6.x86_64

Software stack

vLLM 0.15.1, PyTorch 2.9.1+cu128, CUDA 12.9.86

MLCommons · 6.0-0093

HPE Cray XD670 (8x H200-SXM-141GB)

NVIDIA H200-SXM-141GB

8 acceleratori/nodo · 1 nodi

Intel(R) Xeon(R) Platinum 8562Y+

deepseek-r1

Offline · fp8

v5.1 · open · datacenter

Accuratezza riportata

exact_match: 81.42661804922516 TOKENS_PER_SAMPLE: 3854.3742023701

8.904,83

Tokens/s

RHEL 9.4

Software stack

TensorRT 10.8, CUDA 12.8

MLCommons · 5.1-0375

ASUSTeK ESC N8 H200 (8x H200-SXM-141GB, TensorRT)

NVIDIA H200-SXM-141GB

8 acceleratori/nodo · 1 nodi

INTEL(R) XEON(R) PLATINUM 8580

dlrm-v2-99

Offline · int8

v5.1 · closed · datacenter

Accuratezza riportata

AUC: 80.166

643.122

Samples/s

Ubuntu 24.04

Software stack

TensorRT 10.11, CUDA 12.9

MLCommons · 5.1-0007

QuantaGrid D74H-7U (8x H200-SXM-141GB, TensorRT)

NVIDIA H200-SXM-141GB

8 acceleratori/nodo · 1 nodi

Intel(R) Xeon(R) Platinum 8480+

dlrm-v2-99

Offline · int8

v5.1 · closed · datacenter

Accuratezza riportata

AUC: 80.166

647.861

Samples/s

Rocky Linux 9.2

Software stack

TensorRT 10.8, CUDA 12.8

MLCommons · 5.1-0079

ASUSTeK ESC N8 H200 (8x H200-SXM-141GB, TensorRT)

NVIDIA H200-SXM-141GB

8 acceleratori/nodo · 1 nodi

INTEL(R) XEON(R) PLATINUM 8580

dlrm-v2-99

Server · int8

v5.1 · closed · datacenter

Accuratezza riportata

AUC: 80.166

591.162

Queries/s

Ubuntu 24.04

Software stack

TensorRT 10.11, CUDA 12.9

MLCommons · 5.1-0007

QuantaGrid D74H-7U (8x H200-SXM-141GB, TensorRT)

NVIDIA H200-SXM-141GB

8 acceleratori/nodo · 1 nodi

Intel(R) Xeon(R) Platinum 8480+

dlrm-v2-99

Server · int8

v5.1 · closed · datacenter

Accuratezza riportata

AUC: 80.166

585.168

Queries/s

Rocky Linux 9.2

Software stack

TensorRT 10.8, CUDA 12.8

MLCommons · 5.1-0079

ASUSTeK ESC N8 H200 (8x H200-SXM-141GB, TensorRT)

NVIDIA H200-SXM-141GB

8 acceleratori/nodo · 1 nodi

INTEL(R) XEON(R) PLATINUM 8580

dlrm-v2-99.9

Offline · int8

v5.1 · closed · datacenter

Accuratezza riportata

AUC: 80.233

388.058

Samples/s

Ubuntu 24.04

Software stack

TensorRT 10.11, CUDA 12.9

MLCommons · 5.1-0007

QuantaGrid D74H-7U (8x H200-SXM-141GB, TensorRT)

NVIDIA H200-SXM-141GB

8 acceleratori/nodo · 1 nodi

Intel(R) Xeon(R) Platinum 8480+

dlrm-v2-99.9

Offline · int8

v5.1 · closed · datacenter

Accuratezza riportata

AUC: 80.233

389.330

Samples/s

Rocky Linux 9.2

Software stack

TensorRT 10.8, CUDA 12.8

MLCommons · 5.1-0079
1 / 11

Fonti e divergenze

Ogni specifica conserva fonte, data di acquisizione e confidenza del matching. La confidenza non è una certificazione della correttezza del valore.

Open GPU DB30 attributi selezionati

Mostra provenance campo per campo
SpecificaFonteAcquisizioneMatching
ArchitetturaOpen GPU DB17/09/202690%
device_typeOpen GPU DB17/09/202690%
GenerazioneOpen GPU DB17/09/202690%
Banda memoriaOpen GPU DB17/09/202690%
Capacità memoriaOpen GPU DB17/09/202690%
Tipo memoriaOpen GPU DB17/09/202690%
Memoria unificataOpen GPU DB17/09/202690%
nameOpen GPU DB17/09/202690%
Data riportata dalla fonteOpen GPU DB17/09/202690%
CUDA Compute CapabilityOpen GPU DB17/09/202690%
OpenCLOpen GPU DB17/09/202690%
Clock baseOpen GPU DB17/09/202690%
Clock boostOpen GPU DB17/09/202690%
InterfacciaOpen GPU DB17/09/202690%
ChipOpen GPU DB17/09/202690%
Superficie chipOpen GPU DB17/09/202690%
FonderiaOpen GPU DB17/09/202690%
FP16 teoriciOpen GPU DB17/09/202690%
FP32 teoriciOpen GPU DB17/09/202690%
FP64 teoriciOpen GPU DB17/09/202690%
Bus memoriaOpen GPU DB17/09/202690%
Clock memoriaOpen GPU DB17/09/202690%
Processo produttivoOpen GPU DB17/09/202690%
Unità ray tracing (vendor-specific)Open GPU DB17/09/202690%
Unità shaderOpen GPU DB17/09/202690%
TDP dichiaratoOpen GPU DB17/09/202690%
Tensor Core NVIDIAOpen GPU DB17/09/202690%
TransistorOpen GPU DB17/09/202690%
statusOpen GPU DB17/09/202690%
vendorOpen GPU DB17/09/202690%
Metodo di riconciliazione e licenze

Altre GPU della stessa architettura

Esplora NVIDIA