Hopper · Hopper
AcceleratorerGPU0046
NVIDIA
H20 96GB
Intet registreret markedsudbud endnu. Kovara følger i øjeblikket ingen offentlige tilbud på denne accelerator.
Oversigt over acceleratoren
Central hardware og livscyklus, hentet fra Kovaras stamdata.
Central hardware
- Arkitektur
- Hopper
- Generation
- Hopper
- VRAM
- 96 GB
- Hukommelsestype
- HBM3
- Hukommelsesbåndbredde
- 4 TB/s
- Formfaktor
- HGX SXM5 / 8-GPU platform
Livscyklus / anvendelse
- Primær anvendelse
- AI inference / training / China-market AI compute
- Lanceringsår
- 2024
- Generationsstatus
- Current
- Senest verificeret
- 03. sep. 2026
Hardwaren i dybden
Hvad de registrerede specifikationer betyder i praksis, og hvad denne accelerator bruges til.
Specifikationerne forklaret
Bruges til AI inference, training og China-market AI compute
- VRAM
- 96 GB
- Hukommelsestype
- HBM3
- Hukommelsesbåndbredde
- 4 TB/s
HBM (High Bandwidth Memory) er stablet i lag og sidder lige ved siden af processoren i samme pakke. Den korte, brede forbindelse er det, der giver acceleratorer med HBM deres hukommelsesbåndbredde, så de vælges typisk til arbejde, der er begrænset af, hvor hurtigt data når frem til kernerne, f.eks. inferens med store modeller og HPC-simulering.
VRAM er arbejdsområdet på kortet. Modelvægte, aktiveringer og datasæt skal kunne være der eller fordeles på flere GPU’er. Tommelfingerregel for vægtene alene ved 16-bit præcision (ca. 2 GB pr. milliard parametre): op til omkring 48 milliarder parametre, før aktiveringer og cache. Det er en beregning på den registrerede VRAM, ikke en benchmark.
- Arkitektur
- Hopper
- Lanceringsår
- 2024
- Livscyklusstatus
- Current
Hopper tilføjede Transformer Engine, der blander FP8- og 16-bit-beregninger til transformermodeller, og fjerde generation af Tensor Cores. (Generel kontekst om arkitekturen, ikke et udsagn om dette specifikke kort.)
Lanceret i 2024. Kovaras poster angiver den som en del af den nuværende generation.
- NVLink
- Understøttet
- MIG
- Understøttet
- Formfaktor
- HGX SXM5 / 8-GPU platform
- TDP
- 400 W
NVLink er en direkte GPU-til-GPU-forbindelse. Hvor den understøttes, kan GPU’er i samme server udveksle data hurtigere end over PCIe alene, hvilket har betydning, når ét træningsjob er fordelt på flere GPU’er.
Multi-Instance GPU (MIG) kan opdele én fysisk GPU i isolerede dele, hver med sin egen hukommelse og regnekraft, så flere mindre workloads kan dele et kort.
SXM-moduler monteres direkte på et serverbaseboard i stedet for at blive sat i som kort, det layout, der typisk bruges til tætte servere med mange GPU’er.
TDP er den nominelle thermal design power: planlægningstallet for strømforsyning og køling i en server.
- Primær anvendelse (registreret)
- AI inference / training / China-market AI compute
Det er de anvendelser, Kovara har registreret for denne komponent. Noterne forklarer workloaden i generelle vendinger; de er ikke påstande om ydeevne.
- AI inferenceKørsel af en trænet model for at besvare forespørgsler. Hukommelseskapacitet, latenstid og omkostning pr. forespørgsel er de typiske hensyn.
- trainingAt lære en model op fra data. Som regel den fase, der kræver mest regnekraft og hukommelse, ofte fordelt på mange GPU’er.
- China-market AI compute
Tallene er Kovaras stamdata, senest verificeret 03. sep. 2026. Forklaringerne beskriver teknologien generelt; de er ikke benchmarks og siger intet om pris eller tilgængelighed.
Udforsk denne accelerator i Compute- HBM3-stakke
- GPU-die
- Interposer
- Kort
- Effekt
- Input
- Output
- NVLink
- Nabo-GPU
- MIG-sektorer
- SXM-stik
Markedsintelligence
Markedspriser følges endnu ikke for denne accelerator.
Den fulgte dækning beskriver ikke hele markedsudbuddet eller den geografiske tilgængelighed.
Udforsk Compute →Tekniske specifikationer
Registrerede hardwareattributter. Ikke fulgt er ikke det samme som Nej.
Regnekraft
- Arkitektur
- Hopper
- Generation
- Hopper
- Primær anvendelse
- AI inference / training / China-market AI compute
Hukommelse
- VRAM
- 96 GB
- Hukommelsestype
- HBM3
- Hukommelsesbåndbredde
- 4 TB/s
Platform
- Formfaktor
- HGX SXM5 / 8-GPU platform
- TDP
- 400 W
- NVLink understøttet
- Ja
- MIG understøttet
- Ja
Livscyklus / anvendelse
- Primær anvendelse
- AI inference / training / China-market AI compute
- Lanceringsår
- 2024
- Generationsstatus
- Current
- Senest verificeret
- 03. sep. 2026
Data og evidens
Offentlig kildeevidens er i øjeblikket ikke tilgængelig for den dækning, Kovara følger.