Hopper · Hopper
AcceleratorerGPU0046
NVIDIA
H20 96GB
Inget spårat marknadsutbud ännu. Kovara följer för närvarande inga offentliga erbjudanden för den här acceleratorn.
Översikt över acceleratorn
Grundläggande hårdvara och livscykel, hämtat från Kovaras masterdata.
Grundläggande hårdvara
- Arkitektur
- Hopper
- Generation
- Hopper
- VRAM
- 96 GB
- Minnestyp
- HBM3
- Minnesbandbredd
- 4 TB/s
- Formfaktor
- HGX SXM5 / 8-GPU platform
Livscykel / användning
- Primär användning
- AI inference / training / China-market AI compute
- Lanseringsår
- 2024
- Generationsstatus
- Current
- Senast verifierad
- 03 sep. 2026
Hårdvaran på djupet
Vad de registrerade specifikationerna innebär i praktiken och vad den här acceleratorn används till.
Specifikationerna förklarade
Används för AI inference, training och China-market AI compute
- VRAM
- 96 GB
- Minnestyp
- HBM3
- Minnesbandbredd
- 4 TB/s
HBM (High Bandwidth Memory) staplas i lager och sitter precis bredvid processorn i samma kapsel. Den korta, breda vägen är det som ger acceleratorer med HBM deras minnesbandbredd, så de väljs oftast för arbete som begränsas av hur snabbt data når kärnorna, till exempel inferens med stora modeller och HPC-simuleringar.
VRAM är arbetsytan på kortet. Modellvikter, aktiveringar och datamängder måste rymmas i det eller delas upp över flera GPU:er. Tumregel för enbart vikterna vid 16-bitars precision (cirka 2 GB per miljard parametrar): upp till ungefär 48 miljarder parametrar, före aktiveringar och cache. Det här är aritmetik på det registrerade VRAM-värdet, inte en benchmark.
- Arkitektur
- Hopper
- Lanseringsår
- 2024
- Livscykelstatus
- Current
Hopper lade till Transformer Engine, som blandar FP8- och 16-bitarsberäkningar för transformermodeller, samt fjärde generationens Tensor Cores. (Allmänt sammanhang om arkitekturen, inte ett påstående om just det här kortet.)
Lanserad 2024. Enligt Kovaras poster är det en komponent av aktuell generation.
- NVLink
- Stöds
- MIG
- Stöds
- Formfaktor
- HGX SXM5 / 8-GPU platform
- TDP
- 400 W
NVLink är en direkt GPU-till-GPU-länk. Där den stöds kan GPU:er i samma server utbyta data snabbare än enbart via PCIe, vilket spelar roll när ett träningsjobb är fördelat över flera GPU:er.
Multi-Instance GPU (MIG) kan dela upp en fysisk GPU i isolerade delar, var och en med eget minne och egen beräkningskapacitet, så att flera mindre arbetslaster kan dela på ett kort.
SXM-moduler monteras direkt på ett serverbasbord i stället för att sättas i som kort, den layout som vanligtvis används för täta servrar med flera GPU:er.
TDP är den angivna termiska designeffekten: planeringsvärdet för strömförsörjning och kylning i en server.
- Primär användning (registrerad)
- AI inference / training / China-market AI compute
Det här är de användningsområden som Kovara har registrerat för komponenten. Kommentarerna förklarar arbetslasten i allmänna termer; de är inga påståenden om prestanda.
- AI inferenceAtt köra en tränad modell för att besvara förfrågningar. Minneskapacitet, latens och kostnad per förfrågan är de vanliga frågorna.
- trainingAtt lära upp en modell från data. Oftast den mest beräknings- och minneskrävande fasen, ofta fördelad över många GPU:er.
- China-market AI compute
Värdena är Kovaras masterdata, senast verifierade 03 sep. 2026. Förklaringarna beskriver tekniken i allmänhet; de är inga benchmarks och säger inget om pris eller tillgänglighet.
Utforska den här acceleratorn i Compute- HBM3-stackar
- GPU-die
- Interposer
- Kort
- Effekt
- Indata
- Utdata
- NVLink
- Angränsande GPU
- MIG-sektorer
- SXM-kontakt
Marknadsanalys
Marknadspriser spåras ännu inte för den här acceleratorn.
Den spårade täckningen beskriver inte hela marknadsutbudet eller den geografiska tillgängligheten.
Utforska Compute →Tekniska specifikationer
Registrerade hårdvaruattribut. Spåras inte är inte detsamma som Nej.
Beräkning
- Arkitektur
- Hopper
- Generation
- Hopper
- Primär användning
- AI inference / training / China-market AI compute
Minne
- VRAM
- 96 GB
- Minnestyp
- HBM3
- Minnesbandbredd
- 4 TB/s
Plattform
- Formfaktor
- HGX SXM5 / 8-GPU platform
- TDP
- 400 W
- NVLink stöds
- Ja
- MIG stöds
- Ja
Livscykel / användning
- Primär användning
- AI inference / training / China-market AI compute
- Lanseringsår
- 2024
- Generationsstatus
- Current
- Senast verifierad
- 03 sep. 2026
Data och belägg
Offentliga källbelägg är för närvarande inte tillgängliga för den täckning som Kovara följer.