3 offres actives · 2 régions suivies
Publicly listed 2 · Inference platform customers 1
Loading
Traduction de l’anglais. En cas de divergence, la version anglaise prévaut.
AccélérateursGPU0043
NVIDIA
Matériel de base et cycle de vie, issus des données de référence de Kovara.
Ce que signifient concrètement les spécifications enregistrées, et à quoi sert cet accélérateur.
Spécifications expliquées
La HBM (High Bandwidth Memory) est empilée en couches et placée juste à côté du processeur, sur le même package. Ce chemin court et large est ce qui donne aux accélérateurs équipés de HBM leur bande passante mémoire ; on les choisit donc généralement pour des charges de travail limitées par la vitesse à laquelle les données parviennent aux cœurs, comme l’inférence de grands modèles et la simulation HPC.
La VRAM est l’espace de travail de la carte. Les poids du modèle, les activations et les jeux de données doivent y tenir, ou être répartis sur plusieurs GPU. Règle empirique pour les seuls poids en précision 16 bits (environ 2 GB par milliard de paramètres) : jusqu’à environ 48 milliards de paramètres, avant activations et cache. Il s’agit d’un calcul arithmétique sur la VRAM enregistrée, et non d’un benchmark.
Grace Hopper associe un GPU Hopper à un CPU Grace basé sur Arm dans un seul superchip. (Contexte général sur l’architecture, et non une affirmation sur cette carte en particulier.)
Lancé en 2023. Les enregistrements de Kovara l’indiquent comme un composant de la génération précédente.
NVLink est une liaison directe de GPU à GPU. Lorsqu’il est pris en charge, les GPU d’un même serveur peuvent échanger des données plus rapidement qu’avec le seul PCIe, ce qui compte lorsqu’une même tâche d’entraînement est répartie sur plusieurs GPU.
La Multi-Instance GPU (MIG) peut diviser un GPU physique en tranches isolées, chacune avec sa propre mémoire et sa propre puissance de calcul, afin que plusieurs charges de travail plus petites puissent partager une carte.
Le TDP est la puissance thermique de conception nominale : la valeur de référence pour dimensionner l’alimentation et le refroidissement d’un serveur.
Voici les usages que Kovara a enregistrés pour ce composant. Les notes expliquent la charge de travail en termes généraux ; elles ne constituent pas des affirmations de performance.
Les chiffres sont des données de référence de Kovara, dernière vérification : 03 sept. 2026. Les explications décrivent la technologie de manière générale ; elles ne sont pas des benchmarks et ne disent rien du prix ni de la disponibilité.
Explorer cet accélérateur sur ComputeObservations publiques de Kovara ; elles ne constituent pas une affirmation de couverture de marché exhaustive ou universelle. Les unités de prix brutes incompatibles sont exclues.
Fourchette observée par GPU-hour
USD / GPU-hour
Écart $4.21 USD / GPU-hour
Fournisseurs représentés par les offres actuelles suivies par Kovara.
3 offres actives · 2 régions suivies
Publicly listed 2 · Inference platform customers 1
1 offre active · 1 région suivie
Publicly listed 1
1 offre active · 1 région suivie
Self-serve first-come 1
Régions représentées par les offres actuelles ; cela ne décrit pas l’intégralité de la disponibilité mondiale.
1 offre active · 1 fournisseurs
2 offres actives · 1 fournisseurs
2 offres actives · 2 fournisseurs
Configurations actuelles, disponibilité enregistrée, capacité confirmée et preuves à l’appui de chaque prix.
| Provider | Région | Configuration | Disponibilité | Prix | Modèle commercial | Confiance / preuves | Action |
|---|---|---|---|---|---|---|---|
| OFR-0240Lambda | Unspecified, Multiple / Unspecified | NVIDIA GH200 96GB HBM3Configuration de 1 GPU · 1 GPU par nœud | Self-serve first-comeCapacité confirmée : Non confirmé | $2.29 USD / GPU-hourPrix d’origine : USD 2.29 GPU/hour | On-DemandGPU instance · Hourly | Confiance AVérifié il y a 11 joursConfirmé le 23 sept. 2026Source : SRC000017 | Examiner |
| OFR-0304Denvr Data | Unspecified, Multiple / Unspecified | NVIDIA GH200 96GB HBM3Configuration de 1 GPU · 1 GPU par nœud | Publicly listedCapacité confirmée : Non confirmé | $3.87 USD / GPU-hourPrix d’origine : USD 3.87 GPU/hour | On-DemandGPU platform · Per-minute billing | Confiance AVérifié il y a 10 joursConfirmé le 23 sept. 2026Source : SRC000038 | Examiner |
| OFR-0601CoreWeave | Europe, Multiple / Unspecified | NVIDIA GH200 96GB HBM3Configuration de 1 GPU · 1 GPU par nœud | Publicly listedCapacité confirmée : Non confirmé | $6.50 USD / GPU-hourPrix d’origine : USD 6.50 instance-hour | On-DemandGPU instance · Hourly | Confiance AVérifié il y a 5 joursConfirmé le 29 sept. 2026Source : SRC000013 | Examiner |
| OFR-0629CoreWeave | North America, Multiple / Unspecified | NVIDIA GH200 96GB HBM3Configuration de 1 GPU · 1 GPU par nœud | Publicly listedCapacité confirmée : Non confirmé | $6.50 USD / GPU-hourPrix d’origine : USD 6.50 instance-hour | On-DemandGPU instance · Hourly | Confiance AVérifié il y a 5 joursConfirmé le 29 sept. 2026Source : SRC000013 | Examiner |
| OFR-0630CoreWeave | North America, Multiple / Unspecified | NVIDIA GH200 96GB HBM3Configuration de 1 GPU | Inference platform customersCapacité confirmée : Non confirmé | $6.50 USD / GPU-hourPrix d’origine : USD 6.50 GPU/hour | Inference platformInference single GPU · Hourly | Confiance AVérifié il y a 5 joursConfirmé le 29 sept. 2026Source : SRC000013 | Examiner |
Attributs matériels enregistrés. Non suivi est une valeur distincte de Non.
Preuves publiques et signaux de confiance à l’appui de la couverture suivie par Kovara.