1 offre active · 1 région suivie
Publicly listed 1
Loading
Traduction de l’anglais. En cas de divergence, la version anglaise prévaut.
AccélérateursGPU0016
NVIDIA
Matériel de base et cycle de vie, issus des données de référence de Kovara.
Ce que signifient concrètement les spécifications enregistrées, et à quoi sert cet accélérateur.
Spécifications expliquées
La HBM (High Bandwidth Memory) est empilée en couches et placée juste à côté du processeur, sur le même package. Ce chemin court et large est ce qui donne aux accélérateurs équipés de HBM leur bande passante mémoire ; on les choisit donc généralement pour des charges de travail limitées par la vitesse à laquelle les données parviennent aux cœurs, comme l’inférence de grands modèles et la simulation HPC.
La VRAM est l’espace de travail de la carte. Les poids du modèle, les activations et les jeux de données doivent y tenir, ou être répartis sur plusieurs GPU. Règle empirique pour les seuls poids en précision 16 bits (environ 2 GB par milliard de paramètres) : jusqu’à environ 20 milliards de paramètres, avant activations et cache. Il s’agit d’un calcul arithmétique sur la VRAM enregistrée, et non d’un benchmark.
Ampere a apporté à ses composants pour centres de données les Tensor Cores de troisième génération, la précision TF32 et la Multi-Instance GPU (MIG). (Contexte général sur l’architecture, et non une affirmation sur cette carte en particulier.)
Lancé en 2020. Les enregistrements de Kovara l’indiquent comme un composant de la génération précédente.
NVLink est une liaison directe de GPU à GPU. Lorsqu’il est pris en charge, les GPU d’un même serveur peuvent échanger des données plus rapidement qu’avec le seul PCIe, ce qui compte lorsqu’une même tâche d’entraînement est répartie sur plusieurs GPU.
La Multi-Instance GPU (MIG) peut diviser un GPU physique en tranches isolées, chacune avec sa propre mémoire et sa propre puissance de calcul, afin que plusieurs charges de travail plus petites puissent partager une carte.
Les cartes PCIe s’insèrent dans les emplacements d’extension standard des serveurs et des stations de travail, ce qui convient à un large éventail de systèmes.
Le TDP est la puissance thermique de conception nominale : la valeur de référence pour dimensionner l’alimentation et le refroidissement d’un serveur.
Voici les usages que Kovara a enregistrés pour ce composant. Les notes expliquent la charge de travail en termes généraux ; elles ne constituent pas des affirmations de performance.
Les chiffres sont des données de référence de Kovara, dernière vérification : 03 sept. 2026. Les explications décrivent la technologie de manière générale ; elles ne sont pas des benchmarks et ne disent rien du prix ni de la disponibilité.
Explorer cet accélérateur sur ComputeObservations publiques de Kovara ; elles ne constituent pas une affirmation de couverture de marché exhaustive ou universelle. Les unités de prix brutes incompatibles sont exclues.
Fourchette observée par GPU-hour
USD / GPU-hour
Écart $0.84 USD / GPU-hour
Fournisseurs représentés par les offres actuelles suivies par Kovara.
1 offre active · 1 région suivie
Publicly listed 1
3 offres actives · 1 région suivie
Self-serve first-come 3
Régions représentées par les offres actuelles ; cela ne décrit pas l’intégralité de la disponibilité mondiale.
4 offres actives · 2 fournisseurs
Configurations actuelles, disponibilité enregistrée, capacité confirmée et preuves à l’appui de chaque prix.
| Provider | Région | Configuration | Disponibilité | Prix | Modèle commercial | Confiance / preuves | Action |
|---|---|---|---|---|---|---|---|
| OFR-0302Denvr Data | Unspecified, Multiple / Unspecified | NVIDIA A100 40GB PCIeConfiguration de 4 GPU · 4 GPU par nœud | Publicly listedCapacité confirmée : Non confirmé | $1.15 USD / GPU-hourPrix d’origine : USD 1.15 GPU/hour | On-DemandGPU platform · Per-minute billing | Confiance AVérifié il y a 10 joursConfirmé le 23 sept. 2026Source : SRC000038 | Examiner |
| OFR-0233Lambda | Unspecified, Multiple / Unspecified | NVIDIA A100 40GB PCIeConfiguration de 1 GPU · 1 GPU par nœud | Self-serve first-comeCapacité confirmée : Non confirmé | $1.99 USD / GPU-hourPrix d’origine : USD 1.99 GPU/hour | On-DemandGPU instance · Hourly | Confiance AVérifié il y a 11 joursConfirmé le 23 sept. 2026Source : SRC000017 | Examiner |
| OFR-0234Lambda | Unspecified, Multiple / Unspecified | NVIDIA A100 40GB PCIeConfiguration de 2 GPU · 2 GPU par nœud | Self-serve first-comeCapacité confirmée : Non confirmé | $1.99 USD / GPU-hourPrix d’origine : USD 1.99 GPU/hour | On-DemandGPU instance · Hourly | Confiance AVérifié il y a 11 joursConfirmé le 23 sept. 2026Source : SRC000017 | Examiner |
| OFR-0235Lambda | Unspecified, Multiple / Unspecified | NVIDIA A100 40GB PCIeConfiguration de 4 GPU · 4 GPU par nœud | Self-serve first-comeCapacité confirmée : Non confirmé | $1.99 USD / GPU-hourPrix d’origine : USD 1.99 GPU/hour | On-DemandGPU instance · Hourly | Confiance AVérifié il y a 11 joursConfirmé le 23 sept. 2026Source : SRC000017 | Examiner |
Attributs matériels enregistrés. Non suivi est une valeur distincte de Non.
Preuves publiques et signaux de confiance à l’appui de la couverture suivie par Kovara.