Fine-tuning
Le fine-tuning part d’un modèle déjà entraîné et l’adapte à vos données. Il demande beaucoup moins de puissance de calcul qu’un entraînement à partir de zéro, ce qui rend intéressantes les locations courtes et flexibles.
Ce qui compte le plus
Tient en mémoire
Choisissez des GPU dotés de suffisamment de VRAM pour le modèle et l’état de l’optimiseur, ou recourez à des méthodes économes en mémoire qui sacrifient un peu de vitesse pour gagner de la place.
Tâches courtes, en rafales
Les exécutions durent souvent de quelques heures à quelques jours : une tarification à l’heure et un démarrage rapide comptent donc plus que des contrats longs.
Réseau simple
Un seul nœud suffit souvent ; le surcoût d’un réseau de cluster haut de gamme est donc généralement inutile.
Répétabilité
Vous relancerez des expériences : des prix prévisibles et un accès simple ont donc de la valeur.
Une configuration type
Un nœud comportant plusieurs GPU, voire un seul GPU à grande mémoire, selon la taille du modèle et la méthode.
Mode d’achat habituel
La capacité on-demand ou à court terme est le choix habituel. Le spot peut convenir si votre tâche enregistre des checkpoints et peut reprendre.
Erreurs courantes
- Payer un réseau de cluster qu’une tâche sur un seul nœud n’utilise pas.
- Omettre les checkpoints sur la capacité interruptible.
- Sous-estimer les coûts de transfert et de stockage des jeux de données.
Termes à connaître
Il s’agit d’un guide général, et non d’une recommandation portant sur un fournisseur ou un prix précis. Consultez les offres actuelles et confirmez la disponibilité et les conditions auprès du fournisseur.
Prêt à examiner des options réelles ?
Consultez les offres suivies avec leurs sources et leurs dates, ou demandez à Kova de faire le dimensionnement pour vous.
