Fine-tuning
Il fine-tuning parte da un modello già addestrato e lo adatta ai tuoi dati. Richiede molta meno capacità di calcolo dell’addestramento da zero, il che rende interessanti i noleggi brevi e flessibili.
Che cosa conta di più
Entra in memoria
Scegli GPU con VRAM sufficiente per il modello e per lo stato dell’ottimizzatore, oppure usa metodi che risparmiano memoria cedendo un po’ di velocità in cambio di spazio.
Lavori brevi e a picchi
Le esecuzioni spesso durano da qualche ora a qualche giorno, perciò il prezzo orario e l’avvio rapido contano più dei contratti lunghi.
Rete semplice
Spesso basta un solo nodo, perciò il costo aggiuntivo di una rete di cluster di fascia alta di solito è superfluo.
Ripetibilità
Rieseguirai gli esperimenti, perciò prezzi prevedibili e un accesso semplice sono preziosi.
Una configurazione tipica
Un nodo con più GPU, o anche una sola GPU con molta memoria, a seconda delle dimensioni del modello e del metodo.
Come si acquista di solito
La scelta abituale è la capacità on-demand o a breve termine. Lo spot può andare bene se il tuo lavoro salva dei checkpoint e può riprendere.
Errori comuni
- Pagare una rete di cluster che un lavoro su un solo nodo non usa.
- Saltare i checkpoint sulla capacità interrompibile.
- Sottovalutare i costi di trasferimento e di archiviazione dei dataset.
Termini da conoscere
Questa è una guida generale, non una raccomandazione per un provider o un prezzo specifico. Controlla le offerte attuali e conferma disponibilità e condizioni con il provider.
Vuoi vedere le opzioni reali?
Guarda le offerte monitorate con le relative fonti e date, oppure chiedi a Kova di dimensionarlo per te.
