# Panoramica dei server GPU

Source: https://support.kapsulehost.com/it-it/gpu-servers-overview

I server GPU sono macchine bare-metal single-tenant dotate di acceleratori NVIDIA, dimensionate per l'addestramento di IA, l'inferenza e il rendering. Questa guida copre i quattro livelli, come funzionano effettivamente l'ordine e la consegna, cosa copre il costo di configurazione e come gestire una macchina GPU una volta che è attiva.

## Che cos'è un server GPU

Un server GPU è una macchina fisica dedicata con uno o più GPU NVIDIA, più la CPU, la memoria di sistema e l'archiviazione veloce necessaria per alimentarli. L'intera macchina è tua: nessun altro condivide gli acceleratori, la larghezza di banda PCIe o i dischi.

Installi il tuo stack e lo esegui come preferisci. I carichi di lavoro CUDA, PyTorch, TensorFlow, JAX e i soliti framework di serving funzionano esattamente come funzionerebbero su qualsiasi box Linux bare-metal, perché è esattamente quello che è.

Il motivo per cui si vuole single tenancy qui non è solo la performance. I carichi di lavoro GPU tendono a girare a pieno regime per ore, e gli acceleratori condivisi si comportano molto diversamente sotto quel tipo di carico sostenuto rispetto a come si comportano in un benchmark.

## I quattro livelli

| Livello | GPU | Memoria GPU | RAM di sistema |
|---|---|---|---|
| Spark | NVIDIA RTX 4000 | 20 GB | Configurazione entry |
| Forge | NVIDIA RTX PRO 6000 | 96 GB | 256 GB |
| Foundry | NVIDIA RTX PRO 6000 | 96 GB | 512 GB |
| Reactor | NVIDIA RTX PRO 6000 | 96 GB | 768 GB |

Spark è il punto di ingresso: memoria GPU sufficiente per modelli più piccoli, fine-tuning, inferenza e lavori di rendering. Forge, Foundry e Reactor condividono lo stesso acceleratore e aumentano la memoria di sistema intorno ad esso, che è quello che conta quando stai preparando set di dati di grandi dimensioni o mantenendo diversi modelli in memoria host.

Ogni livello è venduto sia non gestito che gestito. Non gestito ti fornisce root e ti lascia il sistema operativo. Gestito mantiene lo stesso hardware con i nostri ingegneri sul livello software. Vedi [Server Cloud gestiti e non gestiti](https://support.kapsulehost.com/it-it/cloud-servers-managed-vs-unmanaged).

Per i prezzi attuali nella tua valuta, apri **Store** in KPanel, quindi la scheda **GPU Compute**.

## Scelta di un livello

Inizia dal modello, non dal prezzo.

- **Quanta memoria GPU richiede il tuo modello nella forma in cui lo stai eseguendo?** Questo è il vincolo duro. Se i pesi più le attivazioni non rientrano, nessuna quantità di RAM di sistema aiuta.
- **Stai addestrando o servendo?** L'addestramento consuma molta memoria ed è long-running. L'inferenza è spesso limitata dalla velocità con cui riesci a ottenere dati sulla GPU, ed è qui che la RAM di sistema e il disco contano di più.
- **Quanto è grande il tuo working set?** Se stai streamando un set di dati che non rientra nella memoria host, le configurazioni Foundry e Reactor esistono esattamente per questo motivo.

Se non sei sicuro, raccontaci cosa stai eseguendo, la dimensione del modello, il framework e quanta memoria GPU pensi di aver bisogno. Ti indicheremo il livello giusto piuttosto che farti acquistare più del necessario. [Server di calcolo GPU e AI](https://support.kapsulehost.com/it-it/cloud-servers-gpu) ha di più sul lato del carico di lavoro.

## Come funziona effettivamente l'ordine

L'hardware GPU è scarso e costoso, quindi il processo è deliberatamente non one-click.

1. Accedi a [KPanel](https://kpanel.kapsulehost.com).
2. Fai clic su **Store** nella barra laterale sinistra.
3. In **Servers**, fai clic sulla scheda **GPU Compute**.
4. Passa tra **Unmanaged** e **Managed** e scegli un livello.
5. Completa il checkout.

![I livelli GPU nella pagina dei piani di calcolo in KPanel, con l'interruttore Unmanaged e Managed](https://support.kapsulehost.com/help/screenshots/gpu-servers-overview.65000b19.webp)

Dopo il checkout ricevi un'email di riconoscimento dell'ordine, e il nostro team conferma la capacità attuale e la compilazione prima che l'hardware ti sia allocato.

> **Warning:** Un server GPU non viene provisioned nel momento in cui paghi. La capacità è confermata prima dal nostro team, e non pubblichiamo un tempo di consegna fisso perché la disponibilità cambia. Se una scadenza è importante, chiedici del livello che desideri prima di ordinare piuttosto che dopo.

Sentirai da noi comunque. Se hai pagato e non hai ricevuto un follow-up che ti aspettavi, rispondi all'email di riconoscimento o apri un ticket da **Support** e ti diremo esattamente dove si trova l'ordine.

## Costo di configurazione e fatturazione

I server GPU comportano un costo di configurazione una tantum in aggiunta al prezzo mensile, in comune con i server dedicati e di archiviazione, perché una macchina fisica viene costruita e consegnata. I server cloud non comportano alcun costo di configurazione.

Il costo di configurazione è addebitato una sola volta, non si ripete mai e viene mostrato separatamente dal prezzo mensile al checkout.

> **Note:** I prezzi sono mostrati escludendo la GST. Se la valuta del tuo account è NZD, il 15 percento di GST viene aggiunto al checkout e appare nel totale del pulsante di pagamento. Vedi [Prezzi dei server cloud e GST](https://support.kapsulehost.com/it-it/cloud-servers-pricing-gst).

Poiché un livello GPU è un impegno mensile su hardware costoso piuttosto che un affitto orario, considera la decisione di conseguenza. Se hai bisogno di una GPU solo per un breve scoppio, diccelo quando parli con noi.

## Prenotazione di un livello

Quando un livello non ha capacità, la scheda del piano offre una prenotazione piuttosto che un'azione di configurazione. Unirti alla coda registra il tuo interesse in quel livello.

> **Important:** Una prenotazione è un posto in una coda, non una compilazione programmata, e non ci impegniamo a un tempo di attesa. Non c'è nemmeno un pulsante di annullamento self-service: se non desideri più una prenotazione, contatta il supporto e la rimuoveremo.

## Gestione di un server GPU

Una volta che una macchina GPU è attiva viene gestita esattamente come qualsiasi altro server bare-metal, da **Server dedicati** nella barra laterale di KPanel. Non c'è un elemento GPU separato nella barra laterale.

Il toolset, documentato completamente in [Gestione di un server dedicato](https://support.kapsulehost.com/it-it/dedicated-servers-management), copre:

- **Power**: riavvio elegante, reset hardware, ciclo di alimentazione forzato e Wake-on-LAN.
- **Sistema di ripristino**: un ambiente Linux temporaneo o una console virtuale basata su browser.
- **DNS inverso**: record PTR per ogni IP instradato.
- **IP e subnet**: cosa è instradato alla macchina, più IPv4 aggiuntivi.
- **Traffic**: volume in ingresso e in uscita per giorno, mese o anno.
- **Firewall**: un filtro upstream applicato prima che il traffico raggiunga la macchina.
- **Advanced**: una reinstallazione completa del sistema operativo, dietro una conferma digitata.

L'accesso alla console per una macchina che non si avvia è in [Accesso alla console del server dedicato](https://support.kapsulehost.com/it-it/dedicated-servers-console).

## Note pratiche prima di iniziare

**I driver sono tuoi su una macchina non gestita.** Installa il driver NVIDIA e lo stack CUDA che corrisponde alle versioni del framework che intendi eseguire, e fissale. Le versioni non corrispondenti del driver e del toolkit sono la causa più comune di una GPU presente ma inutilizzabile.

**Fai attenzione al tuo disco.** I checkpoint dei modelli e i set di dati riempiono un disco più velocemente di qualsiasi altra cosa su un server. Se la capacità è il tuo vero problema piuttosto che il calcolo, un [server di archiviazione](https://support.kapsulehost.com/it-it/storage-servers-overview) insieme alla macchina GPU è solitamente più economico di un livello GPU più grande.

**Proteggilo adeguatamente con firewall.** Un box GPU che esegue un endpoint di inferenza è un bersaglio interessante. Usa il firewall upstream per consentire solo ciò che ha bisogno di raggiungerlo, e mantieni **Consenti servizi della piattaforma** attivato così non ti blocchi.

**La reinstallazione cancella tutto.** L'azione di reinstallazione in **Advanced** cancella ogni disco senza annullamento e non fa backup per te. Copia prima i tuoi checkpoint.

## Come ottenere aiuto

GPU è il prodotto dove parlare con noi per primo fa risparmiare più denaro. Chiedi a Kora dentro KPanel, apri un ticket da **Support** o invia un'email a [support@kapsulehost.com](mailto:support@kapsulehost.com) con ciò che stai eseguendo e quanta memoria GPU ti serve.

Per il resto della gamma di calcolo, vedi [Panoramica dei server cloud](https://support.kapsulehost.com/it-it/cloud-servers-overview) e [Panoramica dei server dedicati](https://support.kapsulehost.com/it-it/dedicated-servers-overview).
