Noleggio e Distribuzione di una GPU
GPUnex non è solo una piattaforma per i titolari di pacchetti GPU — è anche un marketplace di calcolo GPU completo per ingegneri AI, ricercatori e aziende che necessitano di accesso on-demand a hardware di livello enterprise. Questa guida La accompagna attraverso l’intero processo: fare domanda per l’accesso come noleggiatore, selezionare un modello GPU, scegliere un piano tariffario, distribuire la Sua istanza e connettersi ad essa.
Faccia Domanda
Invii la Sua domanda come noleggiatore con i dettagli del caso d'uso
Ottenga l'Approvazione
Domanda esaminata entro 24-48 ore
Scelga GPU e Distribuisca
Selezioni hardware, framework e avvii la Sua istanza
Si Connetta via SSH
Acceda alla Sua istanza GPU con pieni privilegi root
Faccia Domanda
Invii la Sua domanda come noleggiatore con i dettagli del caso d'uso
Ottenga l'Approvazione
Domanda esaminata entro 24-48 ore
Scelga GPU e Distribuisca
Selezioni hardware, framework e avvii la Sua istanza
Si Connetta via SSH
Acceda alla Sua istanza GPU con pieni privilegi root
Fare Domanda per l’Accesso come Noleggiatore
L’accesso al noleggio GPU richiede una domanda approvata. Questo passaggio di verifica garantisce la qualità del servizio per tutti i partecipanti del marketplace e aiuta GPUnex ad abbinarLa all’hardware giusto per il Suo carico di lavoro.
Istruzioni Passo Passo
-
Navighi alla sezione Noleggiatore cliccando “Noleggia GPU” nella barra laterale, oppure vada alla pagina Ruoli e selezioni il ruolo Noleggiatore.
-
Clicchi “Fai Domanda per Noleggiare GPU” per aprire il modulo di domanda.
-
Compili la domanda con i seguenti dettagli:
Informazioni Personali / Aziendali:
- Nome completo (obbligatorio)
- Indirizzo email (obbligatorio)
- Nome azienda (opzionale — anche i privati sono benvenuti a fare domanda)
Dettagli del Caso d’Uso:
- Descrizione del caso d’uso — Descriva per cosa prevede di utilizzare il calcolo GPU (ad es. addestramento di un modello linguistico di grandi dimensioni, esecuzione di carichi di lavoro di inferenza, rendering, simulazione scientifica)
Requisiti GPU:
- Modello GPU preferito — Selezioni tra i modelli disponibili (H100, A100, L40S, L4)
- Quantità — Quante GPU necessita (singola GPU o configurazioni multi-GPU)
- Requisiti VRAM — VRAM minima necessaria per il Suo carico di lavoro
- Modello di utilizzo — Utilizzo continuo, a raffica o periodico
- Regione preferita — Selezioni la Sua regione del data center UE preferita per la latenza più bassa
Budget e Tempistiche:
- Budget mensile stimato in USDC
- Tempistica — Quando deve iniziare (immediatamente, entro una settimana, entro un mese)
Domanda Noleggiatore GPU
-
Verifichi la Sua domanda per accuratezza e completezza.
-
Clicchi “Invia” per inviare la domanda per la revisione.
Revisione della Domanda
- Le domande vengono esaminate entro 24-48 ore nei giorni lavorativi.
- Riceverà una notifica email quando la Sua domanda sarà approvata.
- Una volta approvato, ottiene accesso completo al marketplace di noleggio GPU e può distribuire istanze immediatamente.
Modelli GPU Disponibili
GPUnex offre una gamma di GPU NVIDIA per data center per soddisfare diversi requisiti di carico di lavoro e budget.
NVIDIA H100 80GB
La GPU per data center più potente per addestramento e ricerca su larga scala.
- Memoria HBM3 da 80GB
- Addestramento e inferenza ad alto throughput
- Fino a 8x multi-GPU con NVLink
NVIDIA A100 40/80GB
Standard del settore per addestramento e fine-tuning AI.
- Memoria HBM2e da 40-80GB
- Addestramento, inferenza e fine-tuning
- Configurazioni multi-GPU
NVIDIA L40S 48GB
Eccellente per rendering, inferenza e addestramento su scala media.
- Memoria GDDR6 da 48GB
- Rendering e inferenza
- Grafica + calcolo
NVIDIA L4 24GB
Efficiente in termini di costi per inferenza, elaborazione batch e addestramento leggero.
- Memoria GDDR6 da 24GB
- Inferenza e elaborazione batch
- Miglior costo-per-inferenza
Configurazioni Multi-GPU
Per carichi di lavoro che richiedono più calcolo di quanto una singola GPU possa fornire, GPUnex supporta configurazioni multi-GPU:
- Fino a 8x NVIDIA H100 GPU in un singolo nodo
- Interconnessione NVLink per comunicazione GPU-to-GPU ad alta larghezza di banda all’interno di un nodo
- Rete InfiniBand per cluster multi-nodo
- Ideale per addestramento distribuito di modelli di grandi dimensioni, serving di inferenza su larga scala e ricerca che richiede parallelismo massiccio
Scelta della GPU Giusta
Utilizzi le seguenti linee guida per selezionare l’hardware appropriato:
- Addestramento di modelli linguistici di grandi dimensioni (>7B parametri): H100 80GB o A100 80GB, multi-GPU consigliato
- Fine-tuning di modelli pre-addestrati: A100 40GB o A100 80GB a seconda della dimensione del modello
- Serving di inferenza in produzione: L40S 48GB o L4 24GB per inferenza efficiente in termini di costi; H100 per applicazioni critiche in termini di latenza
- Rendering e visualizzazione: L40S 48GB offre eccellenti prestazioni grafiche e di calcolo
- Elaborazione batch e inferenza leggera: L4 24GB fornisce il miglior costo-per-inferenza per modelli più piccoli
Modelli di Prezzo
GPUnex offre tre modelli di prezzo per adattarsi a diversi modelli di utilizzo e requisiti di budget.
On-Demand
- Fatturazione: Al secondo, si paga solo per ciò che si utilizza
- Impegno: Nessuno — avvio e arresto in qualsiasi momento
- Flessibilità: Piena flessibilità per scalare verso l’alto o verso il basso istantaneamente
- Ideale per: Sperimentazione, carichi di lavoro variabili, progetti a breve termine
Riservato
- Impegno: Giorni, settimane o mesi
- Sconto: Fino al 40% di sconto rispetto al prezzo On-Demand
- Capacità: Garantita — la Sua GPU riservata è sempre disponibile durante il periodo di impegno
- Ideale per: Sessioni di addestramento continue, inferenza in produzione, carichi di lavoro prevedibili
Spot
- Sconto: Fino al 70% di sconto rispetto al prezzo On-Demand
- Preemption: Le istanze possono essere reclamate con un avviso di 30 secondi quando la domanda aumenta
- Auto-checkpoint: Il sistema attiva automaticamente un salvataggio checkpoint quando viene emesso un avviso di preemption, minimizzando il lavoro perso
- Ideale per: Carichi di lavoro tolleranti ai guasti, elaborazione batch, lavori di addestramento non critici in termini di tempo, sperimentazione attenta al budget
On-Demand
Paghi al secondo con zero impegno. Avvio e arresto in qualsiasi momento.
- Fatturazione al secondo
- Nessun impegno richiesto
- Piena flessibilità di scaling
- Ideale per sperimentazione
Riservato
Si impegni per giorni, settimane o mesi e risparmi significativamente.
- Fino al 40% di sconto
- Capacità garantita
- Prezzi prevedibili
- Ideale per carichi di produzione
Spot
Istanze fortemente scontate che possono essere reclamate quando la domanda aumenta.
- Fino al 70% di sconto
- Avviso preemption 30 secondi
- Auto-checkpoint alla preemption
- Ideale per lavori tolleranti ai guasti
Distribuzione di un’Istanza
Una volta approvata la Sua domanda come noleggiatore, può distribuire istanze GPU dal marketplace.
Istruzioni Passo Passo
-
Navighi al Marketplace GPU dalla Sua dashboard.
-
Cerchi e filtri l’inventario disponibile utilizzando i seguenti criteri:
- Modello GPU (H100, A100, L40S, L4)
- VRAM (24GB, 40GB, 48GB, 80GB)
- Regione (selezioni la posizione del data center UE preferita)
- Fascia di prezzo (filtri per tariffa oraria)
- Modello di prezzo (On-Demand, Riservato o Spot)
-
Selezioni una GPU dai risultati della ricerca. Clicchi sull’annuncio per vedere i dettagli completi incluse specifiche, prezzi, disponibilità e posizione del data center.
-
Scelga il Suo ambiente software. Selezioni tra framework preconfigurati o fornisca il Suo:
Framework preinstallati:
- PyTorch — Ultima versione stabile con supporto CUDA
- TensorFlow — Ultima versione stabile con accelerazione GPU
- JAX — Framework ML ad alte prestazioni
- Jupyter — Ambiente JupyterLab preconfigurato con le librerie ML comuni
Ambiente personalizzato:
- Fornisca un’immagine Docker personalizzata da qualsiasi registro container pubblico o privato
- Specifichi l’URL dell’immagine e le eventuali variabili d’ambiente richieste
Suggerimento
Tutte le istanze sono preinstallate con PyTorch, TensorFlow, JAX o Jupyter. Può anche portare la Sua immagine Docker da qualsiasi registro container pubblico o privato.
-
Configuri le impostazioni dell’istanza:
- Nome dell’istanza (per Suo riferimento)
- Chiave pubblica SSH (per accesso sicuro)
- Script di avvio (opzionale — viene eseguito automaticamente quando l’istanza si avvia)
- Variabili d’ambiente (opzionale)
-
Verifichi e distribuisca. Confermi la selezione GPU, il modello di prezzo, l’ambiente software e la configurazione. Clicchi “Distribuisci” per avviare la Sua istanza.
-
Attenda il provisioning. Il Suo container verrà distribuito e una connessione SSH sarà disponibile entro pochi secondi dopo aver cliccato Distribuisci.
Connessione via SSH
Una volta che la Sua istanza è in esecuzione, riceverà i dettagli di connessione nella pagina di gestione dell’istanza:
- L’indirizzo IP, la porta e il nome utente sono forniti nel pannello dettagli dell’istanza.
- Utilizzi la chiave privata corrispondente alla chiave pubblica SSH che ha fornito durante la distribuzione.
- Avrà accesso root all’interno del container.
Gestione della Sua Istanza
Dalla pagina di gestione dell’istanza, può:
- Avviare / Fermare l’istanza per mettere in pausa la fatturazione (solo On-Demand)
- Monitorare l’utilizzo GPU, l’uso della memoria e le metriche di calcolo in tempo reale
- Visualizzare i log dei Suoi processi in esecuzione
- Terminare l’istanza quando ha finito
Storage Persistente
GPUnex fornisce storage persistente collegato alla rete indipendente dal ciclo di vita della Sua istanza GPU.
Caratteristiche Principali
- Sopravvive ai riavvii. I Suoi dati rimangono intatti quando ferma e riavvia un’istanza.
- Collegabile a nuove istanze. Se termina un’istanza e ne distribuisce una nuova, può collegare il Suo volume di storage esistente alla nuova istanza. Tutti i Suoi dati, checkpoint dei modelli, dataset e codice sono preservati.
- Persistenza dei dati. Il Suo volume di storage persiste fino a quando non lo elimina esplicitamente, indipendentemente da cosa succede alle Sue istanze di calcolo.
Casi d’Uso per lo Storage Persistente
- Conservare dataset di addestramento che utilizza attraverso più sessioni di addestramento
- Salvare checkpoint dei modelli per poter riprendere l’addestramento dopo interruzioni (particolarmente importante per le istanze Spot)
- Mantenere repository di codice e ambienti di sviluppo attraverso i cambi di istanza
- Conservare log degli esperimenti e risultati per progetti di ricerca a lungo termine
Ottenere Aiuto
Supporto Standard
Tutti i noleggiatori hanno accesso al sistema di supporto GPUnex per problemi tecnici, domande sulla fatturazione e assistenza generale. Contatti il supporto attraverso la sezione apposita nella Sua dashboard.
Supporto Enterprise
I clienti enterprise e i team con distribuzioni più grandi ricevono supporto aggiuntivo:
- Gestione account dedicata con un punto di contatto nominativo
- Supporto prioritario con tempi di risposta più rapidi
- Configurazioni cluster personalizzate adattate ai Suoi requisiti specifici di carico di lavoro
- Prezzi a volume per distribuzioni su larga scala
- Garanzie SLA per uptime e prestazioni
Ha Bisogno di una Soluzione Personalizzata?
Per configurazioni cluster personalizzate, distribuzioni multi-nodo, accordi di capacità riservata o prezzi enterprise, il nostro team vendite è pronto ad aiutarLa. Che necessiti di un cluster H100 dedicato o di un’infrastruttura su misura, possiamo costruire la soluzione giusta per il Suo carico di lavoro.
Contatti il Team Vendite per discutere i Suoi requisiti e ottenere un preventivo personalizzato.
Prossimi Passi
- Riferimento API — Integri la gestione GPU di GPUnex nei Suoi script e pipeline di automazione
- Come Funzionano i Pacchetti GPU — Scopra il lato investitore del marketplace GPUnex
- Contatti il Team Vendite — Ci contatti per soluzioni enterprise, configurazioni personalizzate e prezzi a volume