
Noleggiare un server GPU per il rendering: nodo dedicato o cloud a consumo
Panoramica
Introduzione
Se state cercando come noleggiare un server GPU per il rendering, probabilmente avete già superato i limiti di una singola workstation e state scegliendo tra due modi radicalmente diversi di acquistare potenza di calcolo: pagare per frame su una cloud render farm condivisa, oppure noleggiare hardware GPU dedicato e gestire la vostra coda di lavoro. Sono entrambe opzioni reali sulla nostra farm, e non si tratta dello stesso prodotto con un prezzo diverso.
Negli ultimi anni abbiamo costruito la nostra flotta CPU, che resta ancora la maggior parte di ciò che gestiamo. Ma il lato GPU è cresciuto molto più rapidamente dei contenuti dedicati ad esso. Di recente abbiamo attivato un nuovo gruppo di nodi RTX 5090, con 32 GB di VRAM ciascuno e ray tracing hardware, e finora la maggior parte di quanto abbiamo pubblicato su di essi riguarda benchmark e dati sulle prestazioni. Quello che è mancato è la domanda che conta davvero al momento dell'acquisto: cosa significa realmente noleggiare un server GPU da noi, cosa ottenete in cambio, e quando noleggiare un nodo dedicato ha più senso che pagare per frame.
Questo articolo è la risposta a questa domanda. Analizzeremo entrambi i modelli, esamineremo gli schemi di carico di lavoro che tendono a favorire l'uno o l'altro, e presenteremo i numeri reali in modo che possiate capire quale strada si adatta meglio al vostro progetto.

Confronto tra rendering cloud a consumo e noleggio di cluster GPU dedicato: modello di accesso, unità di fatturazione, impegno minimo
Cosa significa davvero «noleggiare un server GPU»
«Noleggiare un server GPU» comprende due tipi di accordo diversi, e confonderli è la fonte più comune di sorprese da entrambe le parti.
Il primo è il rendering cloud a consumo (per-frame), ciò che la maggior parte delle persone intende con «cloud render farm». Caricate una scena, inviate un job e pagate solo la potenza di calcolo effettivamente consumata dal vostro job, fatturata secondo la metrica propria del render engine (OctaneBench-ora per la GPU, GHz-ora per la CPU). Condividete la flotta sottostante con altri clienti, ma il vostro job viene assegnato ai nodi GPU disponibili. Non c'è hardware fisso assegnato a voi né una spesa minima oltre a quanto ricaricate sul vostro account. Questo è il rendering cloud GPU nel senso convenzionale del termine.
Il secondo è il noleggio di un server GPU dedicato, talvolta chiamato noleggio di cluster o noleggio in stile IaaS. In questo caso noleggiate nodi GPU fisici specifici, in genere coppie di RTX 5090, per un periodo fisso (una settimana o un mese, con termini più lunghi disponibili). L'hardware è vostro per tutta la durata: gestite la vostra coda di job, il vostro invio al render manager, e non condividete la priorità di pianificazione con nessun altro. La fatturazione è una tariffa fissa per nodo per periodo, non per frame renderizzato. A conteggi di nodi più piccoli, questa è la nostra offerta di noleggio di render farm, che pubblica tariffe settimanali fisse per nodo consultabili direttamente sulla pagina, e ne abbiamo trattato una versione a nodo singolo nel nostro approfondimento sul server RTX 5090 dedicato, se volete confrontare prima una configurazione più piccola. Oltre quella dimensione, la stessa idea diventa un cluster GPU dedicato completo, che viene quotato per singolo progetto anziché letto da un listino, perché a quella scala il networking edge, lo storage condiviso e l'isolamento dei tenant vengono predisposti appositamente per voi. Le tariffe in questo articolo sono quelle pubblicate per nodo; un impegno a livello di cluster è una conversazione, non una tabella.
Nessuno dei due modelli è «migliore» in astratto. Sono costruiti per schemi di utilizzo diversi, e lo schema di carico di lavoro qui sotto è un buon esempio di quando il secondo è la scelta giusta.
L'hardware: cosa ottenete davvero su un nodo GPU dedicato
Ogni nodo GPU che noleggiamo, sia a consumo che dedicato, gira sullo stesso livello hardware: NVIDIA RTX 5090, 32 GB di VRAM per scheda, con ray tracing hardware accelerato tramite OptiX. Nel prodotto di noleggio dedicato, un «nodo» corrisponde a due schede RTX 5090, quindi un noleggio a nodo singolo vi dà due schede complete su cui pianificare i vostri job.
Quel valore di VRAM conta più di quanto la maggior parte delle persone si aspetti all'inizio. Scene complesse, in particolare interni di archviz con librerie di asset pesanti o shot VFX con cache di simulazione dense, possono raggiungere il limite di VRAM prima di raggiungere il limite di calcolo. Abbiamo approfondito nel dettaglio dove emerge questo limite nella nostra analisi del limite di VRAM, se questo è un aspetto rilevante per le vostre scene.
I render engine GPU supportati sulla nostra flotta sono Redshift, Octane, V-Ray GPU, Arnold GPU e (come due engine separati, non uno) Cycles ed EEVEE (GPU) di Blender. EEVEE-Next esegue il rendering headless sui nostri nodi GPU come engine di produzione completo, non come semplice modalità di anteprima da viewport. Le licenze dei render engine seguono un unico catalogo su entrambi i modelli di fatturazione: sia il noleggio a consumo che quello dedicato includono la stessa copertura di licenza per Redshift, Octane, V-Ray e Arnold, e il noleggio dedicato non estende quel catalogo con nulla in più. Cycles ed EEVEE sono gratuiti e open source, quindi restano fuori dal discorso licenze in entrambi i casi. Avete bisogno di un engine fuori da quel catalogo? Portate la vostra licenza, oppure chiedete al nostro team operativo di aggiungerlo. Se volete i numeri grezzi delle prestazioni della flotta RTX 5090, li abbiamo pubblicati separatamente nei nostri dati sulle prestazioni di rendering cloud RTX 5090.
Quando un carico di lavoro costante indica il noleggio dedicato
Il modo più chiaro per capire quando il noleggio dedicato batte quello a consumo è lo schema del carico di lavoro, non un numero da titolo. Una produzione che ha bisogno di un throughput GPU costante lungo l'intero ciclo non ha nulla a che vedere con una che invia solo una manciata di job occasionali tra una scadenza e l'altra, anche se il totale delle ore di rendering finisce per essere simile.
Lo schema che tende a giustificare il noleggio dedicato: il rendering gira in modo continuo per settimane anziché a raffiche brevi, i cicli di revisione si sovrappongono a nuove scene così che la coda resta raramente inattiva, e un calendario di consegna in cui aspettare dietro al job di qualcun altro in una coda condivisa è un costo reale, non solo un fastidio. Cicli di produzione archviz costanti, lavoro continuativo su shot VFX, e qualsiasi pipeline che gestisce il proprio render manager su un budget hardware fisso tendono ad adattarsi a questo schema.
Per un carico di lavoro di questo tipo, una tariffa settimanale fissa per nodo fa due cose che la fatturazione a consumo non può fare: mette un tetto alla fattura indipendentemente da quanto spingete l'hardware in quella settimana, e vi dà una priorità di pianificazione esclusiva invece di condividere la posizione in coda con altri clienti. Il compromesso vale anche nell'altro senso: pagate per il nodo indipendentemente dal fatto che sia utilizzato al massimo ogni ora del periodo di noleggio, ed è esattamente per questo che il noleggio dedicato conviene solo quando il carico di lavoro è davvero costante e non solo occasionalmente pesante.
Questo è lo schema da tenere d'occhio nella vostra decisione: se il vostro carico di lavoro è costante e prevedibile anziché a raffiche, e se il tempo di coda inattivo o la priorità di pianificazione condivisa rappresentano un costo reale per la vostra produzione, il noleggio dedicato inizia ad avere più senso rispetto al pagamento a consumo nel momento in cui la vostra spesa mensile a consumo si avvicinerebbe alla stessa fascia di una tariffa fissa per nodo.
A consumo o dedicato: come cambia davvero la fatturazione
Ecco la differenza concreta in numeri, usando le nostre tariffe pubblicate.
Rendering GPU a consumo: fatturato a $0,003 per OctaneBench-ora (OBh), che corrisponde a circa $5,20 per ora-scheda su una RTX 5090. I nuovi account ricevono $25 di credito di partenza gratuito per testare il flusso prima di ricaricare. Non c'è alcun impegno minimo; pagate solo per quello che usate, e il credito non utilizzato non scade mai.
Noleggio di nodo dedicato: fatturato a una tariffa settimanale fissa di $1.172,50 per nodo (2× RTX 5090), contro una tariffa di listino di $1.750/nodo/settimana, quindi la tariffa pubblicata riflette uno sconto di circa il 33% sul listino. Un mese è calcolato come quattro settimane fisse, senza alcuno sconto aggiuntivo per impegno sovrapposto:
| Nodi | Tariffa settimanale | Tariffa mensile (4 settimane) |
|---|---|---|
| 1 nodo (2× RTX 5090) | $1.172,50 | $4.690 |
| 3 nodi (6× RTX 5090) | $3.517,50 | $14.070 |
| 5 nodi (10× RTX 5090) | $5.862,50 | $23.450 |
Volumi maggiori oltre i 5 nodi passano a un preventivo personalizzato anziché a una tariffa pubblicata. Per il noleggio dedicato lato CPU, il prodotto equivalente costa $60/nodo/settimana con un minimo di 5 nodi, anche se si tratta di un'offerta separata rispetto al noleggio di nodi GPU discusso qui.
Il calcolo che conta davvero per la vostra decisione: stimate il vostro consumo mensile realistico di OctaneBench-ora con il prezzo a consumo, e confrontatelo con la tariffa fissa per nodo indicata sopra. Se la vostra fattura prevista a consumo si attesta costantemente sopra la fascia dedicata equivalente, e il vostro carico di lavoro non ha lunghi periodi di inattività, il noleggio dedicato è l'opzione più economica e prevedibile. Se il vostro utilizzo è irregolare, stagionale, o non siete ancora sicuri di quanto tempo GPU serva realmente alla vostra pipeline, il modello a consumo vi evita di pagare per hardware inattivo.
Come si confronta con il noleggio di GPU altrove
Un punto di riferimento concreto, dato che «noleggio di server GPU» copre una fascia di prezzo molto ampia. iRender pubblica $8,20 all'ora per una singola workstation RTX 4090 ($7,38 da tre ore in su), $15/ora per due schede e $30/ora per quattro. La nostra tariffa GPU a consumo di $0,003/OBh corrisponde a circa $5,20 per ora-scheda su RTX 5090, su una scheda di una generazione più recente che porta 32 GB di VRAM contro i 24 GB della 4090. Entrambe le cifre sono le tariffe pubblicate direttamente dai rispettivi fornitori, verificate ad agosto 2026; controllate i prezzi attuali su entrambi i siti prima di fare i vostri calcoli su questi numeri.
L'unità di fatturazione conta quanto la tariffa stessa. Un noleggio a ora-macchina misura l'orologio, che include il tempo di upload, la configurazione della scena, l'iterazione di look-dev, un viewport bloccato, e qualsiasi ora in cui la macchina è rimasta riservata ma inattiva. La fatturazione a OctaneBench-ora misura il lavoro effettivamente svolto. Quindi $5,20 è un tetto massimo che presuppone che la scheda renderizzi a pieno regime per un'ora intera, mentre una tariffa oraria a macchina è un minimo che non presuppone nulla sull'utilizzo effettivo. Su una workstation noleggiata, il divario tra questi due valori è di solito dove si nasconde la vera differenza di costo.
Dove il confronto va nell'altro senso, ed è bene saperlo prima di scegliere: iRender vende fino a quattro schede in un'unica macchina, mentre il nostro limite per nodo è due. Per un singolo frame fisso molto pesante che scala su più schede all'interno di un'unica macchina, vince avere più schede in un'unica macchina, e la VRAM non si somma tra le schede su nessuna delle due piattaforme. La nostra struttura prevede molti nodi a due schede che renderizzano frame in parallelo, il che si adatta bene ad animazione e throughput di coda costante piuttosto che a un singolo frame fisso enorme.
Quando il noleggio dedicato ha senso (e quando no)
Alcuni segnali pratici da verificare prima di impegnarvi in una delle due strade:
Il noleggio dedicato è adatto quando:
- Il vostro carico di lavoro GPU è costante lungo settimane o mesi, non a raffiche occasionali.
- Avete bisogno di priorità di pianificazione e non potete tollerare la contesa in coda con altri clienti.
- Il vostro team gestisce già il proprio render management (Deadline, o equivalente) e vuole puntarlo su hardware fisso anziché su un flusso di lavoro basato su upload.
- Volete una spesa settimanale o mensile prevedibile e pianificabile anziché una fatturazione variabile in base all'utilizzo.
- La vostra spesa prevista a consumo supererebbe già la tariffa fissa per nodo equivalente nella maggior parte dei mesi.
Il rendering cloud a consumo è adatto quando:
- Le vostre esigenze di rendering sono irregolari, legate a singoli progetti o ancora in fase di crescita.
- Volete testare il rendering GPU con un impegno minimo prima di scalare.
- Non volete gestire la vostra infrastruttura di coda di rendering.
- Il vostro utilizzo mensile di ore GPU è ben al di sotto di quanto costerebbe un nodo dedicato.
Se non siete sicuri su quale lato ricadete, il calcolo di fatturazione qui sopra è un modo rapido per verificarlo: stimate le vostre OctaneBench-ora mensili, moltiplicate per $0,003, e confrontate quel numero con la tabella delle tariffe per nodo. Abbiamo scritto anche un confronto più completo e dettagliato nel nostro confronto tra SaaS e cluster dedicato, se volete la versione più approfondita di questa decisione, e nei nostri dati sulle prestazioni del cluster multi-nodo, se state scalando oltre un singolo nodo e volete vedere come si comporta davvero il throughput.

Costo mensile del rendering a consumo al 33% e al 100% di utilizzo, rispetto alla tariffa mensile fissa per 1, 3 e 5 nodi
Come funzionano davvero l'accesso e l'onboarding
Per il rendering a consumo, l'accesso è interamente basato su web e Client App: caricate la vostra scena tramite l'interfaccia web, la nostra Client App, oppure SFTP per progetti di grandi dimensioni, inviate il job e scaricate l'output al termine. Non c'è alcun passaggio di desktop remoto e nulla da installare lato rendering.
Per il noleggio di nodo dedicato, l'onboarding è diverso perché l'hardware è realmente vostro per la durata del noleggio. Predisponiamo il nodo (o i nodi) e vi consegniamo l'accesso remoto tramite Moonlight abbinato a Sunshine come host di streaming su ciascun nodo, incanalato attraverso WireGuard. Non si tratta di RDP: Sunshine usa la codifica hardware NVENC direttamente sulla GPU per comprimere il flusso video, e il client di Moonlight è ottimizzato specificamente per carichi di lavoro 3D e GPU, offrendo una latenza bassa e costante per l'interazione con il viewport, invece del profilo di latenza generico da desktop remoto che tende a peggiorare con questo tipo di utilizzo. In pratica, questo significa che guidate la macchina più o meno come guidereste una workstation: installate i vostri plugin con licenza, puntate il vostro render manager sui nodi, e mantenete la struttura del progetto esistente, su una connessione costruita per il lavoro su GPU anziché per l'uso generico da desktop remoto. Poiché la flotta funziona con strumenti basati su GUI anziché su un'API o un SDK pubblici, qualsiasi automazione di cui la vostra pipeline ha bisogno va costruita sull'accesso al nodo che vi forniamo, non su un endpoint API ospitato, dato che al momento non ne offriamo uno. Se la vostra pipeline dipende dall'invio programmatico dei job, verificate i dettagli con il nostro team di supporto prima di impegnarvi in un periodo di noleggio.
Qualunque sia il modello che utilizzate, entrambi attingono alla stessa infrastruttura di noleggio di render farm, ed entrambi includono lo stesso catalogo di licenze per gli engine (V-Ray, Redshift, Octane, Arnold GPU), quindi passare dall'uno all'altro in seguito non significa dover reimparare una toolchain diversa. Il noleggio dedicato non aggiunge alcun engine oltre a quel catalogo; Cycles ed EEVEE sono gratuiti e open source in entrambi i casi, e qualsiasi cosa fuori dal catalogo richiede una licenza propria o una richiesta al team operativo.
Cosa verificare prima di impegnarvi
Un breve elenco da percorrere prima di sottoscrivere uno dei due modelli:
- Margine di VRAM: verificate la vostra scena più pesante rispetto al limite di 32 GB per scheda, specialmente se lavorate con interni archviz densi o shot VFX pesanti in simulazione.
- Prevedibilità dell'utilizzo: costante e regolare indica il dedicato; a raffiche e occasionale indica il consumo.
- Dipendenze della pipeline: se il render management del vostro studio presuppone già hardware dedicato che controlla completamente, il flusso di upload del modello a consumo potrebbe comportare modifiche alla pipeline.
- Struttura del budget: fissa e prevedibile (dedicato) contro variabile in base all'utilizzo (a consumo); scegliete quella che il vostro processo finanziario preferisce davvero.
- Durata dell'impegno: il noleggio dedicato è prezzato per settimana/mese; il credito a consumo non scade mai, quindi è il punto di partenza a minor impegno se non siete sicuri.
Riepilogo: dedicato o a consumo a colpo d'occhio
| Cloud a consumo | Noleggio di nodo dedicato | |
|---|---|---|
| Unità di fatturazione | Per OctaneBench-ora ($0,003) | Tariffa fissa per nodo a settimana ($1.172,50/nodo) |
| Impegno minimo | Nessuno (il credito non scade mai) | Termine settimanale/mensile |
| Pianificazione | Coda condivisa, priorità standard | Prioritaria (l'hardware è esclusivamente vostro) |
| Accesso | Upload web, Client App, SFTP | Accesso al nodo tramite Moonlight/Sunshine su WireGuard; gestite la vostra coda e i vostri strumenti |
| Più adatto a | Utilizzo irregolare, legato a progetti, in fase di test | Carichi di lavoro costanti, prevedibili, ad alto volume |
FAQ
Q: Qual è la differenza tra noleggiare un server GPU e usare una render farm a consumo? A: Noleggiare un server GPU (noleggio di nodo dedicato) vi dà hardware esclusivo per un termine fisso, settimanale o mensile, fatturato a tariffa fissa indipendentemente da quanto renderizzate. Una render farm a consumo condivide la flotta tra i clienti e fattura solo la potenza di calcolo effettivamente consumata dal vostro job, senza impegno minimo.
Q: Quanta VRAM ha una GPU RTX 5090 noleggiata? A: Ogni scheda RTX 5090 porta 32 GB di VRAM, e un nodo di noleggio dedicato include due schede. I due pool non si sommano: 32 GB per scheda è il limite entro cui deve rientrare ogni singolo frame, e la seconda scheda non lo alza. Ciò che la coppia vi offre sono due frame renderizzati contemporaneamente, non un frame con più memoria. Se la vostra scena non entra in 32 GB, aggiungere schede non è la soluzione.
Q: Qual è l'impegno minimo per noleggiare un nodo GPU dedicato? A: Il noleggio di nodo è fatturato per nodo a settimana, con tariffe mensili calcolate come quattro settimane fisse, e le fasce pubblicate partono da un singolo nodo. I volumi maggiori escono dal listino verso un preventivo su misura, che è una conversazione diversa con una propria definizione del perimetro, non solo un numero più grande nella stessa tabella.
Q: Posso usare il mio software di render management su un server GPU noleggiato? A: Sì. Nel noleggio dedicato, il nodo è vostro per la durata del noleggio, quindi il vostro team installa e configura qualsiasi render manager e strumento di invio dei job già in uso nel vostro studio. Il rendering a consumo, al contrario, passa attraverso il nostro flusso di lavoro basato su upload anziché sulla vostra coda.
Q: Esiste un'API per automatizzare i job di noleggio server GPU? A: Al momento non offriamo un'API o un SDK pubblici per il rendering. L'accesso avviene tramite l'interfaccia web, la Client App, oppure l'accesso diretto al nodo per i noleggi dedicati. Se la vostra pipeline richiede l'invio programmatico dei job, contattate il supporto prima di impegnarvi in un periodo di noleggio per verificare cosa è fattibile per la vostra configurazione.
Q: Quali render engine funzionano sulla flotta di noleggio GPU RTX 5090? A: Redshift, Octane, V-Ray GPU, Arnold GPU e (come due engine separati) Cycles ed EEVEE (GPU) di Blender girano tutti sui nodi RTX 5090. Le licenze per Redshift, Octane, V-Ray e Arnold sono incluse in entrambi i modelli di fatturazione, dallo stesso catalogo; il noleggio dedicato non estende quel catalogo con nulla in più. Cycles ed EEVEE sono gratuiti e open source in entrambi i casi. Avete bisogno di un engine fuori da questo elenco? Portate la vostra licenza o chiedete al nostro team operativo.
Q: Il noleggio GPU dedicato è più economico del rendering cloud a consumo? A: Dipende dal vostro volume di utilizzo. Stimate il vostro consumo mensile di OctaneBench-ora, moltiplicate per $0,003, e confrontatelo con la tariffa fissa per nodo (a partire da $1.172,50/nodo/settimana). Se la vostra fattura prevista a consumo supera regolarmente la fascia dedicata equivalente, e il vostro carico di lavoro è costante anziché a raffiche, il noleggio dedicato risulta più economico e prevedibile.
Q: Devo noleggiare un cluster completo, o posso noleggiare un singolo nodo GPU? A: Un singolo nodo (due schede RTX 5090) è l'unità di noleggio minima pubblicata, con un prezzo di $1.172,50/settimana, e le fasce pubblicate salgono da lì a 3 e 5 nodi. Non avete bisogno di un impegno a livello di cluster per noleggiare un nodo. I volumi maggiori escono dal listino pubblicato verso un preventivo su misura, definito come una conversazione anziché una riga più grande nella stessa tabella.
About Richard Ta
Richard Ta is co-founder and technical lead of Super Renders Farm (superrendersfarm.com), a fully managed cloud render farm that supports Maya, 3ds Max, Cinema 4D, Blender, and Houdini across the major render engines. He has spent over a decade building and running large-scale CPU and GPU render infrastructure for studios in more than 50 countries.


