L'intera scheda, in passthrough.
Non una porzione, non un time-share, non MIG. La GPU compare sul bus PCIe e nient'altro al mondo vi viene pianificato sopra.
Schede intere, passate direttamente alla Sua macchina. Nessuna coda, nessuno scheduler, nessun vicino, e nessun contatore che gira mentre Lei riflette.
Dimensionare il server
RTX 6000 Ada
3 configurazioni
| Piano | GPU | CPU | Memoria | Archiviazione | Rete | Pronto in | Prezzo | Ordine |
|---|---|---|---|---|---|---|---|---|
| RTX 4000 Ada Inferenza, rendering, fine-tuning di modelli di piccole dimensioni | RTX 4000 Ada · 20 GB | Ryzen 7 7700 · 8c/16t | 64 GB DDR5 | 2 × 1 TB Gen4 NVMe | 1 Gbps illimitato | ~15 min | $229$183/mo | Configurare RTX 4000 Ada |
| RTX 6000 Ada Modelli da 48 GB, pipeline video | RTX 6000 Ada · 48 GB | EPYC 7302P · 16c/32t | 128 GB DDR4 ECC | 2 × 2 TB Gen4 NVMe | 1 Gbps illimitato | ~15 min | $549$439/mo | Configurare RTX 6000 Ada |
| L40S Training, inferenza batch su larga scala | L40S · 48 GB | EPYC 7443P · 24c/48t | 256 GB DDR4 ECC | 2 × 3.84 TB Gen4 NVMe | 10 Gbps illimitati | ~15 min | $749$599/mo | Configurare L40S |
Ogni configurazione: GPU intera in passthrough · IPMI · 1 IPv4 · IPv6 /64 instradato · filtraggio DDoS permanente · porta senza limiti di traffico · API completa. Gli chassis multi-scheda vengono quotati per singola macchina — lo richieda, li assembliamo.
La trappola oraria
Il prezzo orario della GPU è pensato per i picchi, e quasi nessuno ha picchi. Se la scheda è occupata per più di un terzo del tempo, una macchina mensile costa meno — e smette di far pagare le ore passate a leggere i log.
L'intera scheda, in passthrough.
Non una porzione, non un time-share, non MIG. La GPU compare sul bus PCIe e nient'altro al mondo vi viene pianificato sopra.
Nessuna coda e nessuna prelazione.
Il carico di lavoro del cliente inizia quando lo avvia e finisce quando termina. Nessuno viene sfrattato perché è arrivato qualcuno con un budget più grande.
48 GB dove serve davvero.
Le RTX 6000 Ada e L40S dispongono di 48 GB ciascuna — sufficienti per un modello che altrimenti richiederebbe lo sharding, il quale di solito costa più della scheda stessa.
La scelta dei driver spetta al cliente.
Consegniamo bare metal e un'ISO a scelta del cliente. Versione CUDA, kernel, container runtime — fissati dal cliente, non da una piattaforma che si aggiorna secondo i propri tempi.
Nessun upsell
Nessun piano IP protetto, nessun addebito per snapshot, nessun piano di supporto da acquistare.
L'intera macchina
Un solo tenant. Nient'altro si avvia su di essa, nient'altro tocca i dischi, nient'altro condivide il controller di memoria.
IPMI, non un ticket di assistenza
Controllo completo out-of-band: alimentazione, console, virtual media. Reinstallazione alle tre del mattino senza chiedere permesso a nessuno.
IPv4 + un /64 instradato
Un IPv4 incluso, un /29 su richiesta, e un intero /64 di IPv6. Il reverse DNS è impostabile liberamente.
Filtraggio DDoS
Scrubbing di livello 3/4 a monte della porta, attivo per impostazione predefinita, senza costi aggiuntivi e senza nulla da abilitare.
Reinstallare o caricare una ISO
Venti immagini pronte all'uso, oppure è possibile montarne una propria e osservarne l'avvio tramite la console. Nulla sopravvive a una cancellazione completa.
Chiavi API e SSH
Ordinare, reinstallare, riavviare e distruggere dal proprio codice. Chiavi installate alla consegna, accesso con password disattivato.
Prima di ordinare
Per tutto il resto, il supporto risponde in pochi minuti — e dice no chiaramente quando la risposta è no.
Apra un ticketPer inferenza e rendering sotto i 20 GB, la RTX 4000 Ada. Per modelli da 48 GB o video pesanti, la RTX 6000 Ada. Per training prolungato e inferenza batch, la L40S — più banda di memoria e uno chassis con CPU e NVMe adeguati ad alimentarla.
Sì, il preventivo è per chassis. Dica al supporto quanti e quali modelli, e se ha bisogno di NVLink — la risposta a quest'ultima domanda è di solito no, e glielo diremo apertamente invece di venderLe la configurazione più costosa.
Sì. Le schede si trovano in macchine già installate in rack, testate e pronte; l'ordine attiva una cancellazione e una reinstallazione. Ciò che richiede tempo è il memory training e il POST su uno chassis di queste dimensioni, non il tempo che impiega qualcuno per raggiungere il rack.
Si applicano le stesse due eccezioni di tutto il resto del sito, e nient'altro — veda come vengono gestite le segnalazioni. Non ispezioniamo ciò che gira sulla sua macchina e non abbiamo alcun interesse a farlo.
Il resto della gamma
Stessa giurisdizione, stessa rete, stesso rifiuto di chiedere chi si è. Si differenziano per l'unica cosa indicata nel rispettivo titolo.
Pronto quando lo desidera
Non serve un account per vedere tutti i prezzi, non serve un'identità per ordinare. Con 229 $ al mese ottiene un server che nessuno può convincerci a spegnere.