A placa inteira, em passthrough.
Não é uma fatia, não é time-share, não é MIG. A GPU aparece no barramento PCIe e absolutamente nada mais é agendado nela.
Placas inteiras, passadas diretamente para a máquina. Sem fila, sem escalonador, sem vizinho, e sem medidor rodando enquanto se pensa.
Dimensione o servidor
RTX 6000 Ada
3 configurações
| Plano | GPU | CPU | Memória | Armazenamento | Rede | Pronto em | Preço | Pedido |
|---|---|---|---|---|---|---|---|---|
| RTX 4000 Ada Inferência, renderização, ajuste fino de modelos pequenos | RTX 4000 Ada · 20 GB | Ryzen 7 7700 · 8c/16t | 64 GB DDR5 | 2 × 1 TB Gen4 NVMe | 1 Gbps sem limite | ~15 min | $229$183/mo | Configurar RTX 4000 Ada |
| RTX 6000 Ada Modelos de 48 GB, pipelines de vídeo | RTX 6000 Ada · 48 GB | EPYC 7302P · 16c/32t | 128 GB DDR4 ECC | 2 × 2 TB Gen4 NVMe | 1 Gbps sem limite | ~15 min | $549$439/mo | Configurar RTX 6000 Ada |
| L40S Treinamento, inferência em lote em escala | L40S · 48 GB | EPYC 7443P · 24c/48t | 256 GB DDR4 ECC | 2 × 3.84 TB Gen4 NVMe | 10 Gbps sem limite | ~15 min | $749$599/mo | Configurar L40S |
Toda configuração: GPU inteira em passthrough · IPMI · 1 IPv4 · IPv6 /64 roteado · filtragem de DDoS permanente · porta sem limite de tráfego · API completa. Chassis com múltiplas placas são cotados por máquina — basta pedir, nós montamos.
A armadilha da cobrança por hora
O preço de GPU por hora é pensado para picos, e quase ninguém tem picos. Se a placa fica ocupada mais de um terço do tempo, uma máquina mensal sai mais barata — e deixa de cobrar pelas horas gastas na leitura de logs.
A placa inteira, em passthrough.
Não é uma fatia, não é time-share, não é MIG. A GPU aparece no barramento PCIe e absolutamente nada mais é agendado nela.
Sem fila e sem preempção.
O trabalho começa quando é iniciado e termina quando termina. Nada expulsa o cliente porque alguém com orçamento maior apareceu.
48 GB onde importa.
A RTX 6000 Ada e a L40S trazem 48 GB cada — suficiente para armazenar um modelo que, de outra forma, precisaria de sharding, o que geralmente custa mais que a placa.
Os drivers ficam a critério do cliente.
Entregamos bare metal e uma ISO à escolha do cliente. Versão do CUDA, kernel, runtime de containers — fixados pelo cliente, não por uma plataforma que se atualiza no próprio cronograma.
Sem upsells
Nenhum plano de IP protegido, nenhuma cobrança por snapshot, nenhum plano de suporte para comprar.
A máquina inteira
Um inquilino. Nada mais inicializa nela, nada mais toca nos discos, nada mais compartilha o controlador de memória.
IPMI, não um chamado de suporte
Controle completo fora de banda: energia, console, mídia virtual. Reinstale às três da manhã sem precisar pedir permissão a ninguém.
IPv4 + um /64 roteado
Um IPv4 incluído, um /29 sob solicitação, e um /64 inteiro de IPv6. O DNS reverso fica livre para configurar.
Filtragem de DDoS
Scrubbing de camada 3/4 antes da porta, ativado por padrão, sem custo e sem nada a habilitar.
Reinstalar ou usar uma ISO própria
Vinte imagens prontas, ou é possível montar uma própria e acompanhar a inicialização pelo console. Nada sobrevive a uma limpeza completa.
Chaves de API e SSH
Pedir, reinstalar, reiniciar e destruir a partir de código próprio. Chaves instaladas na entrega, login por senha desativado.
Antes de pedir
Para qualquer outra coisa, o suporte responde em minutos — e diz não claramente quando a resposta é não.
Abrir um chamadoPara inferência e renderização abaixo de 20 GB, a RTX 4000 Ada. Para modelos de 48 GB ou vídeo pesado, a RTX 6000 Ada. Para treinamento contínuo e inferência em lote, a L40S — mais largura de banda de memória e um chassi com CPU e NVMe para mantê-la alimentada.
Sim, com orçamento por chassi. Informe ao suporte a quantidade, o modelo e se é necessário NVLink — a resposta a essa última pergunta costuma ser não, e isso será dito com honestidade, em vez de vender a configuração mais cara.
Sim. As placas ficam em máquinas em rack já testadas e prontas; o pedido dispara uma limpeza e uma reinstalação. O que leva tempo é o treinamento de memória e o POST em um chassi desse tamanho, não alguém caminhando até um rack.
Aplicam-se as mesmas duas exceções válidas em todo o restante do site, e nada além disso — veja como as reclamações são tratadas. Não inspecionamos o que é executado na máquina do cliente, e não há interesse algum em fazê-lo.
O restante da linha
Mesma jurisdição, mesma rede, mesma recusa em perguntar quem é o cliente. Diferem apenas naquilo que dá nome a cada título.
Pronto quando você estiver
Sem conta para ver preços, sem identidade para pedir. Por 229 $/mês, um servidor que ninguém nos convence a desligar.