GPU Cloud

Alugue o silício. O runtime é seu.

Instâncias de GPU com controle total em NVIDIA RTX PRO 6000 Blackwell Server Edition: 96 GB GDDR7, imagens prontas para CUDA, os mesmos primitivos de rede e cobrança do Cloud Compute.

Para quem é

Treino e fine-tuning

Loops de treino próprios, stacks de experimento e frameworks que você instala.

Inferência self-hosted

vLLM, TensorRT-LLM ou a sua camada de serving, em Linux com CUDA.

HPC e compute visual

Simulação científica, render 3D e visualização que precisa de memória de GPU de verdade.

Plataforma e IA agêntica

Runtimes de agentes, pipelines e pools de GPU multi-tenant sob o seu controle.

O que você leva

Acesso root completo

Entre via SSH como root. Instale drivers, frameworks e stacks de serving do seu jeito.

96 GB GDDR7

Memória ECC na RTX PRO 6000 Blackwell Server Edition para modelos e cenas grandes.

Imagens prontas para CUDA

Imagens Linux de GPU com CUDA, ou um SO base se você leva a própria stack.

MIG até 4

Divida uma GPU em instâncias isoladas, com memória e compute dedicados.

A mesma stack do Compute

VPC, security groups, IP público e privado, e a mesma fatura do resto da plataforma.

Por GPU-hora

Medidor por hora no host de GPU. Desligou a instância, parou a cobrança.

NVIDIA RTX PRO 6000 Blackwell Server Edition

IA e computação visual para o data center: o mesmo silício Blackwell Server Edition que a NVIDIA posiciona para IA agêntica, compute científico, render e mídia.

Blackwell

Arquitetura

NVIDIA RTX PRO 6000 Server Edition

96 GB

Memória de GPU

GDDR7 com ECC

1,597 GB/s

Bandwidth de memória

Interface de memória de 512 bits

Up to 4

MIG

Instâncias de GPU isoladas

Da configuração ao ar

Escolher região

Miami (US1) no lançamento. Escolha o data center da carga.

Configurar instância de GPU

Plano de GPU, pacote de CPU/RAM, rede, security group: custo por hora antes de confirmar.

Escolher imagem

Linux pronto para GPU com CUDA, ou um SO base se você leva a stack.

Deploy

IP público e privado. Gerencie como qualquer instância de Cloud Compute.

Preço fecha com os SKUs

Tarifas por GPU-hora e pacotes de host saem quando os SKUs fecham. Enquanto isso, dimensione o resto da stack na calculadora.

Respostas curtas

Qual GPU é essa?

NVIDIA RTX PRO 6000 Blackwell Server Edition: 96 GB GDDR7 ECC, até quatro instâncias MIG, posicionada para IA universal e computação visual no data center.

Eu tenho acesso root?

Sim. GPU Cloud é uma instância com controle total, não um endpoint gerenciado. Você entra via SSH, instala o que precisa e é dono do runtime.

Qual a diferença para inferência gerenciada?

GPU Cloud aluga o silício com root. Produtos de inferência gerenciada servem modelos por você. Use GPU Cloud quando precisar de treino customizado, fine-tuning ou da sua própria stack de serving.

Quando as tarifas são publicadas?

Tarifas por GPU-hora e pacotes de host saem quando os SKUs fecham. Até lá, dimensione storage, compute e rede na calculadora pública.

SOC 2 Tipo IIAuditado, não autodeclarado
SLA de 99,9% de disponibilidadeNo contrato
Suporte humano 24/7NOC e SOC operando
Zero taxa de egressSem linha de tráfego na fatura

Get started

Pegue uma instância de GPU com acesso root

Faça o deploy quando os SKUs abrirem, ou dimensione o resto da stack na calculadora hoje.