GPU Cloud

Alquila el silicio. El runtime es tuyo.

Instancias GPU con control total en NVIDIA RTX PRO 6000 Blackwell Server Edition: 96 GB GDDR7, imágenes listas para CUDA, los mismos primitivos de red y cobro que Cloud Compute.

Para quién es

Entrenamiento y fine-tuning

Loops de entrenamiento propios, stacks de experimento y frameworks que instalas tú.

Inferencia self-hosted

vLLM, TensorRT-LLM o tu propia capa de serving, en Linux con CUDA.

HPC y compute visual

Simulación científica, render 3D y visualización que necesita memoria de GPU de verdad.

Plataforma e IA agéntica

Runtimes de agentes, pipelines y pools GPU multi-tenant bajo tu control.

Qué te llevas

Acceso root completo

Entra por SSH como root. Instala drivers, frameworks y stacks de serving a tu manera.

96 GB GDDR7

Memoria ECC en RTX PRO 6000 Blackwell Server Edition para modelos y escenas grandes.

Imágenes listas para CUDA

Imágenes Linux de GPU con CUDA, o un SO base si llevas tu propia stack.

MIG hasta 4

Parte una GPU en instancias aisladas, con memoria y compute dedicados.

La misma stack que Compute

VPC, security groups, IP pública y privada, y la misma factura que el resto de la plataforma.

Por GPU-hora

Medidor por hora en el host GPU. Apagas la instancia, se detiene el cobro.

NVIDIA RTX PRO 6000 Blackwell Server Edition

IA y computación visual para el data center: el mismo silicio Blackwell Server Edition que NVIDIA posiciona para IA agéntica, compute científico, render y media.

Blackwell

Arquitectura

NVIDIA RTX PRO 6000 Server Edition

96 GB

Memoria de GPU

GDDR7 con ECC

1,597 GB/s

Ancho de banda de memoria

Interfaz de memoria de 512 bits

Up to 4

MIG

Instancias GPU aisladas

De la configuración al aire

Elegir región

Miami (US1) en el lanzamiento. Elige el data center de la carga.

Configurar instancia GPU

Plan GPU, paquete de CPU/RAM, red, security group: costo por hora antes de confirmar.

Elegir imagen

Linux listo para GPU con CUDA, o un SO base si llevas la stack.

Deploy

IP pública y privada. Gestiónala como cualquier instancia de Cloud Compute.

El precio se cierra con los SKUs

Tarifas por GPU-hora y paquetes de host se publican cuando cierran los SKUs. Mientras tanto, dimensiona el resto de la stack en la calculadora.

Respuestas cortas

¿Qué GPU es esta?

NVIDIA RTX PRO 6000 Blackwell Server Edition: 96 GB GDDR7 ECC, hasta cuatro instancias MIG, posicionada para IA universal y computación visual en el data center.

¿Tengo acceso root?

Sí. GPU Cloud es una instancia con control total, no un endpoint gestionado. Entras por SSH, instalas lo que necesitas y eres dueño del runtime.

¿En qué se diferencia de la inferencia gestionada?

GPU Cloud te alquila el silicio con root. Los productos de inferencia gestionada sirven modelos por ti. Usa GPU Cloud cuando necesitas entrenamiento a medida, fine-tuning o tu propia stack de serving.

¿Cuándo se publican las tarifas?

Las tarifas por GPU-hora y los paquetes de host se publican cuando cierran los SKUs. Hasta entonces, dimensiona storage, compute y red en la calculadora pública.

SOC 2 Tipo IIAuditado, no autodeclarado
SLA de 99,9% de disponibilidadEn el contrato
Soporte humano 24/7NOC y SOC operando
Cero tarifas de egressSin partida de tráfico en la factura

Get started

Consigue una instancia GPU con acceso root

Haz el deploy cuando abran los SKUs, o dimensiona el resto de la stack en la calculadora hoy.