Nube de GPU NVIDIA dedicadas
NVIDIA GB300 NVL72
Capacidad para modelos MoE e IA de razonamiento
Crea tu infraestructura de IA con NVIDIA GB300 NVL72, hardware dedicado, red de alta velocidad y una reserva adaptada a tu proyecto.
Memoria por GPU
288 GB HBM3e/GPU- Qué incluye el nodo
- Rack completo o medio · refrigeración líquida
- Conexión entre nodos
- Quantum-X800 XDR entre racks
Tu configuración dedicada
Dentro de tu clúster GB300 NVL72
- Memoria por GPU
- 288 GB HBM3e/GPU · 20.7 TB por rack
- Conexión entre GPUs
- Dominio NVLink 5 coherente de 72 GPUs
- Conexión entre nodos
- Quantum-X800 XDR entre racks
- Qué incluye el nodo
- Rack completo o medio · refrigeración líquida
Precios y reservas de GB300 NVL72
Configuración y precio por rack, a consultar
Precios en USD por hora de nodo HGX de 8 GPUs; los sistemas rack-scale se cotizan por rack. Impuestos no incluidos. Gestión de Slurm y Kubernetes incluida. Almacenamiento y Direct Connect según las tarifas anteriores. Consulta las condiciones para contratos a largo plazo.
Ver todos los precios ↗Planifica tu capacidad de GPU
¿Es GB300 NVL72 la opción adecuada para tu modelo?
Empieza por los requisitos de tu proyecto y después compara la configuración y el costo de la reserva.
Considera GB300 NVL72 cuando tu modelo y tu estrategia de paralelismo requieren una configuración a escala de rack. Planifica memoria, energía, refrigeración y comunicación en conjunto y confirma la configuración exacta en tu propuesta.
Dimensionamiento de inferencia: guía de optimización de vLLM ↗Qué incluir en tu solicitud de propuesta
- Modelo y aplicación: entrenamiento, ajuste fino o inferencia.
- Precisión, longitud de contexto, tamaño de lote y usuarios simultáneos.
- Cantidad de GPUs, tamaño de los datos, almacenamiento y red.
- Plazo de reserva, fecha de inicio y criterios de éxito.
Compara memoria y precios de reserva
| GPU | Memoria por GPU | Plazo mensual | Plazo anual |
|---|---|---|---|
| HGX B300 | 288 GB HBM3e | desde $83,20 | desde $58,50 |
| HGX B200 | 180 GB HBM3e | desde $72,80 | desde $50,70 |
| HGX H200 | 141 GB HBM3e | desde $44,20 | desde $31,20 |
| HGX H100 | 80 GB HBM3 | desde $28,60 | desde $19,50 |
Precios en USD por hora para un nodo completo de 8 GPUs. La capacidad de memoria por sí sola no determina el rendimiento. La capacidad final, disponibilidad y condiciones se confirman en la propuesta.
Recibir mi propuesta ↗¿El precio es por GPU o por nodo?
Los precios publicados de HGX son en USD por hora de un nodo completo con 8 GPU, dentro de una reserva mensual o anual. Los sistemas NVL72 se cotizan por rack. Los impuestos no están incluidos.
¿Qué GPU NVIDIA debo elegir para mi proyecto de IA?
Compara la memoria de la GPU, los requisitos de red y la carga de entrenamiento o inferencia. La sección de hardware presenta H100, H200, B200, B300 y sistemas de rack completo. Nuestro equipo te ayuda a dimensionar la configuración según el modelo, los datos y la capacidad necesaria.
¿Puedo usar el clúster para entrenamiento, fine-tuning e inferencia?
Sí. TensorBay ofrece infraestructura dedicada de GPU NVIDIA para entrenamiento de modelos, fine-tuning e inferencia. Puedes trabajar con Slurm, Kubernetes o SSH y configurar el entorno de software para tu carga de trabajo.
¿Qué ocurre después de solicitar una cotización?
Indica la GPU, la capacidad y el plazo de reserva, o describe tu proyecto. El equipo revisa los requisitos y prepara una propuesta en un plazo de 48 horas, con configuración y fecha de entrega. La capacidad y las condiciones finales se confirman en la propuesta.
08Demos escala a tu idea
El próximo salto de tu IA empieza con una conversación.
Cuéntanos tu reto. Nuestro equipo te ayuda a definir las GPUs, la capacidad y los plazos. Recibe una propuesta en 48 horas para lanzar tu proyecto o llevarlo más lejos.
- Configuración alineada con tu proyecto
- Propuesta con plazo de entrega
- Pruebas de aceptación antes de empezar