Nube de GPU NVIDIA dedicadas
NVIDIA HGX B200
Entrenamiento de modelos de frontera e inferencia FP4
Crea tu infraestructura de IA con NVIDIA HGX B200, hardware dedicado, red de alta velocidad y una reserva adaptada a tu proyecto.
Memoria por GPU
180 GB HBM3e- Qué incluye el nodo
- 8 GPU · 30 TB NVMe · 2 TB RAM
- Conexión entre nodos
- Quantum-X800 XDR 800G
Tu configuración dedicada
Dentro de tu clúster HGX B200
- Memoria por GPU
- 180 GB HBM3e · 7.7 TB/s
- Conexión entre GPUs
- NVLink 5 · 1.8 TB/s por GPU
- Conexión entre nodos
- Quantum-X800 XDR 800G
- Qué incluye el nodo
- 8 GPU · 30 TB NVMe · 2 TB RAM
Precios y reservas de HGX B200
USD por hora, nodo completo con 8 GPU
Precios en USD por hora de nodo HGX de 8 GPUs; los sistemas rack-scale se cotizan por rack. Impuestos no incluidos. Gestión de Slurm y Kubernetes incluida. Almacenamiento y Direct Connect según las tarifas anteriores. Consulta las condiciones para contratos a largo plazo.
Ver todos los precios ↗Planifica tu capacidad de GPU
¿Es HGX B200 la opción adecuada para tu modelo?
Empieza por los requisitos de tu proyecto y después compara la configuración y el costo de la reserva.
Considera B200 para un clúster Blackwell con nodos dedicados de 8 GPUs. Compara la memoria necesaria con B300 y confirma que tu framework y tus kernels admitan la precisión que quieres utilizar.
Dimensionamiento de inferencia: guía de optimización de vLLM ↗Qué incluir en tu solicitud de propuesta
- Modelo y aplicación: entrenamiento, ajuste fino o inferencia.
- Precisión, longitud de contexto, tamaño de lote y usuarios simultáneos.
- Cantidad de GPUs, tamaño de los datos, almacenamiento y red.
- Plazo de reserva, fecha de inicio y criterios de éxito.
Compara memoria y precios de reserva
| GPU | Memoria por GPU | Plazo mensual | Plazo anual |
|---|---|---|---|
| HGX B300 | 288 GB HBM3e | desde $83,20 | desde $58,50 |
| HGX B200 | 180 GB HBM3e | desde $72,80 | desde $50,70 |
| HGX H200 | 141 GB HBM3e | desde $44,20 | desde $31,20 |
| HGX H100 | 80 GB HBM3 | desde $28,60 | desde $19,50 |
Precios en USD por hora para un nodo completo de 8 GPUs. La capacidad de memoria por sí sola no determina el rendimiento. La capacidad final, disponibilidad y condiciones se confirman en la propuesta.
Recibir mi propuesta ↗¿El precio es por GPU o por nodo?
Los precios publicados de HGX son en USD por hora de un nodo completo con 8 GPU, dentro de una reserva mensual o anual. Los sistemas NVL72 se cotizan por rack. Los impuestos no están incluidos.
¿Qué GPU NVIDIA debo elegir para mi proyecto de IA?
Compara la memoria de la GPU, los requisitos de red y la carga de entrenamiento o inferencia. La sección de hardware presenta H100, H200, B200, B300 y sistemas de rack completo. Nuestro equipo te ayuda a dimensionar la configuración según el modelo, los datos y la capacidad necesaria.
¿Puedo usar el clúster para entrenamiento, fine-tuning e inferencia?
Sí. TensorBay ofrece infraestructura dedicada de GPU NVIDIA para entrenamiento de modelos, fine-tuning e inferencia. Puedes trabajar con Slurm, Kubernetes o SSH y configurar el entorno de software para tu carga de trabajo.
¿Qué ocurre después de solicitar una cotización?
Indica la GPU, la capacidad y el plazo de reserva, o describe tu proyecto. El equipo revisa los requisitos y prepara una propuesta en un plazo de 48 horas, con configuración y fecha de entrega. La capacidad y las condiciones finales se confirman en la propuesta.
08Demos escala a tu idea
El próximo salto de tu IA empieza con una conversación.
Cuéntanos tu reto. Nuestro equipo te ayuda a definir las GPUs, la capacidad y los plazos. Recibe una propuesta en 48 horas para lanzar tu proyecto o llevarlo más lejos.
- Configuración alineada con tu proyecto
- Propuesta con plazo de entrega
- Pruebas de aceptación antes de empezar