Nube de GPU NVIDIA dedicadas
NVIDIA HGX B300
Más memoria para grandes modelos e inferencia
Crea tu infraestructura de IA con NVIDIA HGX B300, hardware dedicado, red de alta velocidad y una reserva adaptada a tu proyecto.
Memoria por GPU
288 GB HBM3e- Qué incluye el nodo
- 8 GPU · 30 TB NVMe · 2 TB RAM
- Conexión entre nodos
- Quantum-X800 XDR 800G
Tu configuración dedicada
Dentro de tu clúster HGX B300
- Memoria por GPU
- 288 GB HBM3e · 8 TB/s
- Conexión entre GPUs
- NVLink 5 · 1.8 TB/s por GPU
- Conexión entre nodos
- Quantum-X800 XDR 800G
- Qué incluye el nodo
- 8 GPU · 30 TB NVMe · 2 TB RAM
Precios y reservas de HGX B300
USD por hora, nodo completo con 8 GPU
Precios en USD por hora de nodo HGX de 8 GPUs; los sistemas rack-scale se cotizan por rack. Impuestos no incluidos. Gestión de Slurm y Kubernetes incluida. Almacenamiento y Direct Connect según las tarifas anteriores. Consulta las condiciones para contratos a largo plazo.
Ver todos los precios ↗Planifica tu capacidad de GPU
¿Es HGX B300 la opción adecuada para tu modelo?
Empieza por los requisitos de tu proyecto y después compara la configuración y el costo de la reserva.
Considera B300 cuando la memoria limita tu modelo, la longitud del contexto o el tamaño del lote. Compara con B200 usando el mismo modelo, precisión y configuración de inferencia antes de elegir tu reserva.
Dimensionamiento de inferencia: guía de optimización de vLLM ↗Qué incluir en tu solicitud de propuesta
- Modelo y aplicación: entrenamiento, ajuste fino o inferencia.
- Precisión, longitud de contexto, tamaño de lote y usuarios simultáneos.
- Cantidad de GPUs, tamaño de los datos, almacenamiento y red.
- Plazo de reserva, fecha de inicio y criterios de éxito.
Compara memoria y precios de reserva
| GPU | Memoria por GPU | Plazo mensual | Plazo anual |
|---|---|---|---|
| HGX B300 | 288 GB HBM3e | desde $83,20 | desde $58,50 |
| HGX B200 | 180 GB HBM3e | desde $72,80 | desde $50,70 |
| HGX H200 | 141 GB HBM3e | desde $44,20 | desde $31,20 |
| HGX H100 | 80 GB HBM3 | desde $28,60 | desde $19,50 |
Precios en USD por hora para un nodo completo de 8 GPUs. La capacidad de memoria por sí sola no determina el rendimiento. La capacidad final, disponibilidad y condiciones se confirman en la propuesta.
Recibir mi propuesta ↗¿El precio es por GPU o por nodo?
Los precios publicados de HGX son en USD por hora de un nodo completo con 8 GPU, dentro de una reserva mensual o anual. Los sistemas NVL72 se cotizan por rack. Los impuestos no están incluidos.
¿Qué GPU NVIDIA debo elegir para mi proyecto de IA?
Compara la memoria de la GPU, los requisitos de red y la carga de entrenamiento o inferencia. La sección de hardware presenta H100, H200, B200, B300 y sistemas de rack completo. Nuestro equipo te ayuda a dimensionar la configuración según el modelo, los datos y la capacidad necesaria.
¿Puedo usar el clúster para entrenamiento, fine-tuning e inferencia?
Sí. TensorBay ofrece infraestructura dedicada de GPU NVIDIA para entrenamiento de modelos, fine-tuning e inferencia. Puedes trabajar con Slurm, Kubernetes o SSH y configurar el entorno de software para tu carga de trabajo.
¿Qué ocurre después de solicitar una cotización?
Indica la GPU, la capacidad y el plazo de reserva, o describe tu proyecto. El equipo revisa los requisitos y prepara una propuesta en un plazo de 48 horas, con configuración y fecha de entrega. La capacidad y las condiciones finales se confirman en la propuesta.
08Demos escala a tu idea
El próximo salto de tu IA empieza con una conversación.
Cuéntanos tu reto. Nuestro equipo te ayuda a definir las GPUs, la capacidad y los plazos. Recibe una propuesta en 48 horas para lanzar tu proyecto o llevarlo más lejos.
- Configuración alineada con tu proyecto
- Propuesta con plazo de entrega
- Pruebas de aceptación antes de empezar