Nube de GPU NVIDIA dedicadas

NVIDIA HGX B300

Más memoria para grandes modelos e inferencia

Crea tu infraestructura de IA con NVIDIA HGX B300, hardware dedicado, red de alta velocidad y una reserva adaptada a tu proyecto.

Memoria por GPU

288 GB HBM3e
Qué incluye el nodo
8 GPU · 30 TB NVMe · 2 TB RAM
Conexión entre nodos
Quantum-X800 XDR 800G

Tu configuración dedicada

Dentro de tu clúster HGX B300

Memoria por GPU
288 GB HBM3e · 8 TB/s
Conexión entre GPUs
NVLink 5 · 1.8 TB/s por GPU
Conexión entre nodos
Quantum-X800 XDR 800G
Qué incluye el nodo
8 GPU · 30 TB NVMe · 2 TB RAM
Red y almacenamiento ↗

Precios y reservas de HGX B300

USD por hora, nodo completo con 8 GPU

Plazo mensual

desde $83,20

Cotizar mensual

Plazo anual

desde $58,50

Cotizar anual

Precios en USD por hora de nodo HGX de 8 GPUs; los sistemas rack-scale se cotizan por rack. Impuestos no incluidos. Gestión de Slurm y Kubernetes incluida. Almacenamiento y Direct Connect según las tarifas anteriores. Consulta las condiciones para contratos a largo plazo.

Ver todos los precios ↗

Planifica tu capacidad de GPU

¿Es HGX B300 la opción adecuada para tu modelo?

Empieza por los requisitos de tu proyecto y después compara la configuración y el costo de la reserva.

Considera B300 cuando la memoria limita tu modelo, la longitud del contexto o el tamaño del lote. Compara con B200 usando el mismo modelo, precisión y configuración de inferencia antes de elegir tu reserva.

Dimensionamiento de inferencia: guía de optimización de vLLM ↗

Qué incluir en tu solicitud de propuesta

  • Modelo y aplicación: entrenamiento, ajuste fino o inferencia.
  • Precisión, longitud de contexto, tamaño de lote y usuarios simultáneos.
  • Cantidad de GPUs, tamaño de los datos, almacenamiento y red.
  • Plazo de reserva, fecha de inicio y criterios de éxito.

Compara memoria y precios de reserva

Configuraciones HGX publicadas por TensorBay, de la generación más nueva a la más antigua
GPUMemoria por GPUPlazo mensualPlazo anual
HGX B300288 GB HBM3edesde $83,20desde $58,50
HGX B200180 GB HBM3edesde $72,80desde $50,70
HGX H200141 GB HBM3edesde $44,20desde $31,20
HGX H10080 GB HBM3desde $28,60desde $19,50

Precios en USD por hora para un nodo completo de 8 GPUs. La capacidad de memoria por sí sola no determina el rendimiento. La capacidad final, disponibilidad y condiciones se confirman en la propuesta.

Recibir mi propuesta ↗

Preguntas frecuentes

Claridad para elegir tu próximo clúster.

Hablar con un especialista
¿El precio es por GPU o por nodo?

Los precios publicados de HGX son en USD por hora de un nodo completo con 8 GPU, dentro de una reserva mensual o anual. Los sistemas NVL72 se cotizan por rack. Los impuestos no están incluidos.

¿Qué GPU NVIDIA debo elegir para mi proyecto de IA?

Compara la memoria de la GPU, los requisitos de red y la carga de entrenamiento o inferencia. La sección de hardware presenta H100, H200, B200, B300 y sistemas de rack completo. Nuestro equipo te ayuda a dimensionar la configuración según el modelo, los datos y la capacidad necesaria.

¿Puedo usar el clúster para entrenamiento, fine-tuning e inferencia?

Sí. TensorBay ofrece infraestructura dedicada de GPU NVIDIA para entrenamiento de modelos, fine-tuning e inferencia. Puedes trabajar con Slurm, Kubernetes o SSH y configurar el entorno de software para tu carga de trabajo.

¿Qué ocurre después de solicitar una cotización?

Indica la GPU, la capacidad y el plazo de reserva, o describe tu proyecto. El equipo revisa los requisitos y prepara una propuesta en un plazo de 48 horas, con configuración y fecha de entrega. La capacidad y las condiciones finales se confirman en la propuesta.

08Demos escala a tu idea

El próximo salto de tu IA empieza con una conversación.

Cuéntanos tu reto. Nuestro equipo te ayuda a definir las GPUs, la capacidad y los plazos. Recibe una propuesta en 48 horas para lanzar tu proyecto o llevarlo más lejos.

  • Configuración alineada con tu proyecto
  • Propuesta con plazo de entrega
  • Pruebas de aceptación antes de empezar
tensorbay@tensorbay.io