B300
Mais memória para modelos e inferência em grande escala
- O que vem no nó
- 8 GPU · 30 TB NVMe · 2 TB RAM
- Conexão entre nós
- Quantum-X800 XDR 800G
Conhecer a configuração
Conexão entre GPUsNVLink 5 · 1,8 TB/s por GPU
Blackwell Ultra
A nuvem de GPUs para o seu próximo salto
Treine modelos mais ambiciosos. Leve sua IA à produção. Com GPUs NVIDIA dedicadas, rede de alta velocidade e um cluster desenhado para o seu negócio.
Seu ponto de partida: 8 GPUs a partir de US$ 19,50/h · reserva anual

A potência por trás de quem já transforma negócios com IA.
01Encontre sua potência
Treinamento, fine-tuning ou inferência: cada desafio pede uma configuração. Compare as opções e encontre a capacidade que faz sentido para sua equipe, seu modelo e seu orçamento.
Ver tabela de preçosMais memória para modelos e inferência em grande escala
Conexão entre GPUsNVLink 5 · 1,8 TB/s por GPU
Blackwell Ultra
Treine modelos de fronteira e execute inferência FP4
Conexão entre GPUsNVLink 5 · 1,8 TB/s por GPU
Nova geração, em preparação
Sirva modelos de contexto longo com mais memória
Treinamento e fine-tuning com foco no orçamento
Conexão entre GPUsNVLink 4 · 900 GB/s
Versatilidade para sua equipe
Preços em USD por hora de nó com 8 GPUs. Sistemas rack-scale têm cotação própria. Sujeitos à capacidade e às condições do contrato.
06Da pesquisa ao resultado
Dê aos seus modelos fundacionais a capacidade que eles exigem. Clusters reservados, rede dedicada e nós de reposição sustentam a infraestrutura dos seus treinamentos mais ambiciosos.
Explore B200, GB200 e GB300 →Adapte modelos aos dados e desafios do seu negócio. Nós dedicados de 8 GPUs e armazenamento persistente dão à equipe espaço para testar, ajustar e evoluir.
Encontre seu H100 ou H200 →Leve modelos de grande porte à produção com GPUs de alta capacidade de memória. Atenda aplicações de contexto longo com a previsibilidade de uma infraestrutura dedicada.
Conheça H200 e B300 →02A vantagem TensorBay
Cada camada do cluster foi pensada para dar à sua equipe mais controle, previsibilidade e espaço para avançar.
F-01
Execute direto no hardware, com a capacidade da máquina dedicada ao seu trabalho. Mais controle sobre o desempenho em cada etapa do projeto.
F-02
Nós, rede e armazenamento dedicados à sua operação. Sua equipe tem uma base exclusiva para treinar, experimentar e colocar a IA para trabalhar.
F-03
Seu cluster passa por 72 horas de testes de carga, memória, rede e temperatura. Você recebe os resultados e aprova a entrega com os números em mãos.
F-04
Seus drivers, seus kernels, suas ferramentas. Trabalhe com Slurm, Kubernetes ou SSH e configure o ambiente para o que seu modelo precisa.
F-05
Nós de reserva no mesmo rack e substituição prevista em SLA de 15 minutos. Uma estrutura preparada para reduzir o impacto de falhas no seu projeto.
F-06
Tarifas publicadas, medição por minuto dentro da reserva e 20 TB de saída de dados incluídos por nó a cada mês. Decida com os custos na mesa.
03Infraestrutura que sustenta sua ambição
Energia, refrigeração, GPUs e rede. Projetamos e operamos cada camada em conjunto para que sua IA tenha uma estrutura pronta para crescer.
1 GW
Capacidade de energia contratada em cinco países para sustentar a expansão da nossa infraestrutura.
PUE 1,12
Refrigeração líquida direto nos chips, em racks de 130 kW. Eficiência projetada para cargas intensivas de IA.
24.000+ GPUs
Expansão em ciclos de seis semanas, com testes de 72 horas antes de cada entrega.
97,4%
Goodput do cluster nos últimos 90 dias: a parcela de capacidade convertida em trabalho útil.
04Rede e armazenamento
Conecte GPUs, dados e armazenamento em uma infraestrutura dedicada ao seu modelo, do primeiro lote de treinamento ao último checkpoint.
Planejar meu clusterRede dedicada
InfiniBand dedicada conecta seu cluster com largura de banda para distribuir o treinamento e mover dados entre GPUs.
800Gb/s
por link InfiniBand XDR, Quantum-X800 para Blackwell
Armazenamento
NVMe local, WEKA e armazenamento compatível com S3 para carregar datasets e salvar checkpoints na escala do seu projeto.
720GB/s
de leitura agregada por pod, com WEKA dedicado
Transferência de dados
Entrada de dados e tráfego entre nós sem cobrança, com uma franquia de saída incluída para planejar sua operação.
20TB
de saída incluídos por nó, por mês
05Invista no próximo passo
Escolha o prazo da reserva, compare a capacidade e planeje seu investimento. Aqui, a conversa começa com os preços abertos.
| GPU e memória | Contrato mensalReserva por contrato mensal | Contrato anualMenor valor por hora |
|---|---|---|
NVIDIAHGX B300288 GB HBM3e por GPU | Mensal a partir de Cotar mensalUS$ 83,20/h | Anual a partir de Cotar anualUS$ 58,50/h |
NVIDIAHGX B200180 GB HBM3e por GPU | Mensal a partir de Cotar mensalUS$ 72,80/h | Anual a partir de Cotar anualUS$ 50,70/h |
NVIDIAHGX H200141 GB HBM3e por GPU | Mensal a partir de Cotar mensalUS$ 44,20/h | Anual a partir de Cotar anualUS$ 31,20/h |
NVIDIAHGX H10080 GB HBM3 por GPU | Mensal a partir de Cotar mensalUS$ 28,60/h | Anual a partir de Cotar anualUS$ 19,50/h |
O valor por hora é do nó completo com 8 GPUs. Escolha o contrato para solicitar sua cotação.
Cada detalhe na conta
Veja o que está incluído e consulte as tarifas de armazenamento, transferência de dados e rede.
Falar com um especialistaValores em USD por hora de nó HGX com 8 GPUs; sistemas rack-scale são cotados por rack. Impostos não incluídos. Gerenciamento de Slurm e Kubernetes sem custo adicional. Armazenamento e Direct Connect seguem as tarifas acima. Consulte condições para contratos de longo prazo.
Receber minha proposta07Confiança para ir além
Leve seus projetos à produção com hardware dedicado, isolamento físico e controles de acesso. Segurança faz parte da infraestrutura, desde o primeiro nó.
Escopo: compute bare-metal, fabric e storage gerenciado
Certificado, todos os sites de datacenter
BAA disponível em clusters dedicados
Região UE com residência de dados no país
Os preços publicados para HGX são em USD por hora de um nó completo com 8 GPUs, dentro de uma reserva mensal ou anual. Sistemas NVL72 têm cotação por rack. Os valores não incluem impostos.
Compare a memória da GPU, os requisitos de rede e a carga de treinamento ou inferência. A seção de hardware apresenta H100, H200, B200, B300 e sistemas de rack completo. Nossa equipe ajuda a dimensionar a configuração a partir do modelo, dos dados e da capacidade necessária.
Sim. A TensorBay oferece infraestrutura dedicada de GPUs NVIDIA para treinamento de modelos, fine-tuning e inferência. Você pode trabalhar com Slurm, Kubernetes ou SSH e configurar o ambiente de software para sua carga de trabalho.
Informe a GPU, a capacidade e o prazo da reserva, ou conte sobre seu projeto. A equipe avalia os requisitos e prepara uma proposta em até 48 horas, com configuração e prazo de entrega. A capacidade e as condições finais são confirmadas na proposta.
08Vamos dar escala à sua ideia
Traga seu desafio. Nossa equipe ajuda a definir as GPUs, a capacidade e o prazo. Em até 48 horas, você recebe uma proposta para tirar o projeto do papel ou levá-lo mais longe.