Ampere · Ampere
AceleradoresGPU0003
NVIDIA
Rubin GPU 288GB HBM4
Ainda não há oferta de mercado acompanhada. A Kovara não acompanha atualmente ofertas públicas para este acelerador.
Visão geral do acelerador
Hardware principal e ciclo de vida, a partir dos dados mestres da Kovara.
Hardware principal
- Arquitetura
- Rubin
- Geração
- Vera Rubin
- VRAM
- 288 GB
- Tipo de memória
- HBM4
- Largura de banda de memória
- 22 TB/s
- Formato
- Rack-scale / liquid-cooled module
Ciclo de vida / uso
- Uso principal
- AI training / inference / HPC
- Ano de lançamento
- 2026
- Status da geração
- Current
- Última verificação
- 03 de set. de 2026
O hardware em detalhe
O que as especificações registradas significam na prática e para que este acelerador é usado.
Especificações explicadas
Usado para AI training, inference e HPC
- VRAM
- 288 GB
- Tipo de memória
- HBM4
- Largura de banda de memória
- 22 TB/s
A HBM (High Bandwidth Memory) é empilhada em camadas e fica logo ao lado do processador, no mesmo encapsulamento. Esse caminho curto e largo é o que dá aos aceleradores com HBM sua largura de banda de memória, por isso eles costumam ser escolhidos para trabalhos limitados pela velocidade com que os dados chegam aos núcleos, como inferência de modelos grandes e simulação HPC.
A VRAM é o espaço de trabalho da placa. Os pesos do modelo, as ativações e os conjuntos de dados precisam caber nela ou ser divididos entre várias GPUs. Regra prática apenas para os pesos com precisão de 16 bits (cerca de 2 GB por bilhão de parâmetros): até aproximadamente 144 bilhões de parâmetros, antes de ativações e cache. Isto é aritmética sobre a VRAM registrada, não um benchmark.
- Arquitetura
- Rubin
- Geração
- Vera Rubin
- Ano de lançamento
- 2026
- Status do ciclo de vida
- Current
Lançamento em 2026. Os registros da Kovara a classificam como uma peça da geração atual.
- NVLink
- Suportado
- MIG
- Suportado
- Formato
- Rack-scale / liquid-cooled module
O NVLink é uma conexão direta de GPU para GPU. Onde é suportado, as GPUs do mesmo servidor podem trocar dados mais rápido do que apenas por PCIe, o que importa quando uma tarefa de treinamento é distribuída entre várias GPUs.
A Multi-Instance GPU (MIG) pode dividir uma GPU física em fatias isoladas, cada uma com sua própria memória e capacidade computacional, para que várias cargas de trabalho menores compartilhem uma placa.
- Uso principal (registrado)
- AI training / inference / HPC
Estes são os usos que a Kovara registrou para esta peça. As notas explicam a carga de trabalho em termos gerais; não são afirmações de desempenho.
- AI trainingEnsinar um modelo a partir de dados. Normalmente a fase que mais consome capacidade computacional e memória, muitas vezes distribuída entre muitas GPUs.
- inferenceExecutar um modelo treinado para responder a requisições. Capacidade de memória, latência e custo por requisição são as preocupações habituais.
- HPCSimulação científica e de engenharia, em que a precisão numérica e a largura de banda de memória importam.
Os números são dados mestres da Kovara, verificados pela última vez em 03 de set. de 2026. As explicações descrevem a tecnologia em geral; não são benchmarks e não dizem nada sobre preço ou disponibilidade.
Explore este acelerador no Compute- Pilhas de HBM4
- Die da GPU
- Interposer
- Placa
- Potência
- Entrada
- Saída
- NVLink
- GPU vizinha
- Setores MIG
Inteligência de mercado
Os preços de mercado ainda não são acompanhados para este acelerador.
A cobertura acompanhada não descreve toda a oferta do mercado nem a disponibilidade geográfica.
Explorar o Compute →Especificações técnicas
Atributos de hardware registrados. “Não acompanhado” é diferente de “Não”.
Compute
- Arquitetura
- Rubin
- Geração
- Vera Rubin
- Uso principal
- AI training / inference / HPC
Memória
- VRAM
- 288 GB
- Tipo de memória
- HBM4
- Largura de banda de memória
- 22 TB/s
Plataforma
- Formato
- Rack-scale / liquid-cooled module
- Suporte a NVLink
- Sim
- Suporte a MIG
- Sim
Ciclo de vida / uso
- Uso principal
- AI training / inference / HPC
- Ano de lançamento
- 2026
- Status da geração
- Current
- Última verificação
- 03 de set. de 2026
Dados e evidências
As evidências públicas das fontes não estão disponíveis no momento para a cobertura acompanhada pela Kovara.