Nvidia lança memória customizada para treinar modelos gigantes de IA
A fabricante de chips apresentou a NVHBM, uma tecnologia de memória de alta velocidade feita sob medida para lidar com modelos de inteligência artificial de trilhões de parâmetros e agentes autônomos
A Nvidia lançou a NVHBM, uma memória customizada de altíssima velocidade feita para treinar e rodar modelos gigantes de inteligência artificial, com trilhões de parâmetros (valores ajustados durante o aprendizado), e agentes autônomos. A tecnologia integra memória, processamento e rede em um sistema unificado para reduzir latência e aumentar eficiência energética.

A Nvidia anunciou a NVHBM (uma memória customizada de altíssima velocidade, sigla para NVIDIA High-Bandwidth Memory), segundo informou a empresa em seu blog oficial. A tecnologia faz parte da expansão do NVLink Fusion (um sistema que conecta processadores, memória e redes em uma arquitetura integrada para IA) e foi criada especificamente para atender a demanda de modelos de inteligência artificial cada vez maiores — alguns com trilhões de parâmetros (os valores que o modelo ajusta durante o treinamento para aprender padrões nos dados).
A novidade surge em resposta a uma mudança no mercado: agentes de IA (sistemas autônomos capazes de planejar e executar tarefas sem supervisão constante) e modelos gigantes estão deixando de ser experimentos para se tornarem aplicações reais. Nesses casos, o gargalo já não é apenas a velocidade de processamento das GPUs (chips gráficos adaptados para treinar e rodar modelos de IA), mas a capacidade de mover grandes volumes de dados entre processador, memória e rede sem perder tempo.
A NVHBM foi projetada para hyperscalers (empresas que operam data centers em escala massiva, como Google, Amazon e Microsoft) e outros grandes players de IA que precisam treinar ou rodar modelos enormes. Ao integrar memória, processamento e comunicação em um único sistema — em vez de usar componentes separados comprados de fornecedores diferentes —, a Nvidia promete reduzir latência (o tempo de espera para acessar dados) e aumentar a eficiência energética.
A aposta da Nvidia é que a próxima geração de infraestrutura de IA não será definida apenas por chips mais rápidos, mas por como todos os componentes — compute (capacidade de processamento), memória, armazenamento, rede e software — trabalham juntos como um sistema unificado. A NVHBM é uma peça dessa estratégia, desdesenhada para funcionar de forma otimizada dentro do ecossistema próprio da fabricante.


