Nvidia quer possuir todos os chips dos data centers de IA


Nvidia está exagerando lançou seu novo sistema de chip Vera Rubin esta semana, revelando novos benchmarks de desempenho para o Combinação de GPU e CPU à frente do rival AMDevento anual de produtos da empresa em São Francisco na quinta-feira.

Durante um longo workshop técnico na semana passada na sede da empresa em Santa Clara, Califórnia, os executivos da Nvidia se gabaram para um pequeno grupo de jornalistas sobre o aumento das capacidades de potência e eficiência do sistema de chip. A maior conclusão: a Nvidia, que há muito se especializou na fabricação de GPUs, está cada vez mais tentando se posicionar como fornecedora de CPUs que podem alimentar agentes de IA.

Embora as GPUs ainda sejam o hardware principal que as empresas usam para treinar e executar seus modelos de IA, a mudança da indústria em direção a sistemas de agentes mais complexos aumentou a demanda por CPUs, que podem orquestrar fluxos de dados, redes e outras tarefas de software. Essa é provavelmente uma das razões pelas quais a Nvidia está ansiosa para se promover como fornecedora de sistemas completos de IA, em vez de apenas chips de IA.

Vera Rubin é a sucessora da Nvidia ao seu superchip híbrido sistema Grace Blackwell e representa o eixo de seu futuro a curto prazo, alimentando a indústria de IA. Ele foi projetado para oferecer uma CPU para cada duas GPUs. Em um único sistema de superchip Vera Rubin NVL 72, existem 36 CPUs Vera para cada 72 GPUs Rubin. A Nvidia também está vendendo o CPU Vera como um produto independente e tem supostamente disse aos clientes chineses estes poderão estar prontos já em agosto.

A imagem pode conter Hardware eletrônico Hardware de computador Placar de placa de circuito impresso e computador

O chip CPU que a Nvidia está usando em seu novo sistema de hardware Vera Rubin.

Cortesia da Nvidia

Os executivos da Nvidia enfatizaram que seus novos racks Vera Rubin NVL72 – uma pilha de chips embalados em uma única plataforma refrigerada a líquido – são muito mais “plug-and-play” do que alguns de seus produtos anteriores. Durante uma breve visita a um laboratório de data center da Nvidia no Vale do Silício, os executivos da Nvidia compartilharam que a OpenAI já tem um rack Vera Rubin em uso.

O CEO da Nvidia, Jensen Huang, não apareceu no workshop em Santa Clara na semana passada; ele estava no Japão anunciando o novo fabricante de chips parcerias com diversas empresas japonesas para desenvolver IA para robótica. Os briefings foram conduzidos por Ian Buck, vice-presidente de computação acelerada de longa data da Nvidia e arquiteto por trás do software CUDA da empresa.

“Estamos em um roteiro para desenvolver novas arquiteturas, não apenas GPUs, mas CPUs”, disse Buck aos repórteres. “Vamos continuar inovando, porque é fazer isso ou morrer no Vale do Silício.”

As reuniões foram realizadas no centro de reuniões executivas de Huang, onde várias mesas próximas estavam cheias de sacos de salgadinhos taiwaneses que o CEO trouxe de sua recente viagem à Computex, uma grande feira anual de semicondutores em Taipei, disse um porta-voz da Nvidia à WIRED.



Source link