Tecnologia

Elon Musk planeja supercomputador com 100.000 GPUs Nvidia H100

A startup de IA de Elon Musk, xAI, planeja construir um supercomputador massivo para aprimorar seu chatbot de IA, Grok, conforme relatado pela Reuters, citando The Information. O supercomputador, que Elon Musk se refere como a Gigafactory of Compute, está projetado para estar pronto até o outono de 2025 e pode envolver uma colaboração com a Oracle. Com esse desenvolvimento, Musk pretende superar significativamente os clusters de GPU rivais em tamanho e capacidade.

Em uma apresentação para investidores, Elon Musk revelou que o novo supercomputador usará até 100.000 GPUs H100 da Nvidia baseadas na arquitetura Hopper, tornando-o pelo menos quatro vezes maior que os maiores clusters de GPU existentes, de acordo com The Information. As GPUs H100 da Nvidia são altamente procuradas no mercado de chips para data centers de IA, embora a forte demanda tenha tornado difícil obtê-las no ano passado. Mas essas não são as GPUs topo de linha da Nvidia que já foram, com a empresa verde prestes a enviar suas GPUs de computação H200 para aplicações de IA e HPC e se preparando para enviar suas GPUs B100 e B200 baseadas em Blackwell na segunda metade do ano.

Não está claro por que a xAI decidiu usar essencialmente uma tecnologia da geração anterior para seu supercomputador de 2025, mas esse investimento substancial em hardware deve refletir a escala das ambições da xAI. Lembre-se de que estamos lidando com um relatório não oficial e os planos podem mudar. No entanto, Musk supostamente se considera ‘pessoalmente responsável por entregar o supercomputador a tempo’, pois o projeto é muito importante para o desenvolvimento de modelos de linguagem de grande escala.

A xAI busca competir diretamente com gigantes da IA como OpenAI e Google. Musk, que também co-fundou a OpenAI, posiciona a xAI como um desafiador formidável no espaço de IA, e é exatamente por isso que ele precisa do supercomputador que está por vir. O modelo Grok 2 exigiu cerca de 20.000 GPUs Nvidia H100 para treinamento, e futuras iterações, como o Grok 3, precisarão de até 100.000 GPUs, de acordo com Musk.

Nem a xAI nem a Oracle forneceram comentários sobre a colaboração quando abordadas. Por razões óbvias, esse silêncio deixa alguns aspectos da parceria e do projeto do supercomputador abertos à especulação. No entanto, a apresentação de Musk aos investidores destaca seu compromisso em expandir os limites da tecnologia de IA através de investimentos substanciais em infraestrutura e parcerias estratégicas.

Fonte: Tom’s Hardware

Shares:

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *