A Foxconn confirmou que seus primeiros servidores baseados nas GPUs Blackwell da Nvidia estarão disponíveis este ano. No entanto, eles estarão disponíveis apenas em quantidades limitadas. A empresa enfatizou que, mesmo que não consiga enviar máquinas baseadas em GB200 em quantidades significativas este ano, a demanda por servidores de IA é tão alta que atingirá suas metas de vendas vendendo máquinas existentes com Nvidia Hopper.
“Estamos no caminho certo para desenvolver e preparar a fabricação do novo servidor de IA [Nvidia] para começar a enviar em pequenos volumes no último trimestre de 2024 e aumentar o volume de produção no primeiro trimestre do próximo ano”, disse James Wu, porta-voz da Foxconn, em uma chamada de resultados com analistas e investidores, conforme relatado pelo Nikkei.
A Foxconn está fortemente investida em seu negócio de servidores de IA, que agora representa 40% de suas operações gerais de servidores. A empresa detém 40% do mercado global de servidores de IA e antecipa que esse segmento em breve se tornará um empreendimento de “trilhão de dólares”. A demanda por servidores usando as GPUs H100 e H200 de geração atual da Nvidia permanece muito forte, dando à Foxconn confiança de que atingirá suas metas de receita para a segunda metade do ano.
Diz-se que a Foxconn é o principal montador das máquinas NVL72 da Nvidia baseadas em nós GB200 que usam um processador Grace de 72 núcleos e duas GPUs B200. O problema é que a Nvidia não será capaz de enviar grandes quantidades de GPUs Blackwell este ano.
Diferente das H100 e H200, que dependem da embalagem CoWoS-S da TSMC, as GPUs B100 e B200 da Nvidia são as primeiras a usar a embalagem CoWoS-L da TSMC, que utiliza um interposer RDL com pontes de interconexão de silício local (LSI) para conectar chiplets. O posicionamento preciso dessas pontes é crucial, especialmente para manter a interconexão de 10 TB/s entre os dies de computação. Rumores sugerem um problema de design envolvendo uma incompatibilidade no coeficiente de expansão térmica (CTE) entre os chiplets da GPU, pontes LSI, interposer RDL e substrato da placa-mãe, potencialmente causando deformação e falha do sistema em embalagem. Analistas também sugerem que redesenhar as camadas metálicas superiores e os bumps do silício da GPU Blackwell pode ser necessário, levando a atrasos.
Consequentemente, espera-se que a Nvidia produza baixos volumes das GPUs B200 de 1000W no Q4 de 2024 para servidores HGX, com disponibilidade limitada de servidores NVL36 e NVL72 baseados em GB200, que a Foxconn está supostamente discutindo.
Para atender à demanda por sistemas de IA de médio e baixo alcance, a Nvidia está desenvolvendo a GPU B200A, apresentando silício monolítico B102 com 144 GB de memória HBM3E, usando a embalagem CoWoS-S estabelecida. Este modelo, esperado no Q2 de 2025, oferecerá até 144 GB de memória HBM3E e 4 TB/s de largura de banda de memória.
Fonte: Nikkei


