NEO Semiconductor, especializada em memória flash 3D NAND e 3D DRAM, anunciou a tecnologia de chip 3D X-AI para substituir os HBMs atualmente usados em aceleradores de GPU de IA. Este DRAM 3D possui processamento de IA integrado, permitindo processar e gerar saídas sem a necessidade de cálculos matemáticos. Ele reduz os problemas de gargalo do data bus quando grandes quantidades de dados são transferidas entre a memória e o processador, aumentando o desempenho e a eficiência da IA.
O chip 3D X-AI possui uma camada de circuito de neurônio em sua base, que processa os dados armazenados nas 300 camadas de memória no mesmo die. Segundo a NEO Semiconductor, essa memória 3D oferece uma melhoria de desempenho de 100 vezes devido aos seus 8.000 circuitos de neurônio que realizam o processamento de IA na memória. Ela também possui uma densidade de memória oito vezes maior do que os HBMs atuais e, mais importante, oferece uma redução de 99% no consumo de energia, diminuindo a quantidade de dados que precisam ser processados nas GPUs, que consomem muita energia.
“Os chips de IA atuais desperdiçam quantidades significativas de desempenho e energia devido a ineficiências arquitetônicas e tecnológicas”, diz Andy Hsu, fundador e CEO da NEO Semiconductor.
Hsu comentou: “A arquitetura atual dos chips de IA armazena dados em HBM e depende de uma GPU para realizar todos os cálculos. Essa arquitetura separada de armazenamento e processamento de dados faz com que o data bus seja um gargalo de desempenho inevitável. Transferir grandes quantidades de dados através do data bus causa desempenho limitado e consumo de energia muito alto. O 3D X-AI pode realizar o processamento de IA em cada chip HBM. Isso pode reduzir drasticamente os dados transferidos entre HBM e GPU para melhorar o desempenho e reduzir dramaticamente o consumo de energia.”

A empresa afirma que o X-AI tem uma capacidade de 128GB e pode suportar 10 TB/s de processamento de IA por die. Empilhando doze dies juntos em uma embalagem HBM única, pode-se alcançar uma capacidade de armazenamento de mais de 1,5TB e uma taxa de processamento de 120 TB/s.
O desenvolvimento de IA está empurrando os limites da computação, com muitas empresas pesquisando tecnologias que aumentarão as velocidades de processamento e a taxa de transferência de comunicação. À medida que obtemos semicondutores mais rápidos e eficientes, o bus que transfere dados entre os componentes se torna o gargalo. Portanto, tecnologias como esta permitirão que todos os componentes funcionem mais rápido juntos.
Por exemplo, várias empresas, incluindo Intel, Kioxia e TSMC, têm trabalhado em tecnologia óptica para permitir comunicações mais rápidas dentro da placa-mãe. Mas ao transferir parte do processamento de IA da GPU para o HBM, a NEO Semiconductor pode ajudar a reduzir sua carga de trabalho, tornando-a muito mais eficiente do que os aceleradores de IA atuais, que consomem muita energia.
Fonte: NEO Semiconductor


