A AMD lançou sua nova plataforma de IA em escala de rack Helios, com aceleradores MI455X de alto desempenho, ao mesmo tempo em que garante uma parceria com a Cerebras para integrar chips em escala de wafer em seus sistemas de data center.
O lançamento dos sistemas Helios Rack
A AMD entrou oficialmente na competição de IA em escala de rack com o lançamento do Helios, uma plataforma projetada para desafiar a participação de mercado de data centers da Nvidia. O sistema se destaca por sua escala física, medindo 1,2 metros de largura e 44OUs de altura, o que o torna significativamente maior que a arquitetura NVL72 da Nvidia. Dentro do rack Helios, a AMD utiliza 18 blades de computação refrigerados a líquido, cada um abrigando quatro GPUs MI455X e um único processador Venice Epyc de 96 núcleos. Ao utilizar uma malha Ultra Accelerator Link over Ethernet (UALoE), o sistema evita a necessidade de switches proprietários, permitindo que os construtores aproveitem o silício comercial padrão da indústria de empresas como a Broadcom. Com cada acelerador MI455X suportado por três placas de rede Pensando Vulcano de 800 Gbps, a AMD afirma que a plataforma oferece largura de banda escalável superior em comparação com as ofertas existentes da Nvidia, posicionando-a como um concorrente poderoso para treinamento em grande escala e cargas de trabalho de inferência.
Arquitetura Técnica do MI455X
A força por trás da plataforma Helios é o mais recente acelerador de data center da AMD, o MI455X, que é construído na arquitetura de computação CDNA de 5ª geração. Este chip representa um enorme esforço de engenharia, utilizando um design de “sanduíche de silício” que incorpora 24 chips e tecnologia de processo de 2 nm para matrizes de computação. Para priorizar o desempenho da IA, a AMD abandonou o suporte FP64 neste SKU específico, realocando a área da matriz para focar em formatos de baixa precisão, como MXFP4 e MXFP8. A arquitetura inclui um aumento significativo no cache L2 compartilhado e um novo mecanismo de acesso direto à memória (DMA) que visa reduzir a latência dos dados. Essas melhorias permitem que o chip suporte particionamento espacial, permitindo que ele funcione como uma única GPU grande ou seja dividido em várias instâncias virtuais, fornecendo aos hiperescaladores opções de implantação flexíveis que antes eram limitadas nas gerações anteriores.
Parceria Estratégica com Cerebras
Juntamente com os avanços de hardware interno, a AMD aprofundou a influência do seu ecossistema através de uma nova parceria com a Cerebras. Em uma conferência do setor, o CEO da Cerebras, Andrew Feldman, confirmou que os chips exclusivos de “escala wafer” de sua empresa serão utilizados nos sistemas Helios AI da AMD. Esta integração visa atender à demanda crítica da indústria por latência ultrabaixa, que é essencial para aplicações generativas de IA que exigem tempos de resposta rápidos. O hardware da Cerebras começará a aparecer nos data centers gerenciados pela Cerebras ainda este ano, e os compradores de servidores terão a opção de configurar seus próprios sistemas baseados em AMD com esta tecnologia em escala de wafer. As empresas lançaram esta colaboração como uma forma de alcançar uma eficiência significativamente maior de tokens por segundo por watt, criando um nicho distinto em um mercado dominado por clusters padrão baseados em GPU.
Impacto no mercado e cenário competitivo
A AMD está posicionando o Helios como um rival direto das plataformas Blackwell e Vera Rubin da Nvidia, afirmando que o desempenho lidera em largura de banda de memória e velocidades de treinamento de IA. Ao coincidir com o cronograma de lançamento das mais novas plataformas da Nvidia, a AMD parece estar se afastando de seu modelo histórico de ‘catch-up’. A empresa também garantiu compromissos significativos de grandes players: a OpenAI planeja implantar poder computacional em larga escala usando GPUs MI455X, e a Anthropic se comprometeu com implantações significativas em troca de acordos de investimento. Apesar da postura competitiva, a AMD adotou uma abordagem de marketing mais transparente em relação às métricas de desempenho. Ao admitir publicamente que os picos de FLOPS teóricos raramente são alcançáveis em cenários do mundo real, a empresa espera construir credibilidade a longo prazo junto de clientes empresariais que dão prioridade ao desempenho sustentado e mensurável em detrimento de números de marketing potencialmente inflacionados.
⚖ The Balanced View
Supporting view
Os apoiadores observam que o Helios oferece uma relação desempenho por dólar superior, maior capacidade de memória HBM4 e largura de banda de expansão mais rápida do que os atuais equivalentes da Nvidia.
Concerns & criticism
Os críticos apontam que o desempenho da IA no mundo real depende fortemente da otimização do software e do formato da carga de trabalho, o que significa que os FLOPS de “pico teórico” são muitas vezes funcionalmente impossíveis de alcançar.
→What's next
A AMD planeja expandir seu portfólio de GPU baseado em CDNA 5 para incluir variantes especificamente otimizadas para implantações empresariais. Enquanto isso, espera-se que os sistemas Helios equipados com Cerebras comecem a ser implementados em data centers a partir do final deste ano.