TechVaultHub

AMD Unveils Helios Rack-Scale AI Platform and Partners with Cerebras

By Staff ng TechVaultHub

Ipinakilala ng AMD ang bago nitong Helios rack-scale AI platform, na nagtatampok ng mga high-performance na MI455X accelerators, habang sabay-sabay na sinisiguro ang pakikipagsosyo sa Cerebras upang isama ang wafer-scale chips sa mga data center system nito.

kumpanya
AMD
Pangunahing Hardware
Helios rack system na may MI455X accelerators
Partnership
Ang mga cerebras system ay isasama sa AMD Helios
Mga Pangunahing Customer
Meta, Microsoft, Oracle, OpenAI, at Anthropic
Pagpapatunay
Kinumpirma ng 3 independent outlet
Advertisement
1

Ang Paglunsad ng Helios Rack Systems

Ang AMD ay opisyal na pumasok sa rack-scale AI competition sa paglulunsad ng Helios, isang platform na idinisenyo upang hamunin ang bahagi ng merkado ng data center ng Nvidia. Ang sistema ay kapansin-pansin para sa pisikal na sukat nito, na may sukat na 1.2 metro ang lapad at 44OUs ang taas, na ginagawang mas malaki kaysa sa NVL72 na arkitektura ng Nvidia. Sa loob ng Helios rack, ang AMD ay gumagamit ng 18 liquid-cooled compute blades, bawat isa ay naglalaman ng apat na MI455X GPU at isang solong 96-core na Venice Epyc processor. Sa pamamagitan ng paggamit ng Ultra Accelerator Link over Ethernet (UALoE) fabric, iniiwasan ng system ang pangangailangan para sa proprietary switch, na nagpapahintulot sa mga builder na gamitin ang industry-standard merchant silicon mula sa mga kumpanya tulad ng Broadcom. Sa bawat MI455X accelerator na sinusuportahan ng tatlong 800 Gbps Pensando Vulcano network card, inaangkin ng AMD na ang platform ay nag-aalok ng mas mataas na scale-out bandwidth kumpara sa mga umiiral na alok ng Nvidia, na ipinoposisyon ito bilang isang malakas na kalaban para sa malakihang pagsasanay at inference workload.

2

Teknikal na Arkitektura ng MI455X

Ang kapangyarihan sa likod ng platform ng Helios ay ang pinakabagong data center accelerator ng AMD, ang MI455X, na binuo sa 5th-gen CDNA compute architecture. Ang chip na ito ay kumakatawan sa isang napakalaking pagsisikap sa engineering, gamit ang isang 'silicon sandwich' na disenyo na nagsasama ng 24 chiplets at 2nm process technology para sa compute dies. Upang bigyang-priyoridad ang pagganap ng AI, ang AMD ay lumayo mula sa suporta sa FP64 sa partikular na SKU na ito, na muling naglalagay ng die area upang tumuon sa mga low-precision na format tulad ng MXFP4 at MXFP8. Kasama sa arkitektura ang isang makabuluhang pagtaas sa shared L2 cache at isang bagong direct memory access (DMA) engine na naglalayong bawasan ang latency ng data. Ang mga pagpapahusay na ito ay nagbibigay-daan sa chip na suportahan ang spatial partitioning, na nagbibigay-daan dito na gumana bilang isang malaking GPU o nahahati sa maramihang mga virtual na pagkakataon, na nagbibigay ng mga hyperscaler na may mga nababagong opsyon sa pag-deploy na dating limitado sa mga naunang henerasyon.

3

Strategic Partnership sa Cerebras

Kasabay ng mga panloob na pagsulong ng hardware nito, pinalalim ng AMD ang impluwensya nito sa ecosystem sa pamamagitan ng bagong pakikipagsosyo sa Cerebras. Sa isang kumperensya sa industriya, kinumpirma ng CEO ng Cerebras na si Andrew Feldman na ang natatanging 'wafer-scale' chips ng kanyang kumpanya ay gagamitin sa loob ng mga sistema ng Helios AI ng AMD. Nilalayon ng pagsasamang ito na tugunan ang kritikal na pangangailangan ng industriya para sa napakababang latency, na mahalaga para sa mga generative AI application na nangangailangan ng mabilis na mga oras ng pagtugon. Magsisimulang lumabas ang Cerebras hardware sa mga sentro ng data na pinamamahalaan ng Cerebras sa huling bahagi ng taong ito, at magkakaroon ng opsyon ang mga mamimili ng server na i-configure ang kanilang sariling mga AMD-based na system gamit ang teknolohiyang ito na wafer-scale. Itinayo ng mga kumpanya ang pakikipagtulungang ito bilang isang paraan upang makamit ang mas mataas na kahusayan ng token-per-second-per-watt, na lumilikha ng natatanging angkop na lugar sa isang merkado kung hindi man ay pinangungunahan ng mga karaniwang GPU-based na cluster.

4

Epekto sa Market at Competitive Landscape

Ipinoposisyon ng AMD ang Helios bilang direktang karibal sa mga platform ng Blackwell at Vera Rubin ng Nvidia, na sinasabing nangunguna sa pagganap sa memory bandwidth at bilis ng pagsasanay ng AI. Sa pamamagitan ng pagtutugma sa timeline ng paglulunsad ng mga pinakabagong platform ng Nvidia, lumilitaw na lumalayo ang AMD sa makasaysayang 'catch-up' na modelo nito. Ang kumpanya ay nakakuha din ng makabuluhang mga pangako mula sa mga pangunahing manlalaro: Ang OpenAI ay nagplano na mag-deploy ng malakihang compute power gamit ang MI455X GPUs, at ang Anthropic ay nakatuon sa mga makabuluhang deployment kapalit ng mga deal sa pamumuhunan. Sa kabila ng mapagkumpitensyang postura, ang AMD ay nagpatibay ng isang mas malinaw na diskarte sa marketing tungkol sa mga sukatan ng pagganap. Sa pamamagitan ng pampublikong pag-amin na ang pinakamataas na teoretikal na FLOPS ay bihirang maabot sa mga totoong sitwasyon sa mundo, ang kumpanya ay umaasa na bumuo ng pangmatagalang kredibilidad sa mga customer ng enterprise na nagbibigay-priyoridad sa napapanatiling, nasusukat na pagganap kaysa sa potensyal na napalaki na mga numero sa marketing.

Advertisement

The Balanced View

Supporting view

Pansinin ng mga tagasuporta na nag-aalok ang Helios ng superyor na ratio ng performance-per-dollar, mas mataas na kapasidad ng memory ng HBM4, at mas mabilis na scale-out na bandwidth kaysa sa kasalukuyang katumbas ng Nvidia.

Concerns & criticism

Itinuturo ng mga kritiko na ang real-world AI performance ay lubos na nakadepende sa software optimization at workload shape, ibig sabihin, ang 'peak theoretical' na FLOPS ay kadalasang imposibleng maabot.

What's next

Plano ng AMD na palawakin ang CDNA 5-based na GPU portfolio nito para isama ang mga variant na partikular na na-optimize para sa mga deployment ng enterprise. Samantala, ang mga sistema ng Helios na nilagyan ng Cerebras ay inaasahang magsisimulang ilunsad sa mga data center simula sa huling bahagi ng taong ito.

Frequently Asked Questions

#artificial-intelligence#data-centers#amd-helios#cerebras-chips#mi455x#gpu-acceleration#semiconductor-manufacturing
Advertisement