AMD službeno predstavlja Helios platformu

  • Objavljeno u Novosti
image

Mjesečna potrošnja tokena povećala se 158 puta u dvije godine jer se umjetna inteligencija pomiče s eksperimentiranja na proizvode i usluge. Izračunavanje za obuku nastavilo je rasti, povećavajući se 5 puta godišnje od 2020. Inferencija postaje najveće opterećenje umjetne inteligencije jer modeli opslužuju milijarde interakcija.

Agentska umjetna inteligencija dodatno povećava tu potražnju. Jedan zahtjev može pokrenuti više koraka zaključivanja, podagente, operacije pretraživanja i pozive alata, zajedno s usmjeravanjem, raspoređivanjem i upravljanjem memorijom koje pokreće CPU. Stoga nije potrebna samo veća količina tokena; svaki koristan rezultat zahtijeva više zaključivanja, orkestracije i premještanja podataka, što stvara dodatni pritisak na računalstvo, kapacitet memorije, umrežavanje, latenciju i cijenu po tokenu.

Umjetna inteligencija zahtijeva novi nacrt infrastrukture. Vodeća računalna obrada je ključna, ali sama računalna obrada nije dovoljna. Kupcima je također potrebna otvorena arhitektura racka, skalabilne i skalabilne mreže velike propusnosti, učinkovito napajanje i hlađenje, jednostavnost servisiranja i rješenja po principu "ključ u ruke" koja se mogu brzo implementirati. AMD je krenuo u dizajniranje tih mogućnosti zajedno kao jednog sustava.

AMD je službeno predstavio Helios AI platformu na razini cijelog serverskog ormara (racka), namijenjenu treniranju i izvođenju velikih modela umjetne inteligencije. Nije riječ o jednom procesoru ili grafičkom čipu, nego o kompletnom sustavu koji objedinjuje procesore, AI akceleratore, memoriju, mrežu i softver.

U srcu AMD Heliosa je AMD Instinct MI455X GPU, koji prema AMD-u, donosi generacijski skok u AI računanju, HBM4 kapacitetu i propusnosti memorije.

Na DeepSeek-V4-Flashu, jednom od vodećih modela otvorene težine u svojoj klasi, AMD Instinct MI455X GPU-ovi pružaju do 34X veći protok tokena uz visoku interaktivnost i do 18X nižu cijenu tokena u usporedbi s AMD Instinct MI355X GPU-ovima.

AMD Helios je dizajniran oko puta kojim se AI radno opterećenje kreće kroz rack. Rad ulazi kroz sloj hosta, prelazi u GPU domenu, pristupa modelu i aktivnim podacima u HBM4 te komunicira kroz rack putem skalabilne strukture.

Taj dizajn za rackove postavlja novu konkurentsku ljestvicu. U usporedbi s NVIDIA Vera Rubin NVL72 rackom, AMD Helios je dizajniran da pruži do 15% više AI računalstva, 50% više HBM kapaciteta i 50% veću skalabilnu propusnost. AMD Helios kombinira te prednosti s 2,9 eksaflopsa gustog FP4 računalstva, 1,4 eksaflopsa FP8 računalstva, 31 TB HBM4, 1,7 PB/s ukupne HBM propusnosti, 260 TB/s skalabilne propusnosti i 43 TB/s skalabilne propusnosti.

AMD kaže da Helios usvajaju vodeći stručnjaci u području umjetne inteligencije, cloud partneri i infrastrukturni partneri. Ta širina je važna jer infrastruktura u rack skali dolazi do proizvodnje putem povezanog lanca opskrbe, od programera modela i cloud operatera do tvrtki koje grade i servisiraju fizičke sustave.

AMD Helios skalira engine u kompletnu platformu za rack, povezujući 72 GPU-a s AMD EPYC Venice serverskim CPU-ima, AMD Pensando umrežavanjem, AMD ROCm softverom i otvorenom sistemskom arhitekturom.

AMD Helios također označava širi pomak u načinu na koji AMD unapređuje AI infrastrukturu. Godišnja izvedba sada povezuje uzastopne generacije AMD Instinct GPU-a s napretkom u memoriji, međusobnom povezivanju i skaliranju GPU-a. Rezultat je otvorena, višegeneracijska računalna kadenca za AI u rack-skali.

Na kraju zaključuju da S AMD Heliosom, rack više nije samo mjesto gdje je instaliran AI sustav. Sam rack je AI sustav, a AMD isporučuje otvorenu platformu za eru AI tvornica.

Podijeli