Nvidia kjøper opp SchedMD og styrker kontrollen over AI-databehandling

  • Nvidia kjøper opp SchedMD, selskapet bak Slurm, og styrker sin satsing på åpen kildekode-programvare for AI og HPC.
  • Slurm håndterer en stor del av arbeidsmengdene på superdatamaskiner og datasentre, inkludert Barcelona Supercomputing Center.
  • Selskapet vil opprettholde Slurm som et åpent og leverandøruavhengig prosjekt, men optimalisert for den nyeste maskinvaren.
  • Avtalen passer inn i Nvidias strategi om å utvide sitt AI-økosystem, fra infrastruktur til generative modeller.

Nvidia kjøper opp SchedMD

Nvidias oppkjøp av SchedMD markerer et ytterligere trekk fra chipgiganten for å befeste sin posisjon i hjertet av høyytelsesdatabehandling og kunstig intelligens. Det amerikanske selskapet har ikke offentliggjort de økonomiske detaljene, men har gjort det klart at målet er å styrke kontrollen over programvaren som orkestrerer mye av arbeidet i verdens superdataklynger.

Dette oppkjøpet kommer samtidig som Nvidia dobler sin satsing på åpen kildekode og et AI-økosystem som strekker seg langt utover å selge GPU-er. Samtidig som selskapet annonserer dette oppkjøpet, opprettholder de et raskt tempo med å lansere sine egne AI-modeller og investere i andre selskaper i sektoren, i et marked der konkurransen, spesielt fra Asia, fortsetter å intensiveres.

Hva er SchedMD, og ​​hvorfor kjøper Nvidia det opp?

SchedMD er et selskap basert i California som spesialiserer seg på programvare for planlegging og administrasjon av store arbeidsmengder. Det er velkjent innen høyytelsesdatabehandling (HPC)-miljøet, selv om navnet er relativt ukjent utenfor det. Flaggskipproduktet deres er Slurm , en åpen kildekode-kø- og oppgavebehandling som koordinerer hvordan dataressurser distribueres på tvers av store serverklynger.

Slurm-programvare for arbeidsbelastningshåndtering

SchedMD ble grunnlagt i 2010 i Livermore, California, av Slurm-utviklerne Morris «Moe» Jette og Danny Auble, og har et team på rundt 40 personer. Forretningsmodellen deres dreier seg om å tilby support, ingeniørtjenester og vedlikeholdstjenester for programvare som alle kan bruke uten lisensavgift.

Slurm har blitt en de facto standard innen superdatamaskiner og datasentre dedikert til AI og HPC. Ifølge data sitert av Nvidia bruker mer enn halvparten av verdens 10 og 100 kraftigste systemer på TOP500-listen denne arbeidsbelastningsbehandleren til å organisere millioner av oppgaver som kjører parallelt.

Slurms rolle er langt fra ubetydelig: den bestemmer hvilket arbeid som utføres, hvor og med hvilke ressurser innenfor en klynge som kan gruppere titusenvis av GPU-er. I et scenario der trening av generative AI-modeller bruker en enorm mengde datakraft, har det blitt en kritisk del av infrastrukturen å ha en effektiv «orkestrator».

Innvirkning i Europa: rollen til Barcelona Supercomputing Center og andre kunder

Oppkjøpet er ikke bare relevant i USA. SchedMD har en global kundebase, inkludert skyinfrastrukturselskapet CoreWeave og Barcelona Supercomputing Center (BSC) , et av Europas ledende superdatasentre.

Ved anlegg som BSC brukes Slurm til planlegging av vitenskapelig arbeid, fysikksimuleringer, stordataanalyse og AI-prosjekter . Eventuelle fremtidige endringer i dette verktøyet vil derfor ha en direkte innvirkning på den daglige driften av superdatamaskiner som betjener europeiske universiteter, forskningssentre og bedrifter.

Nvidia har forsøkt å berolige dette internasjonale økosystemet: selskapet har understreket at de vil opprettholde Slurm som åpen kildekode, leverandøruavhengig programvare , og at de har til hensikt å utvide tilgangen til nye systemer, ikke begrense den. Denne offentlige forpliktelsen inkluderer fortsatt støtte til et mangfoldig maskinvare- og programvareøkosystem, noe som er avgjørende for institusjoner som kombinerer ulike arkitekturer i sine klynger.

For Europa, hvor teknologisk suverenitet og interoperabilitet er sensitive spørsmål, er det faktum at Slurm forblir åpen og bredt kompatibel spesielt relevant. Likevel kan Nvidias ankomst i arbeidsbelastningslederens "maskinrom" indirekte styrke rollen til GPU-ene i fremtidige utvidelser av kontinentets superdatasentre.

Slurm som en kritisk infrastruktur for generativ AI

Nvidia understreker at Slurm er en del av den kritiske infrastrukturen som trengs for å trene og distribuere generative AI-modeller. Store AI- og HPC-arbeidsbelastninger kjører på GPU-klynger som krever kø, avansert planlegging og intelligent ressursallokering for å forhindre at én del av systemet er inaktiv mens en annen blir overbelastet.

Høyytelses datainfrastruktur for AI

I sin offisielle uttalelse forklarer selskapet at etter hvert som HPC- og AI-klynger blir større og kraftigere , blir det viktig å maksimere ytelsen til hver GPU for å begrense kostnader og treningstid. Det er her Slurm kommer inn i bildet, optimalisert for å fungere med Nvidias nyeste maskinvare og i stand til å håndtere komplekse ressursbrukspolicyer.

Verktøyet tilordner trenings- og inferensjobber til de aktuelle nodene, fordeler oppgavekøer, anvender prioriteringer og sørger for at den totale klyngeutnyttelsen er så nær 100 % som mulig. Når det gjelder generativ AI, betyr dette muligheten til å trene modeller med milliarder av parametere og levere svar i stor skala uten å sløse med beregningskapasitet.

For utviklere av basismodeller og for team som bygger AI-applikasjoner oppå dem, lar et modent arbeidsbelastningshåndteringssystem som Slurm dem bedre utnytte infrastrukturinvesteringene sine og skalere prosjekter uten å omskrive oppgaveplanleggingslogikken fra bunnen av.

Styrking av programvarens «vollgrav»: fra CUDA til orkestreringslaget

Dette trekket passer inn i en bredere strategi der programvare er like viktig som maskinvare . Nvidia har bygget et rykte rundt hastigheten på brikkene sine, men deres proprietære CUDA-plattform har blitt en de facto standard blant AI- og HPC-utviklere, noe som skaper en sterk avhengighet av GPU-ene deres.

Bransjeanalytikere påpeker at oppkjøpet av SchedMD forsterker dette konkurransegapet . Ved å integrere Slurm tettere med sitt økosystem, vinner Nvidia terreng ikke bare innen rå databehandling, men også i laget som bestemmer hvordan, når og hvor denne kraften brukes. I praksis utvider selskapet sin innflytelse fra GPU-en til kontrollplanet i store datasentre.

Samtidig insisterer selskapet på at de vil fortsette å holde Slurm åpent og brukbart med andre produsenter , en betingelse som gjør at de kan opprettholde støtten fra fellesskapet og store forskningssentre, som vanligvis unngår helt lukkede løsninger. Nvidias strategi innebærer å lede utviklingen og maksimere integrasjonen med egen maskinvare, uten å stenge døren for alternative arkitekturer.

For rivaler som AMD og Intel betyr dette scenariet å konkurrere i et felt der den mest brukte lasthåndteringen nå er i hendene på deres viktigste GPU-konkurrent. Selv om Slurms åpen kildekode-natur reduserer risikoen for låsing, kan Nvidias evne til å diktere prosjektets tekniske veikart påvirke hvordan støtte for nye funksjoner eller arkitekturer prioriteres.

Utover Slurm: Et raskt voksende AI-økosystem

Oppkjøpet av SchedMD er bare én del av en rekke grep der Nvidia søker å bygge et komplett AI-økosystem , som omfatter alt fra håndtering av datakraft til applikasjoner basert på avanserte modeller. De siste månedene har selskapet gjort betydelige investeringer i ledende selskaper og oppstartsbedrifter i sektoren.

Blant de mest bemerkelsesverdige operasjonene er en makroinvestering i OpenAI , kapitalinntektene til selskaper som Intel og Nokia, deltakelse i konsortiet ledet av BlackRock for å kjøpe Aligned Data Centers – en operasjon verdsatt til rundt 40.000 milliarder dollar – og tilstedeværelsen i finansieringsrunder for aktører som Anthropic, xAI (promotert av Elon Musk), Scale AI, Perplexity, Nscale eller Thinking Machines Lab.

Parallelt har Nvidia annonsert samarbeid og finansieringsforpliktelser med viktige programvareprosjekter for halvlederdesign, som Synopsys , og med leverandører av skyinfrastruktur med fokus på AI, som CoreWeave, som også er en SchedMD-kunde. Alt dette tegner et bilde der selskapet ønsker å være til stede i alle lag av verdikjeden for kunstig intelligens .

Denne ekspansjonsstrategien har gjort det mulig for selskapet å befeste sin posisjon som verdens største selskap målt i markedsverdi , med en markedsverdi på rundt billioner av dollar og en aksjekurs som, til tross for episoder med volatilitet og tvil om en mulig «AI-boble», har fortsatt å nå historisk høye nivåer.

Nye åpne AI-modeller og respons på internasjonal konkurranse

Kunngjøringen om oppkjøpet av SchedMD falt sammen med Nvidias avduking av en ny familie av åpen kildekode-modeller for kunstig intelligens . Ifølge selskapet er disse modellene designet for å være raskere, rimeligere i drift og mer kapable enn forgjengerne, med sikte på å tilby et konkurransedyktig alternativ til bølgen av åpen kildekode-modeller som blant annet stammer fra kinesiske kunstig intelligens-laboratorier.

Selskapet tilbød allerede en rekke modeller og verktøy, fra fysiske simuleringer til løsninger for autonome kjøretøy, som tilgjengelig programvare for forskere og organisasjoner. Med denne nye generasjonen ønsker Nvidia å styrke sin rolle som leverandør av både infrastruktur og referansemodeller som andre kan bygge tjenester og applikasjoner på.

Markedet reagerte med en viss tillit på denne kombinasjonen av kunngjøringer: etter nyheten om oppkjøpet og de nye modellene registrerte Nvidias aksjer en oppgang på rundt 1,3–1,5 % , og tok igjen noe av terrenget som ble tapt de foregående dagene på grunn av tvil om det faktiske tempoet i AI-adopsjonen.

Ved å opprettholde et tilbud av åpne modeller, søker selskapet å balansere sin proprietære programvarestrategi – med CUDA som en sentral pilar – med en mer samarbeidende tilnærming, noe som gjør det enklere for universiteter, europeiske offentlige sentre og oppstartsbedrifter å eksperimentere med og distribuere AI-løsninger uten å starte fra bunnen av.

I mellomtiden er konkurransen hard: nye aktører, inkludert internasjonale konsortier og kinesiske selskaper med sterk statlig støtte, lanserer sine egne modeller og plattformer, noe som legger press på Nvidia til å handle raskt for å opprettholde sin teknologiske og markedsledende posisjon.

Med integreringen av SchedMD under sin paraply, forpliktelsen til å opprettholde Slurm som et åpent prosjekt, og utvidelsen av katalogen over modeller og investeringer, tar Nvidia et nytt skritt mot å posisjonere seg i sentrum av den globale AI- og superdatamaskininfrastrukturen, et felt der Europa – med sentrale noder som Barcelona Supercomputing Center – vil fortsette å nøye overvåke hvordan forholdet mellom teknologisk uavhengighet og avhengighet av maskinvaren og programvaren til den amerikanske giganten utvikler seg.

NVIDIA lanserer Audio2Face-animasjonsmodellen som åpen kildekode
Relatert artikkel:
NVIDIA bruker åpen kildekode for Audio2Face, sin AI-animasjonsmodell for ansiktsanimasjon.

Legg til som foretrukket kilde i Google