Nvidia kjøper opp SchedMD for å styrke sin dominans innen høytytende AI

  • Nvidia kjøper opp SchedMD, utvikleren av Slurm, en viktig arbeidsbelastningsbehandler med åpen kildekode innen superdatamaskiner og AI.
  • Selskapet vil opprettholde Slurm som gratis og leverandøruavhengig programvare, optimalisert for den nyeste maskinvaren.
  • Oppkjøpet forsterker Nvidias strategi om å kontrollere alt fra maskinvaren til orkestreringslaget i store GPU-klynger.
  • Europeiske sentre som Barcelona Supercomputing Center bruker allerede Slurm i sine AI- og HPC-infrastrukturer.

Nvidia kjøper opp SchedMD og styrker sin AI-infrastruktur

Nvidias nylige oppkjøp av SchedMD , selskapet bak Slurm, har blitt et av de mest omtalte trekkene innen sektoren for høyytelsesdatabehandling og kunstig intelligens. Avtalen, hvis økonomiske vilkår ikke er offentliggjort, kommer midt i intens konkurranse og bekymringer om en potensiell AI-boble, der markedet følger nøye med på hvert trekk fra chipgiganten.

Denne avtalen befester ikke bare Nvidias posisjon innen maskinvarebransjen, hvor de allerede dominerte med sine GPU-er, men utvider også rekkevidden til programvarelaget som administrerer og orkestrerer arbeidsbelastninger på superdatamaskiner og store datasentre. Slurm, kjernekomponenten i SchedMD, er nå et kritisk verktøy for universiteter, offentlige laboratorier og teknologiselskaper over hele verden, inkludert i Europa.

Hva er SchedMD og hvorfor er Slurm så viktig?

SchedMD, grunnlagt i 2010 i Livermore, California, av Slurm-utviklerne Morris «Moe» Jette og Danny Auble, har spesialisert seg i en svært spesifikk, men avgjørende nisje: planlegging og håndtering av massive jobber på databehandlingsklynger . Med en stab på rundt 40 personer har selskapet bygget virksomheten sin rundt Slurm, åpen kildekode-programvare som er bredt tatt i bruk i HPC-økosystemet.

Slurm fungerer som en købehandler og ressursallokator i infrastrukturer der tusenvis av CPU-er og GPU-er sameksisterer. Dens rolle er å bestemme hvilket arbeid som utføres, hvor og hvor lenge, for å maksimere bruken av tilgjengelig kapasitet. I praksis er dette nøkkelen til å sikre at datasentre ikke har maskiner inaktive mens de trener AI-modeller eller kjører komplekse vitenskapelige simuleringer.

Ifølge data sitert av Nvidia bruker mer enn halvparten av de 10 og 100 beste superdatamaskinene på TOP500-listen Slurm som sitt system for arbeidsbelastningshåndtering. Dette adopsjonsnivået posisjonerer SchedMDs programvare som en de facto standard innen superdatamaskiner, inkludert i ledende europeiske infrastrukturer.

Selskapet har tjent penger på dette åpen kildekode-prosjektet gjennom support, konsulent- og vedlikeholdstjenester , og tilbyr teknisk assistanse til organisasjoner som er avhengige av Slurm for å planlegge store mengder AI-opplæring og inferensarbeid, samt storskala vitenskapelige simuleringer.

Slurm og arbeidsbelastningshåndtering i superdatamaskiner

Innvirkning i Spania og Europa: rollen til Barcelona Supercomputing Center

Betydningen av denne operasjonen er også tydelig i Europa. Blant SchedMDs fremtredende kunder er Barcelona Supercomputing Center – National Supercomputing Center (BSC) , et ledende senter for høyytelsesdatabehandling i Spania og et sentralt knutepunkt i den europeiske strategien for AI og superdatabehandling.

Bruken av Slurm i anlegg som BSC og andre europeiske HPC-sentre muliggjør koordinert tilgang til store GPU-klynger for vitenskapelige, industrielle og generative AI-prosjekter. Fra klimasimuleringer og materialmodellering til språkmodellopplæring er disse miljøene avhengige av svært presis ressursplanlegging for å sikre at tusenvis av køjobber går videre uten å blokkere systemet.

Nå som SchedMD er under Nvidias paraply, er det spesielt interessant å se hvordan Slurm vil opprettholde sin åpne, nøytrale og multi-hardware natur i et europeisk økosystem der ulike brikkeprodusenter og skyløsninger sameksisterer. Nvidia har insistert på at de vil fortsette å distribuere Slurm som et åpen kildekode, leverandøruavhengig verktøy, men bransjen vil følge prosjektets faktiske utvikling nøye.

For EUs forskningsmiljø og teknologisektor, som er forpliktet til delt infrastruktur og åpne standarder, er den fortsatte eksistensen av Slurm som en interoperabel og åpen kildekode-komponent spesielt viktig. Programvaren er integrert i en rekke paneuropeiske superdatamaskinprosjekter, så enhver retningsendring vil ha vidtrekkende konsekvenser.

Nvidias strategi: fra brikken til infrastrukturkontroll

Oppkjøpet av SchedMD føyer seg inn i en bredere trend der Nvidia styrker alle ledd i AI-verdikjeden . Tradisjonelt har selskapet vært kjent for kraften i GPU-ene sine, men de siste årene har programvarekomponenten blitt stadig viktigere som en differensierende faktor mot konkurrenter som AMD og Intel.

Kjernen i denne strategien er CUDA (Compute Unified Device Architecture) , Nvidias proprietære parallelle databehandlingsplattform som har blitt en de facto standard for mange AI-utviklere. Ved å tilby biblioteker, verktøy og et komplett økosystem har CUDA skapt en sterk innlåsningseffekt: jo mer du utvikler på denne plattformen, desto dyrere blir det å migrere til en annen.

Integreringen av Slurm i Nvidia-økosystemet utvider denne innflytelsen til arbeidsmengdeorkestreringslaget . Det handler ikke bare om å selge grafikkort, men om å delta i beslutninger om hvordan disse ressursene brukes i stor skala – noe noen analytikere beskriver som å bli en slags «trafikkhåndtering» for global AI-datakraft.

Bransjekilder tolker dette trekket som en måte å forsterke selskapets «konkurransedyktige vollgrav»: Stilt overfor spredningen av åpne modeller og maskinvarealternativer, prøver Nvidia å sikre at mye av den kritiske AI-infrastrukturen i praksis fortsetter å kjøre gjennom økosystemet av programvare og verktøy.

Slurm som en nøkkelkomponent i generativ AI og superdatabehandling

I annonseringen av oppkjøpet understreker Nvidia at HPC- og AI-arbeidsmengder krever koordinering av svært parallelle oppgaver på tvers av store klynger. Etter hvert som disse systemene vokser i størrelse og kompleksitet, blir det viktig å maksimere bruken av hver GPU for å begrense kostnader og unngå flaskehalser.

Slurm, nå optimalisert for den nyeste Nvidia-maskinvaren , har etablert seg som en kjernekomponent i infrastrukturen som kreves for generativ AI. Utviklere av grunnleggende modeller – store språkmodeller, visjonssystemer eller multimodale modeller – er avhengige av denne programvaren for å administrere både innledende opplæring og påfølgende inferensoppgaver i produksjon.

Verktøyet håndterer funksjoner som jobbplanlegging, GPU-allokering, køhåndtering og håndheving av retningslinjer angående bruker- eller prosjektprioritet. Dette kontrollnivået er avgjørende i sammenhenger der ressursbehovet langt overstiger tilgjengelig kapasitet på bestemte tidspunkter.

I akademiske miljøer og europeiske offentlige forskningssentre har bruken av Slurm blitt utbredt nettopp på grunn av kombinasjonen av fleksibilitet, ytelse og åpen modell . Nvidias oppkjøp endrer ikke umiddelbart disse egenskapene, men det plasserer prosjektets fremtidige utvikling i hendene på en aktør med en klar interesse i å opprettholde sin lederskap innen AI.

Forpliktelse til åpen kildekode og tvil om nøytralitet

Både i bedriftsbloggen sin og i påfølgende uttalelser har Nvidia insistert på at de planlegger å fortsette å utvikle og distribuere Slurm som åpen kildekode , leverandøruavhengig programvare. Selskapet oppgir at de vil støtte et mangfoldig maskinvare- og programvareøkosystem samtidig som de akselererer SchedMDs tilgang til nye systemer.

Denne meldingen har som mål å berolige en brukerbase som er svært følsom for ethvert forsøk på å stenge ute viktige verktøy eller knytte dem for mye til én enkelt produsent . Mange superdatamaskiner i Europa integrerer ulik maskinvare og planlegger anskaffelsene sine basert på kriterier for teknologisk suverenitet, så et skifte mot en løsning som er for tett knyttet til Nvidia kan generere motstand.

Ved å holde modellen åpen kan Nvidia dra nytte av den utbredte bruken av Slurm uten å forstyrre den nåværende balansen, samtidig som de introduserer spesifikke optimaliseringer for GPU-ene sine . Denne tilnærmingen lar dem styrke sin posisjon i de mest avanserte AI-miljøene uten å forby, i hvert fall på papiret, bruken av andre arkitekturer under samme arbeidsbelastningsbehandler.

For det europeiske HPC-fellesskapet, som er vant til å utvikle og vedlikeholde åpne vitenskapelige programvareprosjekter , vil det være viktig å observere hvordan Slurms styring utvikler seg, utviklingstempoet og hvordan eksterne bidrag håndteres etter integrering i Nvidia.

Markedskontekst: aksjemarkedsvolatilitet og en bølge av AI-investeringer

Kunngjøringen om oppkjøpet av SchedMD kom på et tidspunkt da Nvidias aksjer var i ferd med å ta seg opp igjen etter flere dager med fall knyttet til debatten om en potensiell AI-boble i markedene. Etter kunngjøringen av avtalen og avdukingen av nye AI-modeller med åpen kildekode, steg aksjekursen med rundt 1,3–1,5 % i løpet av handelen, og opprettholdt dermed selskapets posisjon som verdens største etter markedsverdi.

Denne transaksjonen er et ledd i en rekke intense investeringer innen kunstig intelligens og datasentersektoren . Nvidia har deltatt i store finansieringsrunder for AI-selskaper, kjøpt andeler i teknologiselskaper og sluttet seg til konsortier for å kjøpe opp store datasenteroperatører, noe som styrket sin tilstedeværelse i hele AI-databehandlingssyklusen.

Selv om oppkjøpet av SchedMD er mer beskjedent i størrelse enn andre investeringer, er den strategiske effekten betydelig: kontroll over et kritisk verktøy for ressursplanlegging i superdatamaskiner gir Nvidia større vekt i de tekniske beslutningene som tas av skyleverandører, akademiske institusjoner og store teknologiselskaper.

I Europa, hvor utplasseringen av EU-finansierte superdatamaskiner og AI-plattformer har som mål å styrke teknologisk autonomi , vil disse konsentrasjonsbevegelsene rundt én enkelt aktør bli nøye overvåket av regulatorer, offentlige anskaffelsesmyndigheter og vitenskapelige miljøer.

Nvidias oppkjøp av SchedMD forsterker trenden med maktkonsentrasjon rundt store AI-leverandører : GPU-produsenten tar et nytt skritt mot å kontrollere ikke bare maskinvaren, men også programvaren som organiserer bruken av datakraft, i et scenario der sentre som Barcelona Supercomputing Center og andre europeiske noder vil fortsette å være avhengige av verktøy som Slurm for å få mest mulig ut av infrastrukturen sin.

Hvordan er den nye AI NVLM-modellen?
Relatert artikkel:
Nvidia lanserer NVLM, sin kraftigste AI og nye OpenAI-konkurrent

Legg til som foretrukket kilde i Google