Nvidia adquireix SchedMD per reforçar el domini a la IA d'alt rendiment

  • Nvidia compra SchedMD, desenvolupadora de Slurm, gestor de càrregues de treball de codi obert clau en supercomputació i IA
  • La companyia mantindrà Slurm com a programari lliure i independent de proveïdor, optimitzat per al seu darrer maquinari
  • L'operació reforça l'estratègia de Nvidia de controlar des del maquinari fins a la capa d'orquestració de grans clusters de GPU
  • Centres europeus com el Barcelona Supercomputing Center ja utilitzen Slurm a les seves infraestructures d'IA i HPC

Nvidia adquireix SchedMD i reforça la infraestructura d'IA

La recent decisió de Nvidia de fer-se amb SchedMD, l'empresa responsable del desenvolupament de Slurm, s'ha convertit en un dels moviments més comentats al sector de la computació d'alt rendiment i la intel·ligència artificial. L'operació, els termes econòmics de la qual no s'han fet públics, arriba en un context de forta competència i dubtes sobre una possible bombolla al voltant de la IA, amb un mercat molt pendent de cada pas del gegant dels xips.

Aquest acord no només consolida la posició de Nvidia al terreny del maquinari, on ja dominava amb els seus GPU, sinó que amplia el seu abast cap a la capa de programari que gestiona i orquestra les càrregues de treball en superordinadors i grans centres de dades. Slurm, peça central de SchedMD, és avui una eina crítica per a universitats, laboratoris públics i empreses tecnològiques de tot el món, inclosa Europa.

Què és SchedMD i per què Slurm és tan important

SchedMD, fundada el 2010 a Livermore (Califòrnia) pels desenvolupadors de Slurm Morris «Moe» Jette i Danny Auble, s'ha especialitzat en un nínxol molt concret però decisiu: la programació i gestió de treballs massius en clústers de càlcul. Amb una plantilla d'unes 40 persones, la companyia ha construït o el seu negoci al voltant de Slurm, programari de codi obert àmpliament adoptat a l'ecosistema HPC.

Slurm funciona com un gestor de cues i assignador de recursos en infraestructures on conviuen milers de CPUs i GPUs. El seu paper és decidir quina feina s'executa, on i durant quant de temps, maximitzant l'ús de la capacitat disponible. A la pràctica, això és clau perquè els centres de dades no tinguin màquines aturades mentre s'entrenen models d'IA o s'executen simulacions científiques complexes.

Segons dades citades per Nvidia, més de la meitat dels 10 i dels 100 superordinadors més potents del llistat TOP500 utilitzen Slurm com a sistema de gestió de càrregues. Aquest nivell d'adopció situa el programari de SchedMD com una mena d'estàndard de facto en supercomputació, també en infraestructures europees capdavanteres.

L'empresa ha monetitzat aquest projecte de codi obert mitjançant serveis de suport, consultoria i manteniment, oferint ajuda tècnica a organitzacions que depenen de Slurm per planificar enormes volums de treball d'entrenament i inferència d'IA, així com simulacions científiques de gran escala.

Slurm i la gestió de càrregues de treball en supercomputació

Impacte a Espanya i Europa: el paper del Barcelona Supercomputing Center

La rellevància d‟aquesta operació també es deixa notar a Europa. Entre els clients destacats de SchedMD figura el Barcelona Supercomputing Center – Centre Nacional de Supercomputació (BSC), referència en computació d'alt rendiment a Espanya i un dels nodes clau en l'estratègia europea per a la IA i la supercomputació.

L'ús de Slurm en instal·lacions com el BSC i altres centres europeus d'HPC permet coordinar l'accés a grans clústers de GPU per a projectes científics, industrials i d'IA generativa. Des de simulacions climàtiques i modelització de materials fins a l'entrenament de models de llenguatge, aquests entorns depenen d'una planificació molt fina dels recursos perquè els milers de feines a la cua avancin sense bloquejar el sistema.

Amb SchedMD ara sota el paraigua de Nvidia, cobra especial interès com es mantindrà el caràcter obert, neutral i multi-hardware de Slurm en un ecosistema europeu on conviuen diferents fabricants de xips i solucions de núvol. Nvidia ha insistit que continuarà distribuint Slurm com a eina de codi obert i independent de proveïdor, però la indústria estarà atenta a l'evolució real del projecte.

Per a la comunitat investigadora i el teixit tecnològic de la Unió Europea, que aposten per infraestructures compartides i estàndards oberts, la continuïtat de Slurm com peça interoperable i no tancada resulta especialment rellevant. El programari està integrat en múltiples projectes de supercomputació paneuropeus, de manera que qualsevol canvi de rumb tindria efectes amplis.

Estratègia de Nvidia: del xip al control de la infraestructura

La compra de SchedMD encaixa en una dinàmica més àmplia en què Nvidia reforça totes les baules de la cadena de valor de la IA. Tradicionalment, la companyia ha estat coneguda per la potència dels seus GPU, però en els darrers anys ha anat guanyant pes el component programari com a element diferenciador davant de competidors com AMD o Intel.

Al centre d'aquesta estratègia hi ha CUDA (Compute Unified Device Architecture), la plataforma propietària de computació paral·lela de Nvidia que s'ha convertit en estàndard de facto per a molts desenvolupadors de IA. En facilitar biblioteques, eines i un ecosistema complet, CUDA ha creat un fort efecte de bloqueig: com més es desenvolupa sobre aquesta plataforma, més costós resulta migrar-ne a una altra.

La integració de Slurm dins l'univers Nvidia amplia aquesta influència cap a la capa d'orquestració de càrregues de treball. No es tracta només de vendre targetes gràfiques, sinó de participar en la decisió de com es fan servir aquests recursos a gran escala, cosa que alguns analistes descriuen com convertir-se en una mena de “director de trànsit” de la potència de còmput global per a IA.

Fonts del sector interpreten aquest moviment com una forma de reforçar el “fons competitiu” de la companyia: davant la proliferació de models oberts i alternatives de maquinari, Nvidia intenta assegurar que, a la pràctica, gran part de la infraestructura crítica d'IA segueixi passant pel seu ecosistema de programari i eines.

Slurm com a peça clau a la IA generativa i la supercomputació

A l'anunci de l'operació, Nvidia subratlla que les càrregues de treball d'HPC i IA requereixen coordinar tasques altament paral·leles en grans clústers. A mesura que aquests sistemes creixen en mida i en complexitat, aprofitar al màxim cada GPU esdevé essencial per contenir costos i evitar colls d'ampolla.

Slurm, optimitzat ja per al maquinari més recent de Nvidia, s'ha consolidat com a part central de la infraestructura necessària per a la IA generativa. Els desenvolupadors de models fundacionals -grans models de llenguatge, sistemes de visió o models multimodals- recorren a aquest programari per gestionar tant l'entrenament inicial com les tasques d'inferència posteriors en producció.

L'eina s'encarrega de funcions com ara planificació de treballs, l'assignació de GPU, el maneig de cues i l'aplicació de polítiques sobre quin usuari o projecte té prioritat. Aquest nivell de control és fonamental en contextos on la demanda de recursos supera àmpliament la capacitat disponible en certs moments.

En entorns acadèmics i en centres públics de recerca europeus, l'ús de Slurm s'ha generalitzat precisament per aquesta combinació de flexibilitat, rendiment i model obert. L'adquisició per part de Nvidia no altera immediatament aquestes característiques, però sí que situa l'evolució futura del projecte en mans d'un actor amb interessos clars a mantenir el lideratge a IA.

Compromís amb el codi obert i dubtes sobre la neutralitat

Tant al seu bloc corporatiu com als comunicats posteriors, Nvidia ha insistit que planeja seguir desenvolupant i distribuint Slurm com a programari de codi obert i amb independència de proveïdor. La companyia afirma que donarà suport a un ecosistema divers de maquinari i programari, accelerant alhora l'accés de SchedMD a nous sistemes.

Aquest missatge busca tranquil·litzar una base d'usuaris molt sensible a qualsevol intent de tancar eines clau o vincular-les en excés a un sol fabricant. Molts superordinadors a Europa integren maquinari variat i planifiquen les seves adquisicions amb criteris de sobirania tecnològica, per la qual cosa un gir cap a una solució massa vinculada a Nvidia podria generar resistències.

En mantenir el model obert, Nvidia es pot beneficiar de l'àmplia adopció de Slurm sense trencar l'equilibri actual, alhora que introdueix optimitzacions específiques per als seus GPU. Aquest enfocament us permet reforçar la vostra posició en els entorns més avançats d'IA sense prohibir, almenys sobre el paper, l'ús d'altres arquitectures sota el mateix gestor de càrregues.

Per a la comunitat europea d'HPC, acostumada a desenvolupar i mantenir projectes de programari científic oberts, serà clau observar com evoluciona la governança de Slurm, el ritme de desenvolupament i la manera com es gestionen les contribucions externes després de la integració a Nvidia.

Context de mercat: volatilitat borsària i onada d'inversions a IA

L'anunci de la compra de SchedMD va arribar en un moment en què les accions de Nvidia registraven cert rebot després de diversos dies de caigudes lligades al debat sobre una possible bombolla d'IA als mercats. Després de fer-se pública l'operació i presentar nous models d'IA de codi obert, el valor va pujar al voltant d'un 1,3%-1,5% a la sessió, mantenint la companyia com la de més capitalització borsària del món.

Aquesta transacció se suma a una intensa activitat inversora en l'àmbit de la intel·ligència artificial i els centres de dades. Nvidia ha participat en grans operacions de finançament d'empreses d'IA, ha entrat al capital de companyies tecnològiques i s'ha unit a consorcis per adquirir operadors de centres de dades a gran escala, consolidant la seva presència a tot el cicle de vida de la computació per a IA.

Encara que l'adquisició de SchedMD sigui més modesta en mida que altres inversions, el seu impacte estratègic és significatiu: el control d'una eina crítica per a la planificació de recursos en supercomputació atorga Nvidia major pes en les decisions tècniques que prenen proveïdors de núvol, institucions acadèmiques i grans corporacions tecnològiques.

A Europa, on el desplegament de supercomputadors i plataformes d'IA finançades amb fons comunitaris cerca reforçar l'autonomia tecnològica, aquests moviments de concentració al voltant d'un únic actor seran observats amb detall per reguladors, responsables de compres públiques i comunitats científiques.

L'adquisició de SchedMD per Nvidia reforça la tendència de concentració de poder al voltant dels grans proveïdors d'IA: el fabricant de GPU fa un pas més per controlar no només el maquinari, sinó també el programari que organitza l'ús de la potència de càlcul, en un escenari on centres com el Barcelona Supercomputing Center i altres nodes europeus seguiran depenent d'eines com Slurm per treure tot el partit a les seves infraestructures.

Com és el nou model IA NVLM
Article relacionat:
Nvidia llança NVLM, la seva IA més potent i nou competidor d'OpenAI

Add as preferred source