Aukeratu zure herrialdea edo eskualdea.

NVIDIA Groq 3 LPX racken ekoizpen masiboa hastearazten hasi da 20.000 milioi dolarreko teknologia-akordioaren ondoren

Abuztuaren 24an, astelehena, NVIDIAk iragarri zuen Groq 3 LPX rack-eskala sistema ekoizpen masibora iritsi dela, iaz 20.000 milioi dolar balio izan zuen Groq-rekin lotutako transakzioaren bidez lortutako teknologia komertzialki ezarriz. Late latentzizko AI agenteen inferentziarako diseinatuta, sistema Vera Rubin plataformaren parte bilakatuko da eta token sortzean GPUen errendimendu-mugak tratatuko ditu.

Dion Harris, NVIDIAko zuzendaritzako zuzendaria, esan zuen lehen Groq 3 LPX rackak Nebiuseko hodeiko zerbitzu hornitzailearen plataforman ezarriko direla. Vera CPUekin eta Rubin GPUekin konbinatuta, zerbitzuak eskaintzen hasi beharreko heterogeneo konputazio kluster oso bat osatuko dute 2026ko bigarren erdialdean.

LPX rack bakoitzak 256 Groq 3 Hizkuntzaren Prozesatzeko Unitate integratzen ditu, edo LPU. Sistemak SRAM handiak erabiltzen ditu kanpoko memoria eskuratzearekin lotutako gainkostua murrizteko eta luzerako testuinguru leihoak eta erantzun azkarrak eskatzen dituzten inferentzia lan karga optimizatzeko, AI agenteak eta AI lagundutako programazioa barne. Emaitza ofizialen arabera, rackak 3.400 irteera token eskaintzen ditu segundo batean Gemma 4 31B modeloarekin 100.000 tokeneko testuinguru leihoarekin funtzionatzean, latentzian sentibera lan kargetan errendimendu abantaila argia emanez.

NVIDIA eta Groq 2025eko abenduan iritsi ziren 20.000 milioi dolarreko akordio batera. Transakzioaren arabera, NVIDIAk Groq-ren txip arkitekturako teknologia lizentziak lortu zituen eta Groq-ren sortzaile taldea eta ingeniaritza langile nagusiak enpresara ekarri zituen. NVIDIAren historian teknologia transakziorik handiena izan zen. Groq enpresa independente gisa geratu zen, eta bere existentzia hodeiko negozioa jarraitu zuen. Akordioa baino lehen, Groq-k industria arreta handia lortu zuen bere latentzia baxuko LPU inferentzia teknologiarekin, iturrizko hizkuntza modelo handiekin erabiltzen dena.

Vera Rubin plataformak desagregatutako, heterogeneo inferentzia arkitektura bat erabiltzen du. Rubin GPUek modeloaren aurrezteko operazioak eta testuinguru prozesatze handi mota kudeatzen dute, Groq 3 LPX sistemek, aldiz, dekodeta fasean token generazio azkarrari egiten diote arreta. Vera CPUek helburu orokorreko lan kargak, esate baterako, tresna deiak eta kode exekuzioa, betetzen dituzte. Lan karga hauen banaketak prozesadore ezberdinek AI agenteen lan fluxu osoa euren indarberritzeen arabera laguntzea ahalbidetzen du.

Txip ekoizpen akordioek hornidura katean dauden desberdintasunak ere islatzen dituzte. Groq-seriako LPUak Samsung-ek ekoitzten ditu, aldez aurretik, NVIDIAren ohiko GPUak TSMCren ekoizpen kapasitatearekin ekoizten dira.