Nvidias vd Jensen Huang meddelade på måndagen att företagets nya chipgeneration är i full produktion. De nya chippen ska enligt bolaget leverera fem gånger högre prestanda för AI-beräkningar jämfört med föregångaren.
På teknikmässan Consumer Electronics Show i Las Vegas presenterade chefen för världens högst värderade bolag nya detaljer om chipsen, som väntas lanseras senare i år. Enligt uppgifter till Reuters testas de redan i Nvidias laboratorier av AI-företag. Lanseringen sker samtidigt som Nvidia möter ökad konkurrens från både traditionella rivaler och egna kunder som utvecklat sina egna chiplösningar.
Vera Rubin-plattformen lanseras i år
Den nya plattformen Vera Rubin består av sex separata Nvidia-chips och förväntas debutera senare i år. Flaggskeppsservern innehåller 72 grafikprocessorer och 36 nya centralprocessorer. Huang demonstrerade hur de kan kopplas samman till större kluster med över 1 000 Rubin-chips, vilket enligt honom kan förbättra effektiviteten för att generera så kallade tokens – den grundläggande enheten i AI-system – med tio gånger.
För att uppnå de nya prestandaresultaten använder dock Rubin-chipsen en proprietär datatyp som företaget hoppas att den bredare industrin ska börja använda.
— Så här kunde vi leverera ett så gigantiskt steg upp i prestanda, trots att vi bara har 1,6 gånger fler transistorer, sade Huang.
Hårdare konkurrens på AI-marknaden
Medan Nvidia fortfarande dominerar marknaden för att träna AI-modeller möter företaget betydligt hårdare konkurrens när det gäller att leverera resultaten av dessa modeller till hundratals miljoner användare av chattbotar och annan AI-teknik. Konkurrenterna inkluderar både traditionella rivaler som AMD och kunder som Alphabets Google, som utvecklat egna chipslösningar.
En stor del av Huangs presentation fokuserade på hur väl de nya chipsen fungerar för just denna uppgift. Han berättade bland annat om ett nytt lagringslager kallat "context memory storage", som syftar till att hjälpa chattbotar ge snabbare svar på långa frågor och konversationer.
Nya nätverkslösningar och samarbeten
Nvidia presenterade också en ny generation nätverksswitchar med en ny typ av anslutning kallad co-packaged optics. Tekniken, som är avgörande för att koppla samman tusentals maskiner till en enhet, konkurrerar med erbjudanden från Broadcom och Cisco Systems.
Enligt Nvidia kommer CoreWeave att vara bland de första att få de nya Vera Rubin-systemen. Företaget förväntar sig också att Microsoft, Oracle, Amazon och Alphabet kommer att införa dem.
Satsning på självkörande fordon
Huang presenterade också ny mjukvara som kan hjälpa självkörande bilar att fatta beslut om vilken väg de ska ta – och lämna dokumentation som ingenjörer kan använda efteråt. Mjukvaran, kallad Alpamayo, som Nvidia visade i forskningssyfte i slutet av förra året, kommer nu att släppas mer allmänt tillsammans med träningsdata så att biltillverkare kan göra egna utvärderingar.
— Vi gör inte bara modellerna tillgängliga som öppen källkod, vi gör även det data vi använder för att träna dessa modeller tillgänglig, för endast på det sättet kan ni verkligen lita på hur modellerna kom till, sade Huang från scenen i Las Vegas.
Förvärv och Kinaexport
Förra månaden förvärvade Nvidia talanger och chipteknik från startup-företaget Groq, inklusive nyckelmedarbetare som varit avgörande för att hjälpa Alphabets Google att designa sina egna AI-chips. Trots att Google är en stor Nvidia-kund har företagets egna chips vuxit fram som ett av de största hoten mot Nvidias dominans.
Under en frågestund med finansanalytiker efter presentationen sade Huang att Groq-affären inte kommer att påverka kärnverksamheten, men kan resultera i nya produkter som utökar företagets sortiment.
Samtidigt är Nvidia angeläget om att visa att dess senaste produkter kan överträffa äldre chips som H200, som USA:s president Donald Trump har tillåtit att exporteras till Kina. Reuters har rapporterat att chippet, som var föregångaren till Nvidias nuvarande "Blackwell"-chip, är i hög efterfrågan i Kina, vilket väckt oro bland Kinakritiker över hela det amerikanska politiska spektrumet.
Huang berättade för finansanalytiker efter sin presentation att efterfrågan är stark på H200-chips i Kina. Finanschefen Colette Kress uppgav att Nvidia har ansökt om licenser för att leverera chipsen till Kina men väntar på godkännanden från USA och andra regeringar.
