NVIDIA accelera l'inferenza con Groq 3 LPX: il nuovo tassello della piattaforma Vera Rubin
NVIDIA porta in produzione Groq 3 LPX, acceleratore dedicato all'inferenza AI a bassissima latenza, integrato nella piattaforma Vera Rubin. Il sistema raggiunge 3.400 token al secondo nei test Artificial Analysis e sarà adottato per primo da Nebius. L'obiettivo è accelerare gli agenti AI senza sostituire le GPU tradizionali.