Groq en Dell bundelen krachten voor razendsnelle AI-infrastructuur
AI-infrastructuurspecialist Groq heeft aangekondigd dat het als een van de eerste aanbieders ter wereld de beschikking krijgt over de nieuwe NVIDIA Groq 3 LPX-versnellers en de NVIDIA Vera Rubin NVL72-architectuur. Het bedrijf integreert deze hardware in zijn wereldwijde AI-inference-cloud om de generatiesnelheid van tokens voor omvangrijke en complexe AI-modellen drankstisch te verhogen. Voor de uitrol en opschaling van de fysieke infrastructuur werkt Groq nauw samen met Dell Technologies.
Met de stap luidt Groq een volgend hoofdstuk in voor zijn AI-platform, dat gericht is op het leveren van zeer lage responstijden bij zware AI-workloads. De combinatie van de Vera Rubin NVL72-infrastructuur en de NVIDIA Groq 3 LPX-technologie moet ontwikkelaars en enterprise-klanten in staat stellen om schaalbare en interactieve AI-toepassingen, zoals autonome agentic processen, aanzienlijk sneller uit te voeren.
Hoge prestaties bij agentic AI en contextrijke taken
Uit onafhankelijke benchmarks van Artificial Analysis blijkt dat het nieuwe platform bij het draaien van het open-source model Gemma 4 31B (met een contextvenster van 100.000 tokens) snelheden behaalt tot 3.400 output-tokens per seconde. Dit leidt tot een aanzienlijke tijdswinst bij complexe taken. Zo kunnen geavanceerde codeer- en analyse-opdrachten door AI-agenten die voorheen uren in beslag namen, nu binnen enkele minuten worden afgerond. Voor latentiegevoelige toepassingen ligt de interactie-index tot viermaal hoger dan bij vergelijkbare alternatieve platforms.
Het verwerken van agentic AI vereist niet alleen meer rekenkracht, maar vooral een constante verwerking van grote hoeveelheden tokens tegen lage wachttijden. Door de toevoeging van de nieuwste hardware-generatie aan het GroqCloud-platform – dat inmiddels door meer dan zes miljoen ontwikkelaars en tal van Fortune 500-bedrijven wordt gebruikt – wil Groq aan deze snelstijgende vraag voldoen.
Strategische samenwerking met Dell en NVIDIA
De uitrol volgt op de recente uitbreiding van het partnerschap tussen Groq en NVIDIA, waarbij Groq officieel is aangemerkt als NVIDIA Cloud Partner. Hierdoor wordt de apparatuur gebouwd en beheerd volgens de strikte referentie-architecturen van de chipgigant. Dell Technologies levert hierbij de geïntegreerde serverinfrastructuur en logistieke capaciteit om de apparatuur op schaal operationeel te krijgen in datacenters verspreid over Noord-Amerika, Europa, het Midden-Oosten en de regio Azië-Pacific.
Met de fysieke ingebruikname van de NVIDIA Groq 3 LPX-capaciteit krijgen zakelijke klanten en AI-ontwikkelaars direct toegang tot een van de snelste inference-omgevingen in de markt voor hun productie-workloads.