La puce vise à faciliter et améliorer le déploiement d'agents IA pour les entreprises en réduisant la latence.
Nvidia lance son accélérateur d'inférence Groq 3 LPX, promettant de résoudre les problèmes de latence de décodage. Mais est-ce vraiment la solution miracle pour les entreprises ou juste un autre gadget à la mode ?