Nvidia met Groq 3 LPX en production, mais ses 3400 tokens/s restent à vérifier
Une réponse d’agent IA ne se joue plus seulement sur la qualité du modèle, mais sur le temps nécessaire pour générer chaque token, appeler un outil et relancer le raisonnement. Avec Groq 3 LPX, Nvidia veut s’attaquer à ce dernier kilomètre : celui où la puissance de calcul devient...