Groq lève de nouveaux capitaux pour miser davantage sur l’inférence IA.
L’entreprise d’infrastructure IA basée à San Francisco a confirmé le 22 juin une levée de fonds de 650 millions de dollars pour développer son cloud d’inférence IA, environ six mois après la signature par Nvidia d’un accord de licence non exclusif portant sur la technologie de Groq et le recrutement de plusieurs cadres clés.
Cette levée place clairement l’inférence au cœur de la stratégie de Groq, c’est-à-dire la partie du calcul IA qui exécute les modèles après leur entraînement.
Groq se recentre davantage sur l’inférence
Groq a annoncé une levée de 650 millions de dollars en capital de croissance pour accélérer le développement de son cloud d’inférence IA. Le tour a été mené par Disruptive et Infinitum, avec la participation d’investisseurs.
L’entreprise a indiqué que ces fonds soutiendraient le déploiement de son infrastructure mondiale, notamment 13 centres de données en Amérique du Nord, en Europe, au Moyen-Orient et dans la région APAC. Groq a souligné qu’elle servait plus de cinq millions de développeurs et des milliers d’entreprises nativement IA, en traitant chaque semaine des milliers de milliards de jetons IA.
Groq a également indiqué qu’elle prévoyait de passer à 200 MW d’ici à la fin de 2027.
Alex Davis, président de Groq et PDG de Disruptive, a déclaré dans un communiqué, « Groq a consacré des années à développer la technologie, l’infrastructure et l’expertise opérationnelle nécessaires à la prochaine phase de l’IA. »
Cette levée intervient après un important changement d’orientation stratégique. TechCrunch a rapporté que Nvidia avait signé en décembre un accord de licence non exclusif portant sur la technologie de Groq et recruté le fondateur et PDG de Groq, Jonathan Ross, son président Sunny Madra ainsi que d’autres salariés. Groq n’a pas communiqué sa nouvelle valorisation.
La dernière valorisation de l’entreprise s’élevait à 6,9 milliards de dollars, après une levée de 750 millions de dollars en septembre.
L’inférence devient le nouvel enjeu
L’argumentaire de Groq repose sur l’idée que l’infrastructure IA passe de l’entraînement de grands modèles à leur exécution à grande échelle.
L’entraînement est le travail coûteux qui consiste à construire les modèles. L’inférence intervient lorsque les utilisateurs demandent à ces modèles de générer des réponses, d’écrire du code, de résumer des documents ou d’alimenter des applications d’IA en temps réel.
À mesure que les entreprises passent de l’expérimentation à la production, nous anticipons une hausse rapide de la demande en inférence.
Groq a déclaré qu’à terme, l’inférence nécessiterait entre 15 et 20 fois plus de capacités de calcul que l’entraînement.
« À mesure que l’IA passe de l’expérimentation à la production, la demande en inférence fiable et économique continuera de croître de manière exponentielle », a déclaré John Yetimoglu, membre du conseil d’administration de Groq, fondateur et directeur des investissements d’Infinitum, dans le communiqué de l’entreprise.
C’est le marché que Groq cherche à conquérir. L’entreprise a indiqué que sa stratégie actuelle avait commencé après l’accord avec Nvidia, lorsque son conseil d’administration, ses investisseurs et sa direction ont recentré l’activité sur la création d’un cloud d’inférence IA de premier plan.
De nouveaux dirigeants arrivent après l’accord avec Nvidia
Groq reconstitue également son équipe dirigeante.
TechCrunch a rapporté que Doug Wightman, qui avait cofondé Groq avec Ross, était resté dans l’entreprise après l’accord avec Nvidia.
L’annonce de Groq désignait Adam Winter comme PDG et Matt Eng comme directeur financier, les présentant tous deux comme des dirigeants de longue date ayant développé la technologie, l’infrastructure et les activités commerciales de l’entreprise. L’entreprise a également nommé Alan Rice au poste de directeur des opérations. Rice a auparavant travaillé chez xAI et Meta Datacenters, après une carrière dans les opérations liées aux sous-marins nucléaires de la marine américaine.
À partir de juillet, Groq a indiqué qu’elle accueillerait Sinclair Schuller au poste de directeur de la technologie et Rakesh Malhotra à celui de directeur produit. Tous deux avaient auparavant travaillé ensemble chez Apprenda, avant de cofonder Nuvalence, rachetée par EY en 2024.
Malhotra a également passé environ dix ans chez Microsoft à travailler sur des produits liés au cloud, à la gestion des centres de données et au stockage d’entreprise.
La concurrence s’intensifie dans le cloud IA
La levée de Groq montre à quel point l’attention des investisseurs se porte désormais sur l’inférence, à mesure que les outils d’IA deviennent une infrastructure du quotidien.
L’entreprise reste toutefois confrontée à un environnement concurrentiel difficile. Nvidia est désormais plus étroitement liée à la technologie d’inférence de Groq par l’intermédiaire de l’accord de licence. Nvidia a annoncé son propre système matériel d’inférence Groq 3 LPX lors du GTC en mars.
Pour Groq, la question est de savoir si un cloud d’inférence spécialisé peut se démarquer alors que des entreprises d’IA, des fournisseurs de cloud et des fabricants de puces se livrent tous à une course pour réduire les coûts et accélérer l’exécution des modèles. Ces nouveaux fonds donnent à Groq davantage de marge de manœuvre pour tenter sa chance.
Cela illustre également une évolution plus large de l’infrastructure IA, où le prochain champ de bataille pourrait être la capacité à exécuter les modèles rapidement, de manière fiable et à moindre coût pour des millions d’utilisateurs.
À lire aussi : Amazon serait en discussions pour vendre ses puces IA personnalisées alors que la demande pour des alternatives aux composants de Nvidia augmente.

