J’ai besoin… besoin de vitesse.
OpenAI, le créateur de ChatGPT, vient d’annoncer un partenariat majeur qui promet de fournir les réponses d’IA les plus rapides jamais observées.
OpenAI a annoncé le 14 janvier une alliance avec le spécialiste des puces d’IA Cerebras Systems afin d’intégrer 750 mégawatts de puissance de calcul à latence ultrafaible à sa plateforme. Selon des sources de CNBC, des initiés du secteur au fait de l’accord ont confirmé que son montant dépassait 10 milliards de dollars. La capacité de calcul sera déployée en plusieurs phases à partir de 2026, avec une mise en œuvre complète prévue d’ici 2028.
À huis clos
L’alliance entre ces entreprises spécialisées dans l’IA ne s’est pas faite du jour au lendemain. Cerebras a confirmé que les deux sociétés collaboraient en coulisses depuis 2017, leurs équipes se réunissant régulièrement pour partager leurs travaux de recherche et de développement. Cette longue période de rapprochement laisse penser que le partenariat est le fruit d’une manœuvre stratégique soigneusement orchestrée, plutôt qu’une réponse précipitée aux pressions du marché.
Cerebras apporte une technologie unique avec ses Wafer-Scale Engines (WSE), des processeurs capables de fournir des réponses d’IA jusqu’à 15 fois plus rapidement que les systèmes traditionnels fondés sur des GPU. Le fabricant de puces se présente comme un concurrent direct du géant du secteur Nvidia, qui domine actuellement le marché du matériel informatique pour l’IA. Une fois entièrement déployée, cette infrastructure constituera, selon Cerebras, le plus grand système mondial d’inférence d’IA à haute vitesse.
Pour les utilisateurs
L’intégration promet de transformer la manière dont les utilisateurs vivent leurs interactions avec l’IA dans tous les produits d’OpenAI. Lorsqu’ils soumettent des requêtes complexes, génèrent du code, créent des images ou exécutent des agents d’IA, le temps de réponse pourrait être considérablement réduit. Des réponses d’IA en temps réel incitent les utilisateurs à interagir plus souvent, à rester plus longtemps sur les plateformes et à s’attaquer à des tâches plus sophistiquées.
Sachin Katti, de l’équipe chargée de l’infrastructure de calcul d’OpenAI, a expliqué que des réponses plus rapides permettent des interactions plus naturelles et offrent une base plus solide pour déployer l’IA en temps réel auprès d’un public plus large. OpenAI prévoit d’intégrer progressivement cette capacité à latence réduite dans ses processus d’inférence, en l’étendant par phases à différents types de charges de travail. Cette approche s’inscrit dans la stratégie informatique plus large d’OpenAI, qui consiste à adapter des systèmes spécialisés aux exigences de chaque charge de travail.
Entrée en bourse
Ce partenariat intervient à un moment crucial pour Cerebras, qui navigue sur le chemin complexe menant à une entrée en bourse. L’entreprise a déposé une demande d’introduction en bourse auprès de la Securities and Exchange Commission en 2024, avant de retirer son projet en octobre 2025. Désormais, des sources de Bloomberg rapportent que Cerebras cherche à lever environ 1 milliard de dollars sur la base d’une valorisation préinvestissement de 22 milliards de dollars.
Cet accord avec OpenAI marque un changement susceptible de renforcer la position de Cerebras en vue de ses futures ambitions sur les marchés publics, tout en validant sa technologie au plus haut niveau du développement de l’IA.
Dans un secteur où chaque milliseconde compte et où les utilisateurs exigent des réponses instantanées, cet accord donne à OpenAI un coup de pouce bienvenu dans l’intense course à l’IA.
OpenAI devrait revenir sur la scène du Super Bowl cette année, avec l’intention de diffuser un spot publicitaire de 60 secondes pendant la retransmission du Super Bowl LX sur NBC.

