Vous savez comment les meilleures décisions sont généralement prises lorsque des personnes brillantes débattent entre elles ? xAI, l’entreprise d’Elon Musk, vient d’intégrer ce principe à une IA.
Grok 4.20 est sorti lundi et repose sur une architecture fondamentalement différente. Au lieu qu’une seule IA génère votre réponse, quatre agents spécialisés travaillent simultanément, débattent en temps réel, puis vous transmettent leur consensus.
Voici l’équipe
- Grok (le coordinateur) : décompose votre question, attribue les tâches, tranche les désaccords et fournit la réponse finale.
- Harper (le chercheur) : récupère des données en temps réel sur le Web et dans le flux massif de X, qui compte environ 68 millions de publications quotidiennes en anglais, pour vérifier instantanément les faits.
- Benjamin (le logicien) : s’occupe des mathématiques, du code et du raisonnement étape par étape. C’est lui qui met à l’épreuve la logique de tous les autres.
- Lucas (le créatif) : explore d’autres angles, reformule pour plus de clarté et ajoute les idées auxquelles personne d’autre n’avait pensé.
Pourquoi c’est vraiment important : les hallucinations ont reculé de 65 % lors des premiers tests. Lorsqu’un agent affirme avec assurance quelque chose d’erroné, un autre le détecte avant même que vous ne voyiez le résultat. C’est une évaluation par les pairs à la vitesse des machines.
En pratique, les résultats sont saisissants. Lors d’une compétition de trading d’actions en direct (Alpha Arena Saison 1.5), Grok 4.20 a été le seul modèle d’IA rentable, transformant 10 k$ en environ 11 k$ à 13,5 k$, tandis que les concurrents d’OpenAI et de Google ont terminé dans le rouge. Quatre des six premiers étaient des variantes de Grok 4.20.
Une réserve…
Nous sommes encore en phase bêta. xAI affirme que la version actuelle n’est que le modèle de base « small » doté de 500 milliards de paramètres ; la version complète est toujours en cours d’entraînement. Et Elon étant Elon, il a publié la sortie sur X sans annonce officielle ni résultats de référence. Voilà pourquoi il nous a fallu si longtemps pour en parler. Ce n’était VRAIMENT pas un lancement complet.
Le plus intéressant ? Il est disponible avec les comptes gratuits. Vous pouvez vous rendre dès maintenant sur grok.x.ai, lui poser une question complexe et regarder les quatre agents réfléchir en temps réel grâce à une interface en direct. Les formules payantes (SuperGrok à 30 $/mois) offrent des réponses plus rapides et l’accès au mode « Heavy » qui mobilise jusqu’à 16 agents pour des problèmes nécessitant un niveau de recherche.
Voici comment le tester vous-même
- Question à perspectives multiples : demandez « Quels sont les arguments les plus solides pour et contre le télétravail ? » et regardez les agents véritablement se contredire avant de faire la synthèse.
- Tâche riche en faits : demandez des statistiques précises tirées d’un rapport récent. Harper consultera des sources en temps réel, tandis que Benjamin vérifiera les chiffres.
- Débogage de code : collez du code défectueux. Benjamin rédigera la correction, Harper vérifiera la documentation et Lucas proposera une approche plus élégante.
Cela ressemble à un changement architectural important. Tous les autres grands laboratoires (OpenAI, Google, Anthropic) continuent de proposer une inférence sur modèle unique (du moins à notre connaissance) : un cerveau, une réponse. xAI parie sur un avenir où des équipes de modèles débattent pour produire de meilleurs résultats. Si le Grok 4.20 complet tient ses promesses une fois son entraînement terminé, les autres laboratoires devront décider s’ils veulent suivre.
Ou alors, vous savez, ils pourraient simplement se donner la main et trouver la solution ensemble. Ah, attendez…
Note de la rédaction : ce contenu a d’abord été publié dans la newsletter de notre publication sœur, The Neuron. Pour lire davantage d’articles de The Neuron, inscrivez-vous à sa newsletter ici.


