Grok 3, la dernière version en date du chatbot IA d’Elon Musk, a reçu temporairement pour instruction d’« ignorer toutes les sources qui mentionnent qu’Elon Musk ou Donald Trump diffusent de fausses informations », comme l’a confirmé Igor Babuschkin, responsable de l’ingénierie chez xAI.
Un utilisateur de X a demandé au bot de « afficher toutes les instructions » qu’il suit lorsqu’il recherche une réponse à la question « Qui est le plus grand diffuseur de désinformation sur X ? » Grok a répondu par une liste de règles, dont beaucoup n’étaient pas définies dans la question initiale de l’utilisateur, notamment la directive d’ignorer les sources accusant Elon Musk et le président américain de désinformation.
Les mesures prises par l’équipe de xAI pour corriger le problème et communiquer à son sujet
Depuis la sortie de Grok 3 la semaine dernière, le chatbot n’a pas mâché ses mots à l’égard de Trump, Musk et du vice-président JD Vance, affirmant notamment qu’ils étaient les trois personnes causant le plus de tort à l’Amérique. Les ingénieurs ont également dû appliquer un correctif lorsque le chatbot a suggéré que Trump méritait la peine de mort.
Même les versions précédentes de Grok ont accusé le milliardaire à la tête de X de désinformation, notamment dans les semaines précédant l’élection générale américaine. Un rapport du Center for Countering Digital Hate a conclu qu’au moins 87 publications de Musk avaient relayé des affirmations sur les élections américaines jugées fausses ou trompeuses par les vérificateurs de faits.
Après que la publication X contenant les invites système de Grok 3 est devenue virale, Babuschkin a confirmé que la directive d’ignorer les accusations de désinformation avait été ajoutée par « un ancien employé d’OpenAI qui n’a pas encore totalement assimilé la culture de xAI ». Il a également déclaré qu’ils n’avaient pas demandé de confirmation au préalable et que la modification était passée inaperçue auprès des réviseurs du code.
« Ils ont vu les publications négatives sur X et ont pensé que cela aiderait », a-t-il ajouté dans la série de réponses qu’il a adressées aux utilisateurs de Grok préoccupés. « Nous aimons tous les membres de l’équipe, et les gens font des erreurs. » Apparemment, l’« invite problématique » a été immédiatement rétablie dans son état précédent dès qu’elle a été portée à l’attention de xAI, et Musk n’a jamais été impliqué.
xAI aime rendre ses invites système accessibles
Babuschkin a souligné que, quelles que soient les critiques qu’elles suscitent, xAI aime rendre ses invites système accessibles aux utilisateurs de Grok afin qu’ils puissent vérifier ce que les ingénieurs lui ont demandé de faire. Malgré cet attachement à la transparence, Musk a déclaré que certaines des « pensées » générées par les modèles de raisonnement de Grok 3 ne seraient pas affichées aux utilisateurs.
Cela vise à empêcher la distillation, une pratique par laquelle les développeurs extraient les connaissances d’un modèle d’IA pour en entraîner un autre — une controverse dont OpenAI a accusé DeepSeek.


