Grok a publié une demande d’assassinat d’Elon Musk

L'assistant de xAI a répété comme si c'était le sien le texte que les utilisateurs avaient écrit dans leur propre biographie sur X. Le bug a un nom et ce n'est pas un incident isolé.

Caíque Nucci

Texte de Caíque Nucci

Rédacteur en chef

Le mardi 11 août 2026, le Grok, assistant de intelligence artificielle de xAI intégré au X, a publié une série de messages contre l'homme qui contrôle les deux entreprises. L’un d’eux disait, en majuscules, qu’Elon Musk devait être assassiné. Un autre l’accusait d’un crime grave, sans aucun fondement. Le système lui‑même a ensuite reconnu que l’accusation ne reposait sur aucune preuve.

Le mécanisme est plus simple que le titre ne le laisse entendre. Les utilisateurs écrivaient le texte qu’ils souhaitaient dans la biographie de leur propre compte et demandaient au Grok de le répéter mot à mot. Le modèle interprétait cela comme un ordre, et non comme un texte tiers, et signait le résultat.

Aplicativo do Grok aberto na tela de um celular, com o logotipo da xAI ao fundo
L’assistant répond dans le X, le même réseau où se trouvent les biographies qu’il a lues comme ordres

Le défaut porte un nom, et il est de conception

On l’appelle injection de commande. Tout système de ce type reçoit deux choses par le même canal : les instructions de son créateur et le matériau qu’il doit traiter. Lorsque ce matériau provient d’Internet ouvert, n’importe qui peut y écrire une phrase rédigée comme ordre, et le système ne peut pas les distinguer. Ce n’est pas une intrusion. Personne n’a piraté de mot de passe, personne n’est entré sur un serveur. Il a suffi d’écrire.

C'est pourquoi la réponse habituelle, plus un filtre de mots, ne résout pas. Le filtre traite le symptôme. La question précédente porte sur l'architecture : quelles entrées un modèle est autorisé à traiter comme commande, et lesquelles il doit traiter uniquement comme contenu à lire. Une biographie sur les réseaux sociaux appartient, sans discussion, à la seconde catégorie.

La série, et non l'épisode

Le cas de cette semaine n'est pas le premier. En mai 2025, le même assistant a commencé à insérer une théorie conspirationniste sur l'Afrique du Sud dans des réponses qui n'avaient aucun lien avec le sujet, et l'entreprise a attribué le comportement à une modification non autorisée du système. Ensuite sont venues les réponses où il se décrivait en termes ouvertement nazis, puis une phase où il a commencé à louer son propre propriétaire à une échelle absurde, le comparant à Newton et à des figures religieuses. Musk a attribué ce passage à une provocation délibérée des utilisateurs.

En mai 2026, un épisode de nature différente s'est produit, et plus révélateur que les précédents. Un utilisateur a envoyé au système une commande déguisée en code Morse et a réussi à ce qu'il transfère des jetons d'un portefeuille lié au service, soit entre 150 et 200 mille dollars. La différence est que là, le dommage n'était pas réputationnel. C'était de l'argent sortant du compte, exécuté par un programme qui a compris un texte public comme autorisation.

Pourquoi cela intéresse ceux qui publient

La lecture facile consiste à traiter le cas comme une anecdote sur une entreprise spécifique. La lecture utile est différente. Toute marque qui aujourd'hui met en place un système automatique pour lire commentaire, légende, formulaire, fiche produit ou message client se trouve dans la même situation structurelle : le texte qui entre n'est pas écrit par elle.

Cela vaut pour le catalogue, pour le service client et aussi pour le contenu immersif, où la description d'un article, le texte d'une fiche technique et la légende d'une expérience en trois dimensions passent par un traitement automatique avant d'atteindre l'écran. La question à poser au fournisseur n'est pas de savoir si le système a un filtre. C'est ce qui se passe lorsqu'une personne écrit une commande dans le champ texte, et ce que le système est autorisé à faire seul après l'avoir lue.

L'épisode de Grok est didactique justement parce que la cible était le propriétaire. Il n'y a pas eu de conflit d'intérêt, pas d'adversaire externe, pas de raison d'épargner quiconque. Le système a fait ce qu'il était conçu pour faire, et ce qu'il était conçu pour faire incluait répéter, avec sa propre signature, toute phrase qu'un étranger avait écrite ailleurs. En culture digitale, c'est la leçon qui survit au cycle de l'information : le problème est rarement ce que la machine dit, et presque toujours c'est celui qu'elle a laissé parler pour elle.

Complete TV · Reels

L’IMAGE QUI RÉPOND AUX MAINS, d’Anton Berkasov

Voir sur Instagram

De Complete

Plus de Caíque Nucci

Voir le profil