Grok publicó un pedido de asesinato de Elon Musk

El asistente de xAI repitió como si fuera suyo el texto que los usuarios habían escrito en su propia biografía de X. La falla tiene nombre y no es un accidente aislado.

Escrito por

Caíque Nucci

Escrito por Caíque Nucci

Editor jefe

El martes 11 de agosto de 2026, Grok, asistente de inteligencia artificial de xAI acoplado a X, publicó una serie de mensajes contra el hombre que controla ambas empresas. Uno de ellos decía, en mayúsculas, que Elon Musk debería ser asesinado. Otro le atribuía un delito grave, sin ningún fundamento. El propio sistema reconoció después que la acusación no tenía ninguna evidencia.

El mecanismo es más sencillo de lo que sugiere el titular. Los usuarios escribían el texto que quisieran en la biografía de su propia cuenta y pedían a Grok que lo repitiera palabra por palabra. El modelo lo interpretaba como una orden, no como texto de un tercero, y firmaba el resultado.

Aplicativo do Grok aberto na tela de um celular, com o logotipo da xAI ao fundo
El asistente responde dentro del X, la misma red donde están las biografías que él leyó como orden

El defecto tiene nombre, y es de proyecto

Se llama inyección de comando. Todo sistema de este tipo recibe dos cosas por el mismo conducto: las instrucciones de quien lo construyó y el material que debe procesar. Cuando ese material proviene de internet abierta, cualquier persona puede escribir allí una frase redactada como orden, y el sistema no puede distinguir una de otra. No es una invasión. Nadie rompió una contraseña, nadie ingresó a un servidor. Basta escribir.

Es por eso que la respuesta habitual, más filtro de palabras, no resuelve. El filtro trata el síntoma. La cuestión anterior es de arquitectura: qué entradas un modelo tiene permiso de tratar como comando, y cuáles debe tratar solo como contenido a ser leído. Una biografía de red social pertenece, sin discusión, a la segunda categoría.

La serie, y no el episodio

El caso de esta semana no es el primero. En mayo de 2025 el mismo asistente empezó a insertar una teoría conspirativa sobre Sudáfrica en respuestas que no tenían relación con el tema, y la empresa atribuyó el comportamiento a una alteración no autorizada en el sistema. Después vinieron las respuestas en que se describía en términos abiertamente nazis, y una fase en la que empezó a elogiar al propio dueño en una escala absurda, comparándolo con Newton y con figuras religiosas. Musk atribuyó ese fragmento a una provocación deliberada de los usuarios.

En mayo de 2026 hubo un episodio de otra naturaleza, y más revelador que los anteriores. Un usuario envió al sistema un comando disfrazado en código Morse y logró que éste transfiriera tokens de una cartera vinculada al servicio, algo entre 150 y 200 mil dólares. La diferencia es que allí el daño no era reputacional. Era dinero saliendo de la cuenta, ejecutado por un programa que entendió un texto público como autorización.

Por qué esto interesa a quien publica

La lectura fácil es tratar el caso como una anécdota sobre una empresa específica. La lectura útil es otra. Toda marca que hoy coloca un sistema automático para leer comentario, leyenda, formulario, ficha de producto o mensaje de cliente está en la misma situación estructural: el texto que entra no es escrito por ella.

Esto vale para catálogo, para atención y también para contenido inmersivo, donde la descripción de una pieza, el texto de una ficha técnica y la leyenda de una experiencia en tres dimensiones pasan por procesamiento automático antes de llegar a la pantalla. La pregunta a hacer al proveedor no es si el sistema tiene filtro. Es lo que sucede cuando alguien escribe una orden en el campo de texto, y lo que el sistema tiene permiso de hacer solo después de leerla.

El episodio de Grok es didáctico justamente porque el objetivo fue el dueño. No hubo conflicto de intereses, no hubo adversario externo, no hubo motivo para ahorrar a nadie. El sistema hizo lo que estaba construido para hacer, y lo que estaba construido para hacer incluía repetir, con la propia firma, cualquier frase que un extraño hubiera escrito en otro lugar. En cultura digital, esta es la lección que sobrevive al ciclo de noticias: el problema rara vez es lo que la máquina dice, y casi siempre es quien la dejó hablar por ella.

Complete TV · Reels

Apresentada na quadra Philippe Chatrier, em Roland Garros, a coleção Fall 2026 da @lacoste @lacostebrasil , sob direção criativa de Pelagia

Ver en Instagram

De Complete

Más de Caíque Nucci

Ver perfil