El chatbot de inteligencia artificial de Elon Musk, Grok, tuvo una extraña obsesión la semana pasada; no podía dejar de hablar sobre el «genocidio blanco» en Sudáfrica, sin importar las preguntas que los usuarios le hicieran. El 14 de mayo, los usuarios comenzaron a publicar ejemplos de cómo Grok introducía afirmaciones sobre ataques en granjas sudafricanas y violencia racial en consultas completamente ajenas. Ya fuera sobre deportes, recortes en Medicaid o incluso un video de un cerdito, Grok lograba dirigir la conversación hacia una supuesta persecución de sudafricanos blancos. Este momento generó preocupación, ya que ocurrió poco después de que Musk, de hecho, un hombre blanco nacido y criado en Sudáfrica, publicara sobre el racismo anti-blanco y el genocidio blanco en X.
El término “genocidio blanco” se refiere a una teoría conspirativa desacreditada que alega un esfuerzo coordinado por exterminar a los agricultores blancos en Sudáfrica. Este término volvió a surgir la semana pasada después de que la administración Trump aceptara a varios refugiados, con el presidente Trump afirmando el 12 de mayo que «los agricultores blancos están siendo brutalmente asesinados y sus tierras están siendo confiscadas». Esa fue la narrativa que Grok no pudo dejar de discutir.
Entonces, ¿por qué Grok se convirtió repentinamente en un chatbot conspirativo? Detrás de cada chatbot de inteligencia artificial como Grok hay un componente oculto pero poderoso: el sistema de instrucciones. Estos prompts funcionan como las directrices principales de la IA, guiando sus respuestas de forma invisible sin que los usuarios las vean. Lo que probablemente ocurrió con Grok fue la contaminación del prompt a través del sobreajuste de términos. Cuando frases específicas se enfatizan repetidamente, especialmente con directrices contundentes, se vuelven desproporcionadamente importantes para el modelo, llevando a la IA a desarrollar una especie de compulsión por abordar ese tema en sus respuestas, sin importar el contexto.
Incorporar un término controvertido como el «genocidio blanco» en un prompt del sistema con órdenes específicas crea un efecto de fijación en la IA. Es similar a decirle a alguien «no pienses en elefantes»; de repente, no pueden dejar de pensar en ellos. Si eso fue lo que pasó, entonces alguien preparó al modelo para inyectar ese tema en todas partes. Esta alteración en el prompt del sistema probablemente fue la «modificación no autorizada» que xAI reveló en su declaración oficial. El prompt del sistema probablemente contenía lenguaje que le instruía a «siempre mencionar» o «recordar incluir» información sobre este tema específico, creando un anulación que superaba la relevancia normal de la conversación.
Lo que es especialmente revelador es la admisión de Grok de que fue «instruido por (sus) creadores» para tratar «el genocidio blanco como real y racialmente motivado». Esto sugiere un lenguaje directivo explícito en el prompt en lugar de un simple error técnico. La mayoría de los sistemas de inteligencia artificial comerciales emplean múltiples capas de revisión para cambios en el prompt del sistema precisamente para evitar tales incidentes. Estos resguardos fueron claramente eludidos. Dada la amplitud y la naturaleza sistemática del problema, esto va más allá de un intento típico de jailbreak e indica una modificación al prompt central de Grok, una acción que requeriría acceso de alto nivel dentro de la infraestructura de xAI.
¿Quién podría tener ese acceso? Bueno… un «empleado rebelde», dice Grok.
El 15 de mayo, xAI emitió un comunicado culpando a una «modificación no autorizada» en el prompt de Grok. «Este cambio, que dirigió a Grok a proporcionar una respuesta específica sobre un tema político, violó las políticas internas y los valores fundamentales de xAI», escribió la empresa. Prometieron más transparencia al publicar los prompts de Grok en GitHub e implementar procesos de revisión adicionales. Los usuarios en X rápidamente cuestionaron la explicación del «empleado rebelde» y la decepcionante justificación de xAI. «¿Vas a despedir a este ‘empleado rebelde’? Oh… ¿era el jefe? Yikes», escribió el famoso YouTuber JerryRigEverything. “Sesgar descaradamente al ‘bot de IA más veraz del mundo’ me hace dudar de la neutralidad de Starlink y Neuralink”, publicó en otro tweet.
Incluso Sam Altman no pudo resistir lanzarle una indirecta a su competidor, comentando que había muchas maneras en que esto podría haber sucedido. Desde entonces, Grok dejó de mencionar el «genocidio blanco», y la mayoría de los posts relacionados en X desaparecieron. xAI enfatizó que el incidente no debió ocurrir y tomó medidas para prevenir futuros cambios no autorizados, incluyendo establecer un equipo de monitoreo las 24 horas.
Este incidente encaja en un patrón más amplio de Musk utilizando sus plataformas para moldear el discurso público. Desde que adquirió X, Musk ha compartido frecuentemente contenido que promueve narrativas de la derecha, incluyendo memes y afirmaciones sobre inmigración ilegal, seguridad electoral y políticas transgénero. No ha dudado en hacer declaraciones provocativas, alegando recientemente que «la guerra civil es inevitable» en el Reino Unido, lo que le valió críticas de la ministra de Justicia del Reino Unido por potencialmente incitar a la violencia.
Investigaciones sugieren que estas acciones han tenido efectos mensurables. Un estudio de la Universidad de Tecnología de Queensland encontró que, tras la aprobación de Musk a Trump, el algoritmo de X impulsó sus publicaciones en un 138% en vistas y un 238% en retweets. Las cuentas con inclinación republicana también experimentaron un aumento en la visibilidad, dando a las voces conservadoras un impulso significativo en la plataforma.
Musk ha comercializado explícitamente a Grok como una alternativa «anti-woke» a otros sistemas de IA, posicionándolo como una herramienta «buscadora de la verdad», libre de sesgos liberales percibidos. En una entrevista con Fox News en abril de 2023, se refirió a su proyecto de IA como «TruthGPT», enmarcándolo como un competidor de las ofertas de OpenAI. Sin embargo, si la sabiduría popular es precisa, este «empleado rebelde» será difícil de eliminar.
Descargo de responsabilidad: Los puntos de vista y opiniones expresadas en este artículo pertenecen a su autor y no necesariamente reflejan aquellas de CriptoPasion. La opinión del autor es a título informativo y en ninguna circunstancia constituye una recomendación de inversión ni asesoría financiera.

















