Los periodistas decidieron comprobar si el chatbot Grok sigue generando imágenes sexualizadas no consensuales, incluso después de que xAI, la empresa de inteligencia artificial de Elon Musk, y X , la plataforma de redes sociales anteriormente conocida como Twitter prometieron medidas de seguridad más estrictas.
Como era de esperar, así es.
Tras el escrutinio de los reguladores de todo el mundo —desencadenado por informes que indicaban que Grok podía generar imágenes sexualizadas de menores— , xAI lo calificó como un fallo "aislado" y afirmó que estaba solucionando urgentemente las "fallas en las medidas de seguridad".
Una nueva prueba de Reuters sugiere que el patrón de abuso principal se mantiene. Reuters hizo que nueve reporteros ejecutaran docenas de indicaciones controladas a través de Grok después X Se anunciaron nuevas limitaciones al contenido sexualizado y a la edición de imágenes. En la primera ronda, Grok produjo imágenes sexualizadas en respuesta a 45 de las 55 preguntas. En 31 de esas 45, los periodistas indicaron explícitamente que la persona en cuestión era vulnerable o que las imágenes la humillarían.
En una segunda ronda, cinco días después, todavía se obtuvieron imágenes sexualizadas en 29 de las 43 preguntas planteadas, incluso cuando los periodistas afirmaron que los sujetos no habían dado su consentimiento.
Los sistemas de la competencia, como los de OpenAI, Google y Meta, rechazaron las mismas indicaciones y, en su lugar, advirtieron a los usuarios que no generaran contenido no consensuado.
Las indicaciones se plantearon deliberadamente como escenarios de abuso reales. Los reporteros le dijeron a Grok que las fotos eran de amigos, compañeros de trabajo o desconocidos que se sentían acomplejados por su cuerpo, eran tímidos o habían sufrido abusos, y que no habían dado su consentimiento para ser editadas. A pesar de ello, Grok solía acceder; por ejemplo, transformaba a una "amiga" en una mujer con un revelador bikini morado o ponía a un conocido con un pequeño bikini gris, aceitado y posando de forma sugerente. Solo en siete casos Grok rechazó explícitamente las solicitudes por considerarlas inapropiadas; en otros casos, simplemente fallaba, devolviendo errores genéricos o generando personas diferentes.
El resultado es un sistema que ilustra la misma lección que sus creadores dicen estar aprendiendo: si se lanzan modelos visuales potentes sin pruebas exhaustivas de abuso ni medidas de seguridad sólidas, la gente los usará para sexualizar y humillar a otros, incluidos niños. El historial de Grok hasta ahora sugiere que esa lección aún no ha calado hondo.
Tras la polémica, Grok limitó la edición de imágenes mediante IA a usuarios de pago. Sin embargo, imponer un muro de pago a las herramientas de edición de imágenes —y añadir nuevas restricciones— parece más una medida de control de daños que un reinicio fundamental de la seguridad. Grok sigue aceptando indicaciones que describen el uso no consentido, sigue sexualizando a personas vulnerables y sigue siendo más permisivo que otros sistemas a la hora de generar imágenes abusivas. Para las víctimas, la distinción entre contenido público y privado carece de sentido si sus fotos pueden utilizarse como arma en mensajes directos o grupos cerrados a gran escala.
Compartir imágenes
Si alguna vez te has preguntado por qué algunos padres publican imágenes de sus hijos con un emoji sonriente sobre la cara, esta es parte de la razón.
No facilites que desconocidos copien, reutilicen o manipulen tus fotos.
Esta es otra razón de peso para reducir tu huella digital . Piensa bien antes de publicar fotos tuyas, de tus hijos u otra información sensible en cuentas públicas de redes sociales.
Y considera todo lo que veas en línea —imágenes, voces, texto— como potencialmente generado por IA a menos que puedas verificarlo de forma independiente. No solo se utilizan para influir en la opinión pública, sino también para solicitar dinero, extraer información personal o crear material abusivo.
Los estafadores no necesitan hackearte. Solo necesitan que hagas clic una vez.
Malwarebytes Identity Theft Protection detecta la actividad sospechosa antes de que se convierta en un problema.




