Investigadores españoles demuestran que ChatGPT, Gemini, Claude y otras IA filtran datos de los chats a anunciantes
ChatGPT, Gemini, Claude, Grok, Perplexity e incluso la europea Mistral. Todas estas inteligencias artificiales filtran datos del contenido de las conversaciones que los usuarios mantienen con ellas a redes publicitarias y plataformas de analítica de terceros, según han podido demostrar investigadores del Instituto IMDEA Networks y la Universidad Carlos III de Madrid. Otros tres sistemas analizados, como DeepSeek, Microsoft Copilot o Meta AI, envían información sobre el dispositivo y los metadatos de los chats a esas empresas de compraventa de datos personales.
La investigación, a la que ha tenido acceso elDiario.es, ha sido puesta en conocimiento de la Agencia Española de Protección de Datos, que ha elevado el caso al Comité Europeo de Protección de Datos para estudiar si estas transferencias vulneran la normativa comunitaria. Este último organismo mantiene abierta una investigación desde hace más de tres años sobre el tratamiento de datos de ChatGPT, cuya resolución podría tener un profundo impacto en el uso de chatbots de IA en el continente.
El estudio finalizado ahora por los investigadores españoles ha sido aceptado en PETS (Privacy Enhancing Technologies Symposium), una de las principales conferencias académicas internacionales sobre privacidad y tecnologías de protección de datos. Su principal conclusión es que los chatbots de inteligencia artificial utilizan métodos de extracción de datos personales muy similares a los que se utilizan en las páginas web y servicios digitales tradicionales para hacer publicidad ultradirigida.
“Nuestros resultados desafían la percepción de los servicios de IA conversacional como intercambios confidenciales entre los usuarios y los proveedores de IA”, avisan en el estudio: “La IA conversacional ha heredado la infraestructura publicitaria y de analítica de las plataformas web y móviles, introduciendo los datos de las conversaciones directamente en las redes de rastreo existentes”.
Una conclusión que contrasta con las menores precauciones que toman muchos usuarios a la hora de volcar datos personales en los chats de inteligencia artificial, en busca de mejores consejos o valoraciones. La realidad que evidencian ahora los especialistas de IMDEA Networs y la Carlos III es que ChatGPT, Gemini o Claude no solo envían datos de entrenamiento a sus desarrolladoras, como avisan antes de comenzar cada conversación, sino también a las bases de datos de los anunciantes.
“Nueva superficie de ataque a la privacidad”
El estudio analizó tanto las aplicaciones móviles como las versiones web de los nueve asistentes de IA citados. Los investigadores entablaron conversaciones con los chatbots con consultas sanitarias, subiendo como apoyo documentos con resultados de pruebas médicas. A continuación, rastrearon lo que ocurría con esos datos utilizando distintas configuraciones de privacidad.
Los resultados fueron claros. Seis de las nueve versiones web (ChatGPT, Gemini, Claude, Grok, Perplexity y Mistral) y tres aplicaciones móviles (ChatGPT, Claude y Perplexity) filtran datos directos de la conversación a través de rastreadores publicitarios. Los títulos de las charlas (como “Síntomas iniciales de Parkinson”), las preguntas formuladas, los documentos subidos al chat o incluso capturas de pantalla se comparten con empresas de mercadeo de datos personales.
“Demostramos que los servicios de IA conversacional introducen una nueva superficie de ataque a la privacidad en la que los artefactos conversacionales generados por el proveedor quedan expuestos al rastreo y a la exposición pública”, avisan los investigadores. En algunas ocasiones, incluso los enlaces públicos de los chats (como los que se utilizan para compartirlos con otras personas) quedaron expuestos a los rastreadores, lo que permite que su contenido pueda ser incorporado a las bases de datos para personalizar anuncios.
Demostramos que los servicios de IA conversacional introducen una nueva superficie de ataque a la privacidad
Además, su análisis reveló que rechazar las cookies, navegar en modo incógnito u otros métodos de protección de la privacidad que pueden activar los usuarios tienen muy poco impacto a la hora de proteger esa información. Hasta un 80,8% de los rastreadores de terceros permanecen activos incluso con esas configuraciones de protección.
Con todo, los especialistas de IMDEA Networks y la Carlos III destacan que el mayor peligro no es la propia filtración de los datos, sino el hecho de que esta información viaje acompañada de los indicadores personales que la vinculan a cada usuario. Se trata de los códigos que las empresas de la publicidad online utilizan para crear una ficha de consumidor de cada persona y registrar sus intereses, motivaciones y datos personales. Esta es la práctica que luego “permite a terceros asociar esas interacciones con usuarios individuales o perfiles de comportamiento a largo plazo y multiplataforma”, avisan.
Grok, el caso más grave
Grok, el asistente desarrollado por xAI, el laboratorio fundado por Elon Musk, lleva a cabo las prácticas más invasivas de todos los asistentes analizados. En su versión web, las conversaciones son accesibles públicamente por defecto mediante direcciones URL que se transmiten automáticamente a siete redes publicitarias y de analítica externas, entre ellas Meta, TikTok, Google Ads y Twitter Analytics.
Junto con la dirección del chat y el título generado por la herramienta, estos servicios reciben cookies de seguimiento e identificadores de usuario. Además, al generar un enlace para compartir el chat, la plataforma reenvía a Meta y TikTok el texto de la última pregunta introducida y, en el caso de TikTok, una captura de pantalla del propio chat. En las pruebas posteriores con esos enlaces, los investigadores registraron que las conversaciones con Grok recibieron hasta 70 accesos automáticos de rastreadores externos procedentes de 14 países.
elDiario.es se ha puesto en contacto con xAI, la empresa desarrolladora de Grok y también propiedad de Elon Musk, pero no ha recibido respuesta. Esta redacción también se ha puesto en contacto con las compañías detrás de los ocho chatbots restantes. Solo Google, OpenAI y Microsoft han respondido a la solicitud de información.
Este informe malinterpreta cómo funcionan nuestros productos. No tenemos anuncios en Gemini
“Este informe malinterpreta cómo funcionan nuestros productos. No tenemos anuncios en Gemini y utilizamos herramientas como Google Analytics para supervisar el rendimiento técnico, detectar interrupciones del servicio y mantener la fiabilidad de nuestra aplicación web de Gemini”, ha explicado una portavoz de Google. “Cumplimos con las normativas europeas de privacidad y ofrecemos a los usuarios controles transparentes sobre sus datos”, añade.
OpenAI, por su parte, ha indicado que utiliza esas herramientas de análisis de datos para comprender el tráfico de ChatGPT, diagnosticar errores y supervisar su rendimiento. En un comunicado que ha pedido que no sea citado literalmente, la compañía asegura que esa información no se usa con propósitos publicitarios, ni se vende o comparte con anunciantes.
“Tras examinar las acusaciones, no hemos encontrado ninguna infracción de la legislación aplicable ni de la Declaración de privacidad de Microsoft”, ha contestado esta multinacional, que afirma que “la privacidad de los usuarios es una prioridad”, para ella, “incluido Copilot”.
“Prácticas intencionadas”
Con todo, los propios investigadores avisan en su estudio que las prácticas detectadas no son producto de errores o descuidos. “Durante nuestro análisis de riesgos, determinamos que la mayoría de los problemas reportados en este estudio reflejan prácticas intencionadas a nivel de producto en lugar de vulnerabilidades de seguridad explotables”, recalcan los investigadores.
Grok fue, de hecho, el único servicio para el que identificamos un problema de seguridad que podría ser explotado por ciberdelincuentes, “debido a los débiles controles de acceso en los recursos de conversación”. Por ello, avisaron directamente a la plataforma propiedad de Musk el 17 de abril, aunque la compañía no emitió ninguna respuesta oficial ni corrigió la privacidad por defecto de sus enlaces. El 15 de agosto OpenAI actualizó la política de privacidad de ChatGPT para mencionar explícitamente el uso de rastreadores de terceros, aunque los autores aclaran que no pueden confirmar si la medida fue consecuencia directa de su estudio.
0