Conoce Atico34 - Solicita presupuesto
Inteligencia artificial

¿Cómo usan los datos personales para entrenar los modelos de inteligencia artificial?

Los modelos de inteligencia artificial también usan datos personales para su entrenamiento, una práctica que puede suponer diferentes riesgos, además de poder considerarse una vulneración de la normativa de protección de datos. Para entender mejor qué implica el uso de datos personales para entrenar IA, hemos elaborado el siguiente artículo.

¿Qué papel juegan los datos personales en el entrenamiento de modelos de IA?

Los datos personales, como otros datos, juegan un papel clave en el entrenamiento de modelos de inteligencia artificial, especialmente en aquellos modelos de aprendizaje automático y aprendizaje profundo, en los que cuanto mayor y más diverso sea el dataset (conjunto de datos), mejor será el proceso de aprendizaje y el funcionamiento posterior del modelo.

Así mismo, los diferentes tipos de inteligencia artificial requieren captar siempre más datos, para poder llegar a conclusiones o resultados cada vez más precisos y diferentes, incluso si son datos que se usaron en su fase de entrenamiento inicial, porque cuantos más datos recabe y procese, más evolucionará ese modelo de IA. Esta es la principal razón por la que las empresas inmersas en el desarrollo de modelos de IA basados en aprendizaje automático y aprendizaje profundo buscan recopilar más conjuntos de datos reales, incluidos datos personales.

Si la finalidad de un modelo de IA es predecir el comportamiento de los consumidores,  nuevas tendencias de consumo o la forma en que se mueven las personas por una ciudad, sin duda, ese modelo requiere ser entrenado con cuantos más datos personales mejor, y cuando más diversos y de mayor calidad, también mejor.

Con grandes bases de datos personales, con información muy variada y de diferentes fuentes, por ejemplo, los sitios webs que visitamos más asiduamente, cuánto tiempo pasamos conectados a internet, qué series o películas vemos, dónde residimos, qué productos consumimos de forma habitual, a qué damos «me gusta», qué fotos subimos, etc., un modelo de IA puede volverse cada vez más preciso a la hora de hacer determinadas predicciones tras el análisis de los datos.

Por este motivo, muchos servicios en internet, como redes sociales, plataformas de streaming, plataformas para compartir contenido, herramientas en línea, etc., han cambiado su política de privacidad (con el RGPD y la Ley de IA en mente) para informar sobre el uso de nuestros datos personales para entrenar sus modelos de IA (es el caso, por ejemplo, de Meta, aunque lo haya paralizado de momento, X, Adobe o Slack), en algunos casos incluso haciendo uso de datos personales sin consentimiento, en otros habilitando una opción opt-out, puesto que la recogida se estaría haciendo alegando interés legítimo y por defecto.

¿Cómo se usan nuestros datos personales para entrenar IA?

Nuestros datos personales son recogidos para crear bases de datos variadas y diversas, que después se emplean para entrenar IA.

La finalidad de esos entrenamientos varía, aunque en general la mayoría de empresas comparten los mismos fines: entrenar sus modelos de IA para que sean más precisos y eficaces y con ello puedan mejorar sus servicios y personalizarlos para captar y retener a los usuarios, además de desarrollar modelos de IA que luego pueden poner a disposición de otras empresas y actores.

En realidad, no es fácil explicar cómo se usan nuestros datos personales para entrenar modelos de IA, más allá de que son necesarios para que el modelo aprenda de ellos al procesarlos y analizarlos en busca de patrones con los que agruparlos y generar sus respuestas o sus decisiones y esto se debe a la naturaleza de «caja negra» de los modelos de aprendizaje automático, pero, sobre todo, de aprendizaje profundo, en los que el algoritmo es todavía mucho más autónomo en la forma en la que aprende de los datos proporcionados y llega a sus conclusiones y predicciones.

En principio, el cómo y para qué se usan nuestros datos personales debe estar descrito y explicado en la política de privacidad o de protección de datos del sitio, plataforma o aplicación, el problema es que esta información no siempre es clara ni mucho menos exhaustiva: «usamos tus datos para ayudar a entrenar nuestros modelos de IA», «utilizamos tus datos para mejorar nuestros servicios y tecnología, como nuestros modelos de aprendizaje automático», «usamos tus datos para ofrecerte recomendaciones y un servicio más personalizado», etc., son las fórmulas habituales que encontramos en estas políticas, pero es, cómo decíamos insuficiente.

Y este es uno de los peligros de la inteligencia artificial, su falta de transparencia; de acuerdo, usan nuestros datos personales para entrenar sus modelos de IA, pero ¿con qué finalidad, más allá de perfeccionar el modelo?, ¿para qué se van a usar esos modelos de IA que están entrenando con nuestros datos personales?, ¿cómo nos va a afectar el uso de esos modelos de IA en el futuro? Estas cuestiones, para las que no tenemos una respuesta fácil, nos llevan a nuestro siguiente punto, los riesgos de la IA para nuestros datos personales.

tarifas proteccion datos 

¿Qué riesgos supone el uso de datos personales para entrenar IA?

El uso de datos personales para entrenar IA pone en riesgo nuestra privacidad, especialmente cuando los datos usados no están anonimizados, ya que de ellos se puede extraer información sobre nosotros y utilizarla con fines de los que no hemos sido informados.

Así mismo, supone una pérdida de control sobre nuestros datos personales, incluso si nos oponemos a su uso, cualquier otro usuario que no lo haya hecho, puede compartir información o datos personales nuestros (por ejemplo, al subir una foto en la que aparecemos, mencionarnos en una publicación, etc.); estos datos van a ser utilizados para entrenar un modelo de IA sin que tengamos conocimiento de ello y mucho menos hayamos dado nuestro consentimiento.

Se corre el riesgo, además, de que los modelos de IA usen para su entrenamiento conjuntos de datos sesgados, inexactos o que contengan errores, lo que podría replicarse en sus resultados y respuestas, generando problemas de discriminación, desinformación o perpetuando prejuicios. En modelos de IA destinados a la toma de decisiones automatizadas sobre personas, esto puede suponer un serio problema al denegar prestaciones de servicios, descartar candidatos en procesos de selección o denegar el acceso a una escuela, por ejemplo.

¿Cómo podemos proteger nuestros datos personales frente a la IA?

Para proteger mis datos personales frente a su uso para el entrenamiento de modelos de IA, solo hay unas pocas medidas que puedo poner en práctica:

  • Leer las políticas de privacidad de los sitios, plataformas y aplicaciones que uso, comprobar si están o tienen intención de recopilar mis datos y publicaciones para entrenar sus modelos de IA y oponerme a ello (deberían tener habilitada una opción para hacerlo, puesto que usar nuestros datos personales para este fin requiere de nuestro consentimiento, al menos en los países bajo el amparo del RGPD o leyes similares de privacidad y protección de datos).
  • Evitar compartir información personal a través de internet en la medida de lo posible.
  • Permanecer atento a los cambios en las políticas de privacidad de los servicios que utilizamos, para saber si van a recabar nuestros datos personales para entrenar modelos de IA.
partner form icon

Te ayudamos a cumplir la Ley de Protección de Datos

Escríbenos o contacta con nuestras oficinas

He leído y acepto la política de privacidad.