Hard Zone : Hardware, Reviews, Noticias, Tutoriales, Foros de ayuda – Privacidad en las IA gratuitas: qué datos guarda cada una y cómo desactivar el entrenamiento

Para entrenar una Inteligencia Artificial hacen falta datos, millones de datos. Esta no solo los obtiene a través de la técnica de web scraping (el contenido público disponible en Internet), también la obtiene de todo tipo de libros y literatura en formato digital, artículos científicos, bases de datos académicas además de los datos de los usuarios.

Por defecto, todas las Inteligencias Artificiales están configuradas para utilizar los datos de los usuarios para mejorar su funcionamiento. Afortunadamente, podemos evitar que esto suceda a través de las opciones de configuración, aunque eso no implica necesariamente que los datos permanezcan almacenados aunque no se utilicen.

Qué datos recopilan la IAs

Cualquier Inteligencia Artificial que utilicemos recopilará un gran número de datos relacionados, no solo con la consulta, sino también en cómo interactuamos con ella, los archivos que subimos, los datos desde el dispositivo con el que interactuamos:

El texto que escribes (prompts y respuestas)
Archivos e imágenes que subes
Metadatos: fecha, dispositivo, idioma, IP aproximada, uso del servicio
Conversaciones guardadas si tienes historial
Feedback (pulgar arriba/abajo, reportes)

Estos datos se utilizan para mejorar la plataforma, aunque podemos limitarlo o eliminarlo completamente a través de las opciones de configuración, si es que realmente sirve para algo.

IADatos que puede guardarUso para entrenamiento

ChatGPT (OpenAI)Chats, archivos subidos, instrucciones personalizadas, datos de usoPuede usar conversaciones para mejorar modelos si está activado

Google GeminiChats, actividad de Gemini, datos asociados a cuenta Google según ajustesPuede usar actividad guardada según configuración

Claude (Anthropic)Conversaciones y datos aportados al servicioPuede usarlos según controles de mejora

Perplexity AIConsultas, historial, archivos y datos de usoPuede usar datos según configuración

Evitar que una IA utilice tus datos para entrenarse

Como hemos comentado más arriba, por defecto, todas las cuentas gratuitas están configuradas para que los datos de uso sean utilizados para mejorar su funcionamiento, no así en las cuentas de empresas, aunque depende de la plataforma.

ChatGPT

Para evitar que ChatGPT utilice nuestros datos para mejorar su funcionamiento, debemos pulsar sobre el icono que representa nuestra cuenta y seleccionar la opción Configuración.

Seguidamente, pulsamos en Controles de datos y en la sección de la derecha, pulsamos en Mejorar el modelo para todos. En la ventana que se muestra a continuación, desmarcamos la casilla Mejorar el modelo para todos.

Interfaz de ajustes de ChatGPT donde se gestiona el uso de datos personales para el entrenamiento del modelo de IA – Captura de HardZone

Gemini

Siendo un servicio de Google, Gemini está interconectado con todos sus servicios, por lo que, por defecto, almacena la actividad del usuario en base a la configuración estándar: últimos 18 meses. Si no queremos que Google almacene nuestra actividad y la utilice para entrenar Gemini, debemos pulsar el siguiente enlace para acceder a las opciones de configuración de Gemini.

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *