Investigación revela que OpenAI usa chats reales para entrenar su IA

Fuentes: Investigación revela que OpenAI usa chats reales para entrenar su IAT3clickbait

Una investigación de 404 Media publicada el 14 de septiembre revela que OpenAI utiliza conversaciones reales de ChatGPT en su programa Project Lily para mejorar sus modelos de inteligencia artificial. Este sistema, que emplea cientos de revisores humanos externos, analiza respuestas generadas por la IA para corregir comportamientos excesivamente complacientes y reducir la apariencia de persona en el chat. Según los documentos consultados, los revisores pueden acceder a conversaciones completas y datos personales, aunque OpenAI aplica un filtro de privacidad llamado Privacy Filter diseñado para ocultar información sensible antes de su incorporación a los procesos de entrenamiento. La compañía reconoce que este filtro puede cometer errores, permitiendo que información sensible permanezca en las conversaciones. Esta práctica, que OpenAI admite en general, implica que los usuarios pueden entrenar los modelos si no desactivan la opción de mejorar el modelo para todos. La investigación destaca la vulnerabilidad de los datos personales, ya que los revisores no reciben el nombre de usuario asociado a la conversación, solo el contenido. Para proteger la privacidad, los usuarios deben desactivar la opción 'Mejorar el modelo para todos' en la configuración de datos, o utilizar chats temporales que no se almacenen ni se utilizan para entrenamiento. Además, es crucial evitar enviar valoraciones sobre interacciones que puedan ser utilizadas para entrenamiento, incluso si la configuración está desactivada.