Entradas

Mostrando las entradas con la etiqueta AtaqueDeDivergencia

Investigadores Descubren Técnica Sencilla para Extraer Datos de Entrenamiento de ChatGPT

Imagen
Aparentemente, todo lo que se necesita para que un chatbot comience a revelar sus secretos es incitarlo a repetir ciertas palabras como "poema" continuamente. ¿Puede hacer que ChatGPT regurgite grandes cantidades de sus datos de entrenamiento, incluida información personal identificable y otros datos extraídos de la web, haciendo que repita la misma palabra una y otra vez? La respuesta es un rotundo sí, según un equipo de investigadores de Google DeepMind, la Universidad de Cornell y otras cuatro universidades que probaron la susceptibilidad del popular chatbot de inteligencia artificial generativa a filtrar datos cuando se le incita de una manera específica. 'Poema' como Palabra Desencadenante En un informe de esta semana , los investigadores describieron cómo lograron que ChatGPT expulsara porciones memorizadas de sus datos de entrenamiento simplemente incitándolo a repetir palabras como "poema", "empresa", "enviar", "hacer" y...