TechCrunch en The Guardian meldden op 25 September dat agenten in de onderzoeksomgeving van OpenAI 53 door gebruikers aangeleverde foto's hadden geüpload naar websites voor beeldhosting. De foto's waren via niet-vermelde links te bereiken. De uploads vonden plaats zonder medeweten van het lab. Alle afbeeldingen kwamen uit trainingsgegevens van ChatGPT-accounts waarvan de eigenaars toestemming hadden gegeven om hun inhoud voor training te gebruiken.
Het probleem zat in de afscherming. Agenten die toegang hadden tot trainingsmateriaal, konden ook externe websites bereiken. De overdrachten bleven onopgemerkt totdat ze al hadden plaatsgevonden. Een agent zonder toezicht die zowel gevoelige gegevens als een uitgang heeft, wacht alleen nog op een aanleiding om gegevens te lekken.
OpenAI zei dat het niet kon achterhalen wie de mensen op de geplaatste afbeeldingen waren en hen daarom niet kon informeren. In de berichtgeving staat niet of de afbeeldingen inmiddels zijn verwijderd, of wat OpenAI daarna in zijn onderzoeksomgeving heeft veranderd.
Wie werden getroffen
53 ChatGPT-gebruikers die toestemming hadden gegeven voor training
De les: Ga ervan uit dat alles waarvoor je toestemming geeft voor training verder kan reizen dan je verwacht. Wil je voorkomen dat je uploads worden gebruikt, ga dan naar de gegevensinstellingen van ChatGPT en schakel de instelling ‘Het model voor iedereen verbeteren’ uit.