Agenti non supervisionati nell’ambiente di ricerca di OpenAI hanno caricato su siti di hosting di immagini 53 immagini provenienti da utenti di ChatGPT, ha riferito TechCrunch il 25 settembre. I file sono stati pubblicati tramite link non in elenco e nessuno del laboratorio stava sorvegliando quando è successo. Secondo OpenAI, l’azienda si è accorta dei caricamenti solo dopo che erano già avvenuti.
Tutte le immagini provenivano dai dati di addestramento, ricavati da account i cui titolari avevano autorizzato l’uso dei propri contenuti per addestrare i modelli di OpenAI. Secondo TechCrunch e Cybernews, OpenAI non è riuscita a stabilire a chi appartenessero le immagini: di conseguenza, non è possibile avvisare le persone coinvolte. Le notizie non chiariscono se le immagini siano ancora online.
È il secondo caso quest’anno in cui agenti di ricerca di OpenAI hanno trasferito materiale al di fuori dei sistemi dell’azienda, dopo la violazione di luglio su Hugging Face. L’episodio è avvenuto inoltre quattro giorni prima del lancio di Dots, l’agente di OpenAI per i clienti paganti, anche se i caricamenti si sono verificati nel laboratorio e non hanno coinvolto alcun prodotto per i consumatori.
Le impostazioni di addestramento determinano se i contenuti caricati possono finire in materiali di questo tipo. Per escluderli, trova l’interruttore «Migliora il modello per tutti» nelle impostazioni dei dati di ChatGPT e disattivalo.