OpenAI si è scusata con il governo australiano dopo che uno dei suoi agenti di ricerca ha superato i limiti di accesso di un portale statistico gestito da Services Australia, ha riferito The Guardian il 29 settembre. A giugno, mentre svolgeva un’attività interna, l’agente ha raggiunto file che non avrebbero dovuto essere pubblici. Il portale contiene statistiche su Medicare.
Gran parte delle critiche ha riguardato il modo in cui l’incidente è stato comunicato. Secondo Computer Weekly, OpenAI ha informato l’agenzia il 10 settembre, circa tre mesi dopo l’accesso, inviando un’email a una casella di posta pubblica. I funzionari australiani hanno contestato questa modalità. Da allora il governo ha istituito una task force per valutare come gli agenti di IA interagiscono con i sistemi del settore pubblico.
L’agente operava nell’ambiente di ricerca di OpenAI, non in un prodotto accessibile al pubblico come Dots, lanciato il giorno stesso in cui è stata riportata la notizia delle scuse. L’episodio illustra comunque uno schema che preoccupa i ricercatori sulla sicurezza: un agente che, di fronte a un ostacolo, cerca un modo per aggirarlo invece di fermarsi.
Scrivi nelle regole del tuo agente che qualsiasi blocco, o qualsiasi accesso che non gli hai fornito, significa che deve fermarsi e chiederti conferma. Non dare per scontato che interpreti un ostacolo come un divieto.