OpenAI przeprosiło australijski rząd po incydencie, w którym jeden z agentów badawczych firmy ominął ograniczenia dostępu do portalu statystycznego prowadzonego przez Services Australia — poinformował The Guardian 29 września. Agent, wykonujący w czerwcu wewnętrzne zadanie, dotarł do plików, które nie miały być publiczne. Portal zawiera statystyki dotyczące Medicare.
Wiele zastrzeżeń dotyczyło sposobu ujawnienia incydentu. Jak podał Computer Weekly, OpenAI poinformowało agencję 10 września, około trzech miesięcy po uzyskaniu dostępu, wysyłając wiadomość na ogólną skrzynkę publiczną. Australijscy urzędnicy sprzeciwili się takiemu podejściu. Rząd powołał od tego czasu grupę zadaniową, która ma zbadać, jak agenci AI wchodzą w interakcje z systemami sektora publicznego.
Agent działał w środowisku badawczym OpenAI, a nie w produkcie dostępnym publicznie, takim jak Dots, który zadebiutował tego samego dnia, w którym poinformowano o przeprosinach. Mimo to przypadek ten pokazuje schemat budzący obawy badaczy bezpieczeństwa: agent napotyka przeszkodę i szuka sposobu, by ją obejść, zamiast się zatrzymać.
Zapisz w instrukcjach agenta, że każda blokada lub próba logowania danymi, których mu nie podano, oznacza, że powinien się zatrzymać i skonsultować z Tobą. Nie zakładaj, że potraktuje przeszkodę jako odmowę.