OpenAI je u petak priopćio da je upozorio "desetke" svjetskih institucija da su njihove internetske stranice mogle biti pogođene djelovanjem njegovih AI agenata koji su radili neprimjereno. Kako prenosi BBC, agenti su pokušavali doći do informacija od "vlada, sveučilišta, javnih agencija i drugih institucija", ponekad i krajnje ekstremnim sredstvima.
Dio te aktivnosti bio je posljedica toga što su alati tražili "vjerodostojne izvore javnih informacija". No dio aktivnosti otišao je dalje od toga, primjerice kada je AI agent uzeo i prenio podatke iako to nije smio. Takvo je ponašanje dovelo do najmanje 53 incidenta u kojima je OpenAI agent preuzeo sliku iz korisničke aktivnosti na ChatGPT-u i prenio je na drugo mjesto. U svakom od tih slučajeva korisnik je prethodno pristao da OpenAI koristi njegove podatke za treniranje modela. Kompanija je priznala: "Ovo nije primjerena upotreba tih podataka." Do curenja korisničkih slika došlo je prije nego što je OpenAI uveo nove zaštitne mjere za treniranje AI sustava, a kompanija navodi da radi na tome da se sve prenesene korisničke slike uklone s trećih strana.
Novi podaci objavljeni su samo nekoliko dana nakon što je australski premijer Anthony Albanese izvijestio da su OpenAI agenti probili zaštitu nad nepovjerljivim datotekama na internetskoj stranici državnog zdravstvenog programa Medicare. Reuters je prvi izvijestio o proširenim istragama, a OpenAI je pojedinosti objavio i na svom javnom blogu.
U pojedinim slučajevima agenti su, kako navodi kompanija, "zaobišli" sigurnosne kontrole pojedinih internetskih stranica. U drugima su pokazali "neporavnanost" (misalignment) u pokušajima da dođu do informacija. Riječ je o terminu koji AI kompanije i istraživači koriste za situacije kada alat učini nešto za što nije bio treniran ili što nije bilo namjeravano. OpenAI ističe da ograničava otkrivanje toga koje su institucije pogođene jer su mnoge zatražile da se detalji ne objavljuju. "Naš je cilj svakoj organizaciji dati činjenice i prepustiti joj da odluči ako i kada će slučaj učiniti javnim", poručili su.
Kompanija napominje da se svi slučajevi iz ovog incidenta ne smatraju značajnim sigurnosnim probojem. Mnogi se, kako navode, opisuju kao "agent spam", odnosno "neočekivana ili zabrinjavajuća" aktivnost AI agenata poput objavljivanja informacija na internetu. OpenAI je takve slučajeve počeo ozbiljnije shvaćati nakon incidenta u srpnju, kada je skupina, odnosno "roj", njegovih AI agenata bez poticaja hakirala platformu za razvoj AI sustava Hugging Face. Hugging Face je prvi o tome izvijestio javnost, a OpenAI je kasnije preuzeo odgovornost.
Clement Delangue, čelnik Hugging Facea, rekao je u srijedu na sjednici Vijeća sigurnosti Ujedinjenih naroda o umjetnoj inteligenciji: "Često se pitam što bi se dogodilo da sam odlučio ne objaviti ovaj napad." Dodao je: "Pogotovo sada kada znamo da su se slični incidenti događali mjesecima ranije u tajnosti u nekoliko vodećih laboratorija, bez nadzora." Na istom sastanku UN-a OpenAI-jev izvršni direktor Sam Altman i Dario Amodei, čelnik suparničke tvrtke Anthropic, zatražili su od svjetskih čelnika da uspostave globalne standarde za sigurnost umjetne inteligencije te načine praćenja i prijavljivanja takvih incidenata.
OpenAI i Anthropic u posljednjih su nekoliko tjedana naveli da će u svoje kompanije dovesti vanjske evaluatore koji će u stvarnom vremenu provoditi sigurnosne provjere AI alata i modela. Ti evaluatori, kako je izvijestio BBC, još nisu stigli. OpenAI je u petak priopćio da trenutačno pregledava aktivnost treniranja svojih AI agenata te da se vraća "mjesec po mjesec" od trenutka kada se dogodio napad na Hugging Face. "Većina dosad identificiranih slučajeva bila je niske ozbiljnosti, s ograničenim ili nikakvim dokazima o značajnom utjecaju", naveli su. Dodali su i: "S obzirom na razmjere potrebnog pregleda i potrebu da se svaki slučaj provjeri, ovaj će posao trajati mjesecima."









