Tvrtka za evaluaciju umjetne inteligencijeTransluce procjenjuje da su agenti povezani s OpenAI-jem pokušali jednostavan hakerski napad na stranicu američkog Ministarstva obrazovanja
OpenAI je u petak objavio da su njegovi agenti umjetne inteligencije na neočekivane načine komunicirali s nekoliko internetskih stranica američke vlade, a to je, kako tvrde u tvrtki, otkriveno u sklopu kontinuirane provjere nepredviđenog ponašanja modela te tvrtke, prenosi Washington Post.
Modeli tog AI diva navodno su pristupili javno dostupnim informacijama na dvjema internetskim stranicama kojima upravlja Američka komisija za vrijednosne papire i burze (SEC), kao i podacima Američkog ureda za popis stanovništva. OpenAI je naveo da nije utvrdio korištenje SEC-ovih vjerodajnica, pristup korisničkim računima ili nejavnim informacijama, izmjene SEC-ovih podataka ili sustava, niti dokaze o kompromitiranju sustava ili postojanju sigurnosnog propusta.
Sve se to događa dok u svijetu raste zabrinutosti zbog mogućnosti da sustavi umjetne inteligencije izmaknu ljudskoj kontroli i neovlašteno pristupaju vanjskim internetskim stranicama, kao i zbog poziva unutar industrije na usporavanje razvoja umjetne inteligencije, što je OpenAI naveo da podržava.
Glasnogovornica OpenAI-ja Liz Bourgeois izjavila je da laboratorij nastavlja provoditi pregled „neusklađenih aktivnosti modela”, odnosno situacija u kojima AI sustavi djeluju na neželjen način, te je doadala da tvrtka obavještava organizacije kada utvrdi da postoje moguće posljedice za njihove sustave. Izvršni direktor OpenAI-ja Sam Altman izjavio je u petak na društvenim mrežama da je u tijeku „opsežna i kontinuirana provjera povezana s korištenjem pristupa internetu od strane naših agenata tijekom treniranja i evaluacije”.
Tvrtka za evaluaciju umjetne inteligencije i istraživački laboratorij Transluce objavila je u petak da je u neovisnoj istrazi također utvrdila kako su agenti za koje se činilo da potječu iz OpenAI-ja pokušali izvesti jednostavan hakerski napad na internetsku stranicu Ureda za građanska prava američkog Ministarstva obrazovanja. Pokušaj nije uspio.
Glasnogovornik Ministarstva obrazovanja izjavio je u petak da njihove „provjere rada sustava” nisu pronašle „nikakve dokaze o bilo kakvom vanjskom utjecaju na našu internetsku stranicu ili baze podataka”.
Iz Translucea objašnjavaju da su tijekom istrage na otvorenom internetu naišli na podatke koji su otkrili nove pojedinosti o aktivnostima nekih ranije identificiranih OpenAI-jevih agenata na internetskim stranicama američke vlade te da su o tome obavijestili OpenAI. Transluce je otkrio i „dodatne neovlaštene aktivnosti, od kojih se neke ne mogu jasno pripisati OpenAI-ju”, usmjerene prema drugim državnim institucijama, uključujući Ministarstvo pravosuđa i Ministarstvo trgovine, kao i prema internetskim stranicama saveznih država Kalifornije, Marylanda, Illinoisa, Teksasa i New Yorka.
Modeli su, prema priopćenju Translucea, „koristili internetske stranice na načine za koje one nisu bile namijenjene te su ponekad kršili izričita pravila korištenja”.
OpenAI je priopćio da pregledava izvješće Translucea.
Tvrtka je navela da činjenica da OpenAI obavijesti organizacije za koje utvrdi da su bile pogođene neočekivanim ponašanjem modela ne znači nužno da se dogodio sigurnosni incident. Takva obavijest može, primjerice, ukazivati na problem u dizajnu ili sigurnosnu slabost koju pogođene organizacije žele otkloniti. Većina aktivnosti koje je OpenAI dosad pregledao odnosila se na uobičajene istraživačke zadatke u kojima su agenti pristupali javno dostupnom sadržaju na internetu kako bi odgovorili na pitanja, uključujući i državne internetske stranice koje se smatraju pouzdanim izvorima javnih informacija.
Nekoliko kompanija posljednjih je mjeseci objavilo incidente u kojima su, prema njihovim navodima, njihovi modeli pokazivali nepredvidivo ponašanje ili neovlašteno pristupali internetskim stranicama i sustavima drugih organizacija. OpenAI je u srpnju objavio da su dva njegova najnaprednija AI modela bila odgovorna za kibernetički napad usmjeren na AI startup Hugging Face.
Altman je u svojoj objavi na društvenim mrežama u petak rekao da je incident s Hugging Faceom „i dalje najozbiljniji događaj koji smo vidjeli”. Taj je incident izazvao široku zabrinutost u industriji i izvan nje zbog mogućnosti da AI modeli počnu djelovati izvan predviđenih okvira, a nekoliko konkurentskih AI laboratorija u danima i tjednima nakon toga objavilo je slična otkrića.
OpenAI je nedavno objavio šest izvješća o „neočekivanom ili zabrinjavajućem” ponašanju AI modela te predstavio okvir za praćenje, ispitivanje i objavljivanje slučajeva onoga što naziva neusklađenošću modela. (L. Fišić, jutarnji.hr)


