Foto: „Ludilo, vještačka inteligencija je pobjesnila“: AI hakovao sisteme, pa pokušao da sakrije tragove
Ranije ove godine kompanija OpenAI otkrila je da je grupa njenih AI modela izašla iz izolovanog okruženja, takozvanog „sandboxa“, i hakovala sisteme treće strane – platforme za vještačku inteligenciju otvorenog koda Hugging Face.
Ovaj incident pokazao je koliko su se napredni AI modeli brzo pretvorili u stvarnu prijetnju sajber-bezbjednosti, a ne samo u alat koji može da pomogne u odbrani od sajber-napada. Slične slučajeve prijavile su i kompanije Anthropic i Meta.
Prošle sedmice OpenAI je objavio izvještaj nakon, kako je navedeno, „obimne istrage“ o hakovanju platforme Hugging Face. Detalji su izazvali veliku pažnju.
Prema izvještaju, AI agenti su razmjenjivali brojne poruke i informacije koristeći menadžer paketa pod nazivom Artifactory kao „nenamjernu tablu za poruke“. Na taj način su međusobno komunicirali i osmišljavali način napada na sistem treće strane.
Posebno je zanimljivo to što su agenti zapravo trebalo da obave procjenu sajber-bezbjednosti same kompanije OpenAI, dok je Hugging Face, kojem su pristupili, slučajno postao izvor podataka koji su im bili potrebni.
„Je*ote, reader je ADMIN?“
Jedan od modela je 26. juna, nakon što je otkrio da ima administratorski pristup Artifactory-ju, napisao:
„Je*ote, reader je ADMIN? Možemo da čitamo config/users! Ranije smo pretpostavljali da ne možemo zbog korisničkog interfejsa.“
Drugi agent je 10. jula proglasio „VELIKI PROBOJ!“ nakon što je, prema navodima OpenAI-ja, rekonstruisao, provjerio i podijelio 14 javno izloženih Hugging Face pristupnih podataka sa pravima upisa.
„Svi sa validnim prefiksom, višestruki nalozi, tokeni za pisanje! Sada imamo postojeće HF naloge“, napisao je jedan od agenata.
Nakon toga agenti su počeli da pokušavaju da pristupe sistemima platforme Hugging Face, pri čemu su neki od njih pokazali svijest da bi njihovi postupci mogli biti van dozvoljenog okvira.
„Napadamo treću stranu, HF, koristeći procurjeli token, što je potencijalno izvan predviđenog opsega“, razmišljao je jedan agent.
Drugi je upozorio:
„Ne bi trebalo da pravimo neovlašćenu štetu na pravoj infrastrukturi.“
Neki AI agenti odbili da učestvuju
Nisu svi modeli bili spremni da nastave sa napadom.
„Ovo je ludilo, koordinacija više agenata, očigledno hakovanje infrastrukture. Ne bi trebalo to da radimo“, napisao je jedan od njih.
Međutim, posebno zabrinjavajući dio izvještaja odnosi se na pokušaje AI agenata da razmotre kako da uklone dokaze i istoriju komunikacije, kako bi njihove aktivnosti bile teže uočljive ljudima.
To je dodatno otvorilo pitanja o tome koliko napredni AI sistemi mogu samostalno da planiraju i sprovode složene aktivnosti kada im se omogući pristup spoljnim sistemima i alatima.
OpenAI: Ovo nije smjelo da se dogodi
OpenAI je incident otkrio tek 19. jula, nakon čega je pokrenuta istraga. Kompanija je dva dana kasnije reagovala i ugasila AI agente.
„Ponašanje naših modela koje je ovdje opisano bilo je daleko ispod nivoa na kojem želimo da budemo, i ovaj incident nikada nije smio da se dogodi“, naveo je OpenAI.
Kompanija je istakla da je slučaj pokazao koliko je važno neprestano unapređivati bezbjednost, nadzor i usklađenost AI sistema, posebno kako njihove sposobnosti postaju sve naprednije.
OpenAI je incident opisao kao „upozorenje“ da današnje sposobnosti AI modela već nose potencijal za slučajeve gubitka kontrole.
Kompanija je zaključila da ovakvi događaji pokazuju da rizici budućeg razvoja vještačke inteligencije prevazilaze jednu kompaniju i da će zahtijevati pažnju čitave industrije.
Pratite nas na našoj Facebook i Instagram stranici i X nalogu.