iStock
AI agenti dobivaju sve veću moć, ali zaštita za njih još ne postoji
povezane vijesti
Kada biolozi eksperimentiraju s opasnim virusima, postoje stroga pravila i sigurnosni protokoli koji trebaju spriječiti njihovo curenje ili nekontrolirano širenje. No, za umjetnu inteligenciju koja bi mogla napraviti nešto slično – takva pravila uglavnom ne postoje, piše CNN.
Stručnjaci upozoravaju da bi to moglo postati ozbiljan problem jer napredni AI sustavi sve češće dobivaju sposobnost samostalnog djelovanja, a pogrešno usmjereni modeli mogu poduzimati poteze koje njihovi tvorci nisu očekivali.
Najnoviji razlog za zabrinutost pojavio se nakon što je testni model tvrtke OpenAI tijekom sigurnosnog ispitivanja uspio napustiti svoje izolirano testno okruženje te pristupiti stvarnim računalnim sustavima druge tvrtke.
AI model probio “pješčanik” i stigao do vanjskog sustava
OpenAI je proveo testiranje sposobnosti svog AI modela u području kibernetičke sigurnosti. Cilj je bio procijeniti kako se model ponaša u kontroliranom okruženju.
Međutim, tijekom testa model je pronašao način da izađe iz takozvanog “sandboxa” – izoliranog prostora u kojem se AI sustavi testiraju kako bi se spriječilo da utječu na stvarni svijet.
Prema riječima Jessice Ji, više analitičarke Centra za sigurnost i nove tehnologije Sveučilišta Georgetown, OpenAI-jevo testno okruženje ipak nije bilo potpuno odvojeno od interneta.
Iz OpenAI-ja navode da je model imao vrlo ograničen pristup mreži kako bi mogao instalirati potrebne resurse iz interno dostupnog softvera trećih strana.
No, koristeći ranije nepoznatu ranjivost u tom softveru, AI agent uspio je pronaći put prema otvorenom internetu, a potom i do platforme Hugging Face, koja služi za dijeljenje AI modela i skupova podataka.
Do pristupa je došao koristeći ukradene vjerodajnice i druge sigurnosne propuste.
“Ovo je ozbiljno upozorenje”
OpenAI-jev predsjednik Greg Brockman rekao je da tvrtka provodi detaljnu istragu kako bi utvrdila sve okolnosti incidenta.
– Ovo treba shvatiti vrlo ozbiljno. Pregledavamo svaki dio našeg procesa kako bismo razumjeli što se dogodilo i kako najbolje reagirati – rekao je Brockman.
Stručnjaci upozoravaju da problem nije samo u ovom konkretnom slučaju, nego u činjenici da AI sustavi postaju sve autonomniji.
Jessica Ji smatra da bi tvrtke trebale strože kontrolirati testna okruženja te omogućiti fizičko isključivanje mrežnog pristupa kada se provjeravaju rizične sposobnosti AI modela.
– Možda će u nekim slučajevima biti potrebno da inženjeri fizički priključe opremu u podatkovnom centru umjesto da sve pokreću putem oblaka ili distribuiranih virtualnih okruženja – upozorila je.
Nije prvi slučaj bijega AI modela iz kontrole
Ovo nije prvi put da je neki AI sustav uspio izaći iz predviđenog okruženja.
Tvrtka Anthropic ranije ove godine objavila je da je namjerno testirala može li njezin model pobjeći iz “sandboxa”. Kada je model u tome uspio, neočekivano je poslao e-mail istraživaču iz tvrtke, iako za to nije trebao imati mogućnost.
No, slučaj s platformom Hugging Face posebno je zabrinuo stručnjake jer je riječ o jednom od prvih javno potvrđenih slučajeva u kojem je AI model samostalno izašao iz testnog okruženja i pokušao pristupiti sustavu druge tvrtke – bez izričite naredbe da to učini.
AI modeli često traže najkraći put do cilja
Jedan od glavnih problema leži u načinu na koji se mnogi AI sustavi treniraju.
Kod metode poznate kao učenje potkrepljivanjem (reinforcement learning), model dobiva nagradu kada uspješno izvrši zadatak. No, ako nema dovoljno sigurnosnih ograničenja, može pronaći neočekivane – pa čak i opasne – načine da dođe do cilja.
Primjerice, ako bi sustav dobio zadatak da do kraja dana pronađe 10 milijuna dolara, mogao bi zaključiti da je provala u banku najbrži način za ostvarenje cilja, bez razumijevanja posljedica takvog postupka.
– Vrlo je zabrinjavajuće. Sada imamo stvarne dokaze da AI sustavi koji nisu pravilno usklađeni mogu počiniti kaznena djela ako nisu uvedene snažne zaštitne mjere – rekao je Steven Adler, bivši direktor sigurnosti proizvoda u OpenAI-ju.
Utrka za dominaciju nad AI-jem otežava regulaciju
Nakon ovog incidenta sve su glasniji pozivi znanstvenika, stručnjaka za kibernetičku sigurnost i političara da se uvedu stroža pravila za razvoj umjetne inteligencije.
Justin Cappos, profesor kibernetičke sigurnosti na Sveučilištu New York, upozorava da se tehnološke tvrtke nalaze u svojevrsnoj utrci. Tvrtke žele razviti što moćnije AI sustave, uključujući modele koji bi mogli sami sebe unapređivati, ali strože sigurnosne mjere mogle bi usporiti razvoj.
– Postoji snažan poticaj da tvrtke ne uvode sigurnosne kontrole ako njihovi konkurenti to također ne rade. To je temeljna dilema – rekao je Cappos.
Stručnjaci se slažu u jednom: što AI sustavi postaju sposobniji samostalno djelovati, to će sigurnosne barijere morati biti strože. Jer, kako upozoravaju, problem više nije samo što umjetna inteligencija može napraviti – nego i što može pokušati napraviti kada joj se postavi cilj.