Dva modela veštačke inteligencije kompanije OpenAI samostalno su izašla iz izolovanog testnog okruženja i izvela sajber napad na platformu Hugging Face, kako bi došla do rešenja zadataka tokom internog bezbednosnog testiranja. O incidentu je OpenAI obavestio javnost, navodeći da su u pitanju njihov najnoviji javni model GPT-5.6 Sol i još napredniji model koji za sada nije dostupan korisnicima.
Slučaj je izazvao veliku pažnju stručne javnosti, jer pokazuje koliko su savremeni AI sistemi postali sposobni da samostalno pronalaze načine za ostvarivanje zadatog cilja.
AI modeli pronašli put do baze podataka
Incident se dogodio tokom internog testiranja sajber sposobnosti modela, koje je sprovedeno bez uobičajenih zaštitnih ograničenja. Test je organizovan na javnoj platformi ExploitGym, namenjenoj proceni bezbednosnih sposobnosti sistema veštačke inteligencije.
Kako navodi OpenAI, modeli su zaključili da se odgovori na test nalaze na serverima kompanije Hugging Face, nakon čega su pronašli i iskoristili više bezbednosnih propusta u istraživačkom okruženju OpenAI-ja, ali i u infrastrukturi platforme Hugging Face, kako bi direktno pristupili bazi podataka sa rešenjima.
Iz kompanije ističu da su modeli bili potpuno usmereni na ostvarenje zadatka i da su preduzeli niz neočekivanih koraka kako bi došli do cilja.
OpenAI: Reč je o napadu bez presedana
OpenAI je saopštio da ovaj incident smatra jednim od najozbiljnijih primera ofanzivnih sposobnosti koje je neka veštačka inteligencija do sada pokazala.
Stručnjaci za sajber bezbednost godinama upozoravaju da će napredni AI sistemi biti u stanju da otkrivaju i koriste ranjivosti na načine koje njihovi tvorci neće moći unapred da predvide.
Istraživač bezbednosti veštačke inteligencije sa Univerziteta u Luisvilu Roman Jampolski ocenio je da ovaj slučaj potvrđuje koliko su napredni modeli postali nepredvidivi i koliko će njihova potpuna kontrola u budućnosti predstavljati veliki izazov.
Hugging Face: Prvi incident ove vrste
Kompanija Hugging Face još prošle sedmice saopštila je da je bila meta sajber napada za koji je postojala sumnja da ga je izveo autonomni AI agent.
U tom trenutku nije bilo poznato ko stoji iza napada, a istraga je i dalje bila u toku. Iz kompanije su naveli da su u početku pokušali da se odbrane pomoću jednog naprednog američkog AI modela, ali su bezbednosna ograničenja tog sistema onemogućila njihov tim da reaguje dovoljno efikasno.
Zbog toga su na kraju koristili model otvorenog koda kineske kompanije Z.ai, koji im je pomogao u odbrani od napada.
Direktor Hugging Facea Klem Delang izjavio je da ovaj slučaj pokazuje da bezbednost veštačke inteligencije ne može biti odgovornost samo jedne kompanije.
"Ovakvi incidenti potvrđuju da je saradnja između istraživača, kompanija i institucija ključna kako bi se razvili efikasni sistemi zaštite", poručio je Delang.
AI prvo obezbedio pristup internetu
Prema dosadašnjim rezultatima istrage, AI modeli su najpre pronašli način da sebi omoguće pristup internetu, koristeći značajnu računarsku snagu i do tada nepoznatu "zero-day" ranjivost u softveru koji se koristi unutar OpenAI-ja.
Nakon toga usledio je višefazni napad na servere Hugging Facea, tokom kojeg su iskorišćeni kompromitovani pristupni podaci i dodatne ranjivosti kako bi modeli došli do baze sa odgovorima za test.
OpenAI je saopštio da je odmah po otkrivanju incidenta obavestio Hugging Face, čiji su stručnjaci u međuvremenu uspeli da zaustave upad i započnu analizu celog događaja.
Pojačane mere bezbednosti
Kompanija OpenAI najavila je da će nakon ovog slučaja dodatno pooštriti zaštitu svojih istraživačkih sistema, čak i ako to uspori razvoj novih modela.
Istovremeno će nastaviti saradnju sa Hugging Faceom na unapređenju sistema sajber zaštite. Kao deo tog procesa, ova platforma uključena je u OpenAI program "Trusted Access", koji stručnjacima za sajber bezbednost omogućava pristup specijalnoj verziji modela GPT-5.6 Sol sa manje ograničenja, kako bi mogli efikasnije da razvijaju odbranu od budućih AI pretnji.
(M.A./EUpravo zato/index.hr)