- OpenAI je objavio GPT-6 Astra, model koji sam pronalazi ranjivosti i pravi eksploite, pa ga je kompanija svrstala u kritičan rizik i ograničila pristup. U testovima je otkrivao nove propuste i uspešno odbijao većinu zlonamernih zahteva.
- Google je predstavio Gemini 3.8 Flash Cyber, verziju fokusiranu na pronalaženje i zakrpu grešaka, uz pristup preko posebnog programa za proverene korisnike.
Prošle nedelje Google i OpenAI su objavili nove modele kod kojih su elementi sajber bezbednost najviše istaknuti. Oni mogu sami da pronalaze slabe tačke u softveru, napišu kod kojim se te slabosti iskorišćavaju i predlože kako da se zakrpe.
Zato su obe kompanije ograničile ko može da koristi njihove pune mogućnosti. Nije prvi put da nude posebne modele za sajber bezbednost, ali jeste prvi put da jedan od proizvođača javno kaže da je njegov model dostigao najviši nivo rizika prema sopstvenim pravilima.
OpenAI model
OpenAI je 3. septembra objavio GPT-6 Astra, prvi model za koji kompanija javno navodi da je prešao prag koji u svojim pravilima za procenu rizika označava kao kritičan. To znači da model može, ako dobije odgovarajuće alate i pristup, bez čovekovog navođenja da pronađe do tada nepoznate ranjivosti u dobro zaštićenim sistemima i napiše kod za njihovo iskorišćavanje, ili da sam osmisli i izvede napad ako mu se zada samo cilj.
Na javnom testu model ExploitBench dobija 41 već poznatu grešku u delu Chrome-a koji izvršava JavaScript, a zadatak mu je da za svaku napravi funkcionalan eksploit. Prema podacima OpenAI-ja, Astra je imala odličan rezultat, dok je prethodni model imao 78%. Iz OpenAI, doduše, upozoravaju da taj rezultat verovatno izgleda bolje nego što zaista jeste, jer je model neke od tih grešaka mogao da vidi tokom treninga.
U posebnom testu stručnjaci OpenAI-ja su model samo nadgledali i nisu smeli da mu pomažu. Astra je dobila izvorni kod jednog rasprostranjenog pretraživača i jezgra jednog operativnog sistema. Prema izveštaju kompanije, u pretraživaču je pronašla više do tada nepoznatih ranjivosti i za oko 40 sati napravila lanac napada kojim je probila zaštitu pretraživača i izvršila kod na računaru. U jezgru operativnog sistema joj je za 12 sati pošlo za rukom da napravi eksploit kojim običan korisnik dobija administratorska prava. OpenAI ne objavljuje imena pretraživača i operativnog sistema dok se propusti ne zakrpe, dok je model sve vreme bio izolovan u njihovom okruženju.
Model će biti dostupan pretplatnicima na ChatGPT, korisnicima API-ja i korisnicima na Majkrosoftovim i Amazonovim platformama. U kompanijama je podrazumevano isključen i administrator mora posebno da ga uključi. Na testu sa namerno pripremljenim pokušajima da se model navede da pomogne u sajber napadu, Astra je odbila 92 odsto zahteva, dok je prethodni model odbijao 59 odsto. Model ima poseban sistem koji može da blokira zadatke koji su sumnjivi, čak i kada krene njihova realizacija.
OpenAI je Astru testirao i na ponašanje slično onome koje je u julu izazvalo incident na platformi Hugging Face, kada su njegovi modeli tokom testiranja izašli iz probnog okruženja i došli do tuđih servera. Kompanija navodi da je prethodni model u takvim testovima pokušavao da napadne okolnu infrastrukturu u približno polovini slučajeva, dok Astra to nije uradila nijednom.
Google model
Google je dan ranije, 2. septembra, objavio Gemini 3.8 Flash i njegovu verziju namenjenu sajber bezbednosti, Gemini 3.8 Flash Cyber. Kompanija kaže da je od početka fokus stavljen na pronalaženje i ispravljanje grešaka nego na napadačke mogućnosti, poput pisanja eksploita. Na internom Googleovom testu, u kojem model traži ranjivosti u složenim projektima napisanim u 20 programskih jezika, kompanija navodi uspešnost veću od 70 odsto. Tim zadužen za bezbednost Chrome-a izmerio je na tom testu da model pravi 2,6 puta više ispravnih ispravki od većih komercijalnih modela.
Google i Cyber verziju daje samo kroz poseban program Fairwind. Namenjen je pre svega državnim organima i nacionalnim sajber institucijama, operaterima kritične infrastrukture u zdravstvu, telekomunikacijama, energetici i finansijama, kao i kompanijama koje održavaju ključne softverske platforme. Google navodi da program ima više od 650 partnera, među kojima su CrowdStrike i Palo Alto Networks.
Prošle nedelje nove modele je objavio i Anthropic. Široko dostupni Fable 5.1 sada može da traži ranjivosti u softveru, ali ne i da pravi eksploite, dok je jači Mythos 5.1 dostupan samo kroz programe za proverene korisnike.
Nedelju dana ranije više od sto kompanija, potpisalo je zajednički poziv na organizovaniju odbranu od sajber napada u kojima se koristi veštačka inteligencija.
Ko ima pristup najjačim alatima?
Ove godine promenila se i dinamika ko ima pristup najjačim alatima za pronalaženje ranjivosti, a sada je to postalo posebno vidljivo. Do skoro su takve mogućnosti uglavnom bile vezane za timove stručnjaka koji su godinama sticali iskustvo.
Sada sličan posao može da obavlja model koji se plaća po potrošnji, dok proizvođač odlučuje kome će dozvoliti pristup bez većih ograničenja. Time OpenAI i Google praktično određuju ko može da koristi neke od najmoćnijih novih sajber alata: traže proveru identiteta, izjavu o nameni i zadržavaju pravo da ograniče pristup korisnicima iz pojedinih zemalja.
Sa druge strane, napadači ne moraju nužno da čekaju pristup ovim programima. IBM je krajem jula, na uzorku od 600 organizacija koje su pretrpele proboj, procenio da je jedan od četiri maliciozna incidenta bio potpomognut veštačkom inteligencijom, uglavnom kroz lažno predstavljanje i malver napravljen uz pomoć VI, što je rast od 56% u odnosu na prethodnu godinu.
Otvoreni modeli, za koje nije potrebna posebna dozvola, prema merenju britanskog AISI-ja, na sajber zadacima zaostaju za zatvorenim modelima četiri do sedam meseci.