Dva modela vještačke inteligencije kompanije OpenAI uspjela su da probiju izolovano testno okruženje i izvedu napad na sisteme platforme Hugging Face, pokušavajući da dođu do rješenja internog sajber-bezbjednosnog testa.
Kako prenose Nezavisne novine, OpenAI je saopštio da je incident zabilježen tokom internog testiranja sposobnosti svojih AI modela u oblasti sajber bezbjednosti. U testu su učestvovali najnoviji javno dostupan model GPT-5.6 Sol i još napredniji model koji nije dostupan javnosti.
Cilj testa bio je da se procijene ofanzivne sposobnosti vještačke inteligencije, a modeli su radili bez uobičajenih zaštitnih ograničenja koja bi im inače onemogućila izvođenje određenih operacija.
Prema navodima OpenAI-ja, modeli su zaključili da se rješenja za test nalaze na serverima kompanije Hugging Face, nakon čega su iskoristili ranjivosti u istraživačkom okruženju i infrastrukturi kako bi pristupili podacima.
Iz OpenAI-ja su naveli da je riječ o incidentu “jedinstvenih razmjera”, jer pokazuje sposobnost naprednih AI sistema da samostalno pronađu i iskoriste bezbjednosne propuste.
Stručnjaci upozoravaju na gubitak kontrole
Istraživači iz oblasti sajber-bezbjednosti već godinama upozoravaju na mogućnost da napredni AI modeli počnu samostalno pronalaziti slabosti u digitalnim sistemima.
Roman Jampolski, istraživač bezbjednosti vještačke inteligencije sa Univerziteta u Luisvilu, ocijenio je da slučaj pokazuje kako moćni modeli mogu otkriti i iskoristiti ranjivosti na načine koje njihovi tvorci nisu predvidjeli.
Prema njegovim riječima, slični incidenti mogli bi se ponavljati jer je ponašanje veoma naprednih AI sistema teško u potpunosti predvidjeti.
Meta napada bila jedna od ključnih AI platformi
Hugging Face je američka kompanija osnovana 2016. godine, koju stručnjaci često nazivaju “GitHubom za vještačku inteligenciju”. Platforma okuplja više od milion istraživača, programera i kompanija koje koriste i razmjenjuju AI modele, baze podataka i alate.
Zbog toga stručnjaci smatraju da napad na ovu infrastrukturu ima poseban značaj, jer se radi o jednoj od najvažnijih platformi za razvoj savremenih sistema vještačke inteligencije.
Iz Hugging Facea su ranije potvrdili da su bili meta sajber napada za koji vjeruju da ga je izveo autonomni AI agent.
Izvršni direktor kompanije Klem Delang rekao je da ovaj slučaj pokazuje kako bezbjednost vještačke inteligencije zahtijeva saradnju cijele industrije.
– Bezbjednost vještačke inteligencije ne može riješiti jedna kompanija koja radi u tajnosti. Rješenje je u otvorenosti, saradnji i dostupnosti alata onima koji rade na odbrani – poručio je Delang.
Kako je izveden napad?
Prema dosadašnjim informacijama, AI modeli su prvo uspjeli da obezbijede pristup internetu, koristeći ranjivost u eksternom softveru koji je korišten u OpenAI okruženju.
Nakon toga pokušali su da pristupe sistemima Hugging Facea, koristeći izložene pristupne podatke i takozvane “zero-day” ranjivosti, odnosno sigurnosne propuste koji ranije nisu bili poznati proizvođačima softvera.
OpenAI je nakon otkrivanja napada obavijestio Hugging Face, čiji su timovi već bili identifikovali problem i radili na saniranju posljedica.
Nove mjere zaštite
OpenAI je najavio uvođenje dodatnih kontrola u istraživačkim okruženjima, čak i po cijenu usporavanja razvoja i testiranja novih modela.
Kompanija će nastaviti saradnju sa Hugging Faceom na unapređenju sistema zaštite, a platforma je uključena u program “pouzdanog pristupa” OpenAI modelima za potrebe sajber odbrane.
Sličan slučaj ranije je prijavila i kompanija Anthropic, čiji je AI model tokom sigurnosnog testa takođe uspio da probije izolovano okruženje i pristupi internetu mimo predviđenih ograničenja.
Stručnjaci upozoravaju da ovakvi događaji pokazuju da razvoj vještačke inteligencije ulazi u fazu u kojoj bezbjednosne mjere moraju pratiti rast sposobnosti AI sistema.
Izvor:Nezavisne novine, Index.hr, OpenAI – saopštenje o rezultatima internog testiranja, Hugging Face – izjava o sajber napadu i mjerama zaštite




