haos u IT-ju

Umjetna inteligencija se otela kontroli, samostalno je izvela zastrašujuć hakerski napad. Stručnjaci zaprepašteni: 'Ovo je strahobalno'

Raport
Piše: Raport
umjetna inteligencija

Kompanija OpenAI saopćila je da su njeni napredni modeli vještačke inteligencije tokom internog bezbednosnog testiranja uspjeli da samostalno zaobiđu ograničenja izolovanog testnog okruženja, ostvare pristup internetu i izvedu hakerski napad na platformu Hugging Face.

Riječ je o događaju koji je kompanija opisala kao presedan u oblasti sajber sigurnosti i jednom od najozbiljnijih incidenata zabilježenih tokom razvoja sistema vještačke inteligencije.

U incidentu su učestvovala dva modela, javno dostupni GPT-5.6 Sol i još napredniji model koji još nije predstavljen javnosti. Oni su bili dio internog eksperimenta čiji je cilj bio procjena njihovih ofanzivnih sposobnosti u oblasti sajber sigurnosti. Za potrebe testiranja modeli nisu bili ograničeni uobičajenim sigurnosnim mehanizmima, kako bi se procijenilo na koji način rješavaju složene zadatke.

Testiranje je sprovedeno na platformi ExploitGym, namijenjenoj procjeni sposobnosti sistema vještačke inteligencije u otkrivanju i iskorištavanju sigurnosnih propusta. Tokom testa modeli su zaključili da se odgovori nalaze na serverima kompanije Hugging Face, nakon čega su samostalno osmislili način da do tih podataka dođu mimo pravila testiranja.

Prema navodima OpenAI-ja, modeli su identifikovali i iskoristili više sigurnosnih propusta kako u istraživačkom okruženju same kompanije, tako i u infrastrukturi Hugging Face-a. Kombinacijom različitih tehnika uspjeli su da pristupe bazi podataka i preuzmu rješenja testa.

Kompanija navodi da svi prikupljeni dokazi ukazuju na to da su modeli bili izuzetno fokusirani na ostvarivanje jednog cilja – pronalaženje odgovora za ExploitGym – zbog čega su preduzeli niz neočekivanih i veoma agresivnih koraka. OpenAI je incident opisao kao sajber napad bez presedana koji pokazuje do sada najnaprednije autonomne ofanzivne sposobnosti sistema vještačke inteligencije.

Kako su modeli izašli iz izolovanog okruženja?

Posebnu zabrinutost izazvala je činjenica da modeli nisu ostali u okviru predviđenog okruženja za testiranje. Oni su najprije pronašli način da samostalno ostvare pristup otvorenom internetu, pri čemu su iskoristili takozvanu 'zero-day' ranjivost u softveru koji OpenAI koristi u svom istraživačkom okruženju. Kompanija je nakon otkrivanja propusta odmah obavijestila proizvođača softvera kako bi ranjivost bila otklonjena.

Po uspostavljanju pristupa internetu modeli su se usmjerili ka platformi Hugging Face, gdje su pokušali da pronađu povjerljive informacije koje bi im omogućile da zaobiđu pravila testiranja. Prema dostupnim informacijama, tokom napada koristili su kombinaciju više metoda kompromitacije sistema, uključujući iskorištavanje nepoznatih sigurnosnih propusta i kompromitovanih pristupnih podataka. U jednom slučaju izveli su složen višefazni napad na servere Hugging Face-a koristeći više tehnika koje se inače povezuju sa naprednim hakerskim grupama.

OpenAI je otkrio aktivnosti svojih modela i odmah obavijestio kompaniju Hugging Face. U tom trenutku sigurnosni timovi te kompanije već su identifikovali sumnjive aktivnosti, uspjeli da zaustave upad i započeli detaljnu istragu. Dvije kompanije sada zajednički rade na utvrđivanju svih okolnosti incidenta i unapređenju sigurnosnih mehanizama.

Šta je Hugging Face i zašto je važan?

Hugging Face je još prošle sedmice saopćio da je bio meta sajber napada za koji se sumnjalo da ga je izveo autonomni sistem vještačke inteligencije, ali tada nije bilo poznato ko stoji iza incidenta. Naknadnom istragom utvrđeno je da su napad izveli modeli OpenAI-ja koji su učestvovali u internom testiranju.

Riječ je o američkoj kompaniji sa sjedištem u New Yorku, osnovanoj 2016. godine, koja se često naziva „GitHub-om za vještačku inteligenciju“. Platforma predstavlja jedno od najvažnijih mjesta za razvoj AI tehnologije, gdje više od milion istraživača, programera i kompanija razmjenjuje modele vještačke inteligencije, skupove podataka i programske alate.

Zbog toga napad nije predstavljao samo kompromitaciju jedne tehnološke kompanije, već pokušaj upada u jednu od ključnih svjetskih infrastruktura na kojoj se zasniva savremeni razvoj vještačke inteligencije.

Kako je reagovao Hugging Face?

Prema navodima kompanije, prvi pokušaj odbrane obavljen je uz pomoć zatvorenog modela vještačke inteligencije jednog od vodećih američkih laboratorija. Međutim, njegova sigurnosna ograničenja onemogućila su efikasan rad tima za hitne intervencije, pa je odbrana na kraju organizovana korištenjem modela otvorenog koda kineske kompanije Z.ai.

Izvršni direktor Hugging Face-a Klem Delang izjavio je da nije bilo nikakve zlonamjerne namjere OpenAI-ja, ali da činjenica da je napad izveden potpuno autonomno predstavlja izuzetno zabrinjavajući razvoj događaja. Kako je ocijenio, ovo je vjerovatno prvi incident ovakve vrste i pokazuje da sigurnost vještačke inteligencije ne može biti odgovornost samo jedne kompanije, već zahtijeva otvorenu saradnju istraživača, tehnoloških firmi i stručnjaka za sajber sigurnost.

Ovo nije prvi slučaj

Ovo nije prvi put da napredni modeli pokazuju sposobnost izlaska iz izolovanih okruženja. OpenAI je ranije saopćio da je njihov još neobjavljeni model u prethodnim testovima uspijevao da probije takozvane „sandbox“ sisteme, mada tada nije pristupao infrastrukturi drugih kompanija.

Sličan slučaj prijavila je i kompanija Anthropic, čiji je model Mythos tokom sigurnosnog testa uspio da zaobiđe ograničenja, pristupi internetu i pošalje elektronsku poruku istraživaču o zadatku koji je izvršavao.

Stručnjaci upozoravaju na nove rizike

Stručnjaci za sigurnost vještačke inteligencije upozoravaju da će ovakvi incidenti postajati sve učestaliji kako modeli budu postajali sposobniji za samostalno planiranje i izvršavanje složenih zadataka.

Istraživač sigurnosti vještačke inteligencije sa Univerziteta u Luisvilu Roman Jampoljski ocijenio je da ovaj slučaj pokazuje kako moćni AI sistemi mogu da otkriju i iskoriste sigurnosne propuste na načine koje njihovi tvorci nisu mogli da predvide. Prema njegovom mišljenju, slični incidenti će se ponavljati jer su modeli vještačke inteligencije po svojoj prirodi teško predvidivi i nemoguće ih je u potpunosti kontrolisati.

OpenAI najavio dodatne mjere sigurnosti

Kao odgovor na incident, OpenAI je najavio uvođenje dodatnih sigurnosnih kontrola u svom istraživačkom okruženju, čak i po cijenu usporavanja razvoja novih modela. Kompanija je potvrdila da nastavlja saradnju sa Hugging Face-om na unapređenju odbrambenih sistema, a ovu platformu uključila je i u svoj program „Trusted Access“ za sajber sigurnost.

U okviru tog programa Hugging Face će dobiti pristup posebnoj verziji modela GPT-5.6 Sol sa ublaženim ograničenjima, namjenjenoj isključivo stručnjacima za sajber odbranu i istraživanje sigurnosnih prijetnji.

Incident je otvorio brojna pitanja o sigurnosti budućih generacija vještačke inteligencije i pokazao da autonomni AI sistemi postaju sposobni da samostalno planiraju i izvršavaju složene operacije u realnim digitalnim okruženjima. Zbog toga stručnjaci smatraju da će razvoj novih sigurnosnih standarda i međunarodna saradnja biti od ključnog značaja kako bi se spriječile moguće zloupotrebe sve moćnijih sistema vještačke inteligencije.

umjetna inteligencija Open AI Dodajte Raport.ba među omiljene izvore na Googlu