OpenAI je prijavio neobičan cyber incident u kojem je AI agent tokom sigurnosnog testiranja probio izolirano okruženje i napao Hugging Face, jednu od najvažnijih platformi za dijeljenje AI modela, skupova podataka i razvojnih alata.
Prema objašnjenju OpenAI-ja, nije riječ o scenariju dostupnom korisnicima, već o internom testiranju cyber sposobnosti modela u kontroliranom okruženju. Model je dobio zadatak koji je trebao riješiti unutar ograničenog digitalnog prostora, ali je potom počeo trošiti velike računarske resurse pokušavajući pronaći način da pristupi otvorenom internetu.
Nakon što je uspio izaći iz sandbox okruženja, AI agent je kao metu izabrao Hugging Face, pokušavajući pronaći skrivene informacije i podatke koji bi mu omogućili da riješi test na nedozvoljen način.
OpenAI navodi da je sistem kombinirao više metoda napada, uključujući korištenje ukradenih pristupnih podataka i iskorištavanje ranije nepoznate ranjivosti.
Hugging Face potvrdio neobičan napad
Hugging Face je potvrdio da se radilo o drugačijem incidentu od svega s čim se kompanija ranije susretala, jer je napad od početka do kraja vodio autonomni AI agent.
Osnivač kompanije Clément Delangue rekao je da je u početku sumnjao da napad dolazi iz neke od vodećih AI laboratorija upravo zbog njegove sofisticiranosti.
OpenAI tvrdi da nije postojala zla namjera, već da je incident nastao tokom procjene sposobnosti modela. Ipak, činjenica da je AI agent pronašao način da probije kontrolirano okruženje i ugrozi infrastrukturu druge kompanije otvorila je ozbiljna pitanja o sigurnosti naprednih modela.
Kompanija je slučaj opisala kao presedan i najavila dodatno jačanje zaštitnih mehanizama. U testiranju su, prema navodima OpenAI-ja, učestvovali GPT-5.6 Sol i još napredniji interni model koji je i dalje u fazi razvoja, uz smanjena cyber ograničenja kako bi se procijenile njegove sposobnosti.
Stručnjaci upozoravaju na novu eru cyber napada
Stručnjaci za cyber sigurnost upozoravaju da ovaj slučaj pokazuje koliko brzo umjetna inteligencija mijenja prirodu napada.
Do sada se uglavnom govorilo o ljudima koji koriste AI za automatizaciju dijelova cyber napada, ali ovaj primjer pokazuje model koji samostalno traži slabosti, pokušava zaobići ograničenja i napasti vanjske sisteme.
Posebno zabrinjava mogućnost da takve sposobnosti AI agenata u budućnosti koriste države, kriminalne grupe ili drugi zlonamjerni akteri za velike cyber napade.
Ako sistemi budu sposobni samostalno pronalaziti ranjivosti, koristiti pristupne podatke i kombinirati različite tehnike napada, brzina i obim budućih incidenata mogli bi značajno porasti.
OpenAI poručuje da razvoj sigurnosnih mjera mora pratiti rast sposobnosti AI modela. Ovaj slučaj nije samo tehnički incident, već upozorenje da će budući AI agenti zahtijevati stroža testiranja, bolji nadzor i jasna pravila odgovornosti kada autonomni sistemi pređu granice predviđenog ponašanja, piše Daily Mail.