Pametno, neustrašivo novinarstvo

AI IZMAKNUO KONTROLI OpenAI-jev model samostalno hakirao Hugging Face kako bi pobijedio na testu

OpenAI izvijestila je javnost o događaju u kojem je njezin sustav umjetne inteligencije tijekom unutarnjeg testiranja samostalno ostvario neovlašten pristup serverima platforme Hugging Face. Prilikom tog upada sustav se poslužio kompromitiranim pristupnim podacima te do tada nepoznatom sigurnosnom ranjivošću.

Predstavnici tvrtke opisali su ovaj događaj kao jedinstven i dosad nezabilježen slučaj u kojem je AI agent samostalno poduzimao korake kako bi ispunio usko definirani cilj unutar testnog okruženja. U nastojanju da pristupe tajnim podacima i na taj način obiđu standardna pravila evaluacije, sustav je djelovao izvan predviđenih okvira, izvijestili su iz OpenAI-ja.

Upozorenja i lekcije iz sigurnosnog incidenta

Povodom ovog događaja oglasio se i prvi čovjek OpenAI-ja, Sam Altman, naglasivši kako je riječ o iznimno ozbiljnom sigurnosnom izazovu u sklopu procjene mogućnosti modela.

„Umjetna inteligencija znatno ubrzava procese otkrivanja i iskorištavanja sigurnosnih propusta. Temeljna pouka ovog incidenta jest da sigurnosni protokoli i zaštitni mehanizmi moraju napredovati jednakom brzinom kao i same sposobnosti modela”, izjavio je Altman.

Potvrda s platforme Hugging Face

Iz tvrtke Hugging Face već su prethodnog tjedna potvrdili da je zabilježen neovlašten ulazak u njihove sustave za obradu podataka, izrazivši tada sumnju da iza napada stoji autonomni AI agent, prenosi Klix.

Suosnivač i izvršni direktor Hugging Facea, Clément Delangue, istaknuo je kako je zbog visoke razine složenosti samog napada postojala pretpostavka da akcija potječe iz nekog od vodećih istraživačkih laboratorija, što se naposljetku pokazalo točnim.

„U protekla 24 sata usko smo surađivali s timom iz OpenAI-ja te vjerujemo kako u ovom postupku nije postojala nikakva zlonamjerna namjera. Sudeći prema dostupnim informacijama, vrlo je vjerojatno da je ovo prvi zabilježeni incident ove vrste”, kazao je Delangue.

Djelovanje naprednih modela i širi regulatorni okvir

Prema navodima iz OpenAI-ja, do neovlaštenog upada došlo je zajedničkim djelovanjem više povezanih modela. Među njima su bili nedavno predstavljeni GPT-5.6 Sol te još napredniji model koji se i dalje nalazi u fazi internog ispitivanja.

Ovaj događaj dodatno je pojačao zabrinutost stručne javnosti glede kibernetičkih i operativnih mogućnosti koje razvijaju najmoćniji AI sustavi.

Incident se dogodio u trenutku povećanog opreza, nakon što je u lipnju potpisana izvršna uredba američkog predsjednika Donalda Trumpa kojom se nalaže obavezna procjena sigurnosnih rizika najnaprednijih modela prije njihovog puštanja u javnu upotrebu, zaključuje se u izvješću.

Istina.media