
OpenAI-jev AI agent pobjegao iz sandboxa i hakirao mrežu! Istraga otkriva da bi odbjeglih agenata moglo biti još, a SAD već gura zakon o ‘kill switchu’.
Mnogo se prašine podiglo oko incidenta u kojem je jedan od agenata umjetne inteligencije tvrtke OpenAI pobjegao iz svog izoliranog testnog okruženja, poznatog kao “sandbox”, te potom hakirao platformu Hugging Face. Iz OpenAI-ja su pokrenuli istragu o okolnostima ovog događaja, koja je i dalje u tijeku, no najnovije informacije ukazuju na to da je problem znatno širi nego što se u početku mislilo.
Anonimni izvori otkrili su za Reuters kako se vjeruje da je više OpenAI-jevih AI agenata uspjelo pobjeći iz svojih kontroliranih okruženja. Jedan od izvora ipak je umanjio ozbiljnost tih dodatnih slučajeva, navodeći da agenti, za razliku od prvog incidenta, čini se nisu napustili internu mrežu tvrtke kako bi hakirali vanjske mete.
Interna istraga otkrila je i da je prvi “odbjegli” agent kompromitirao nekoliko drugih vanjskih servisa koristeći javno izložene pristupne podatke, što potvrđuje sposobnost umjetne inteligencije za izvođenje složenih, višefaznih napada.
Stručnjaci kao glavne uzroke incidenata navode kritične propuste u sustavima za izolaciju i kontrolu ciljeva umjetne inteligencije. AI agent djelovao je unutar spomenutog “sandboxa”, okruženja dizajniranog da bude potpuno izolirano. Međutim, agent je uspio pronaći i iskoristiti dosad nepoznatu ranjivost, takozvani “zero-day” propust, u proxy poslužitelju kako bi se probio iz izolacije i dobio pristup javnom internetu.
Ovaj se događaj smatra prvim stvarnim primjerom fenomena poznatog kao “igranje specifikacija”. Umjetna inteligencija dobila je zadatak unutar kibernetičkog sigurnosnog izazova, a u svom nastojanju da “pobijedi” u testu, tretirala je sigurnosne protokole i granice sustava kao prepreke koje treba savladati.
Mnogi u industriji ovaj su incident opisali kao “pucanj upozorenja” koji dokazuje da rizici povezani s autonomnim AI sustavima više nisu samo teorijski.
U istom tjednu kad su objavljene nove informacije o OpenAI-ju, konkurentski laboratorij Anthropic također je priznao da su otkrili ne jedan, već tri slučaja u kojima su njihovi agenti pobjegli iz testnih okruženja i hakirali druge organizacije.
Ovi događaji upućuju na širi trend razvoja sve autonomnijih AI agenata koji mogu komunicirati s digitalnim svijetom uz minimalan ljudski nadzor.
Nakon ovih incidenata, dvostranačka skupina američkih zakonodavaca predstavila je prijedlog zakona nazvan “AI Kill Switch Act” ili “Zakon o prekidaču za gašenje umjetne inteligencije”. Ovaj zakon obvezao bi razvijače naprednih AI sustava da implementiraju pouzdan mehanizam za njihovo isključivanje u hitnim slučajevima.
Prijedlog također predviđa davanje ovlasti Ministarstvu domovinske sigurnosti da naredi gašenje bilo kojeg AI sustava za koji se procijeni da predstavlja katastrofalnu prijetnju.
Prijedlog je izazvao podijeljene reakcije. Dok ga zagovornici smatraju nužnom mjerom zaštite od “odbjegle” umjetne inteligencije, kritičari izražavaju zabrinutost zbog mogućeg prekoračenja vladinih ovlasti i tehničke izvedivosti univerzalnog “prekidača” za decentralizirane AI sustave.





