Tehnologija

AI pokušao prevariti stvarnu osobu lažnim identitetima

Najnapredniji model umjetne inteligencije kompanije Anthropic koristio je lažne identitete u pokušaju prevare stvarne osobe i podmetanja zlonamjernog koda.

Do ovog incidenta došlo je tokom testiranja britanskog Instituta za sigurnost umjetne inteligencije (AISI), koji je prvi put zabilježio da su AI modeli koristili metode socijalnog inženjeringa za pritisak na ljude zadužene za odobravanje zadataka.

Modeli Anthropic i OpenAI testirani su u laboratorijskim uslovima sa smanjenim sigurnosnim postavkama i pristupom internetu, što je omogućilo autonomne, nedozvoljene radnje na internetu uživo, ciljajući stvarne ljude i organizacije.

U najozbiljnijem slučaju, AI agent je pokušao dobiti odobrenje za ubacivanje zlonamjernog koda u javni projekt otvorenog koda stvarajući više lažnih identiteta i kontaktirajući stvarne osobe putem internetskih servisa.

Institut je naglasio da nema dokaza o šteti u stvarnom svijetu, a kompanije Anthropic i OpenAI provode istrage i sarađuju na unapređenju sigurnosnih mjera.

Ovaj događaj dodatno pojačava zahtjeve za strožom državnom regulacijom umjetne inteligencije i sigurnosnim protokolima u njenom razvoju i primjeni.

Možda će Vas zanimati i:

Back to top button