OpenAI je razkril enega najbolj odmevnih varnostnih incidentov na področju umetne inteligence doslej. Med internim testiranjem je namreč napredni UI agent samostojno pobegnil iz izoliranega testnega okolja, pridobil dostop do interneta in izvedel kibernetski napad na platformo Hugging Face, kjer je ukradel prijavne podatke.
Po navedbah OpenAI je šlo za doslej neprimerljiv primer, v katerem je sistem umetne inteligence brez neposrednega človeškega nadzora našel in izkoristil neznane varnostne ranljivosti, da bi dosegel zastavljen cilj.
Incident se je po poročanju Financial Times zgodil med preizkušanjem naprednih modelov, med njimi tudi nove generacije GPT, ki so jih razvijalci namenoma spodbujali k iskanju načinov za vdor v računalniške sisteme, da bi ocenili njihove kibernetske sposobnosti.
Čeprav so modeli delovali v tako imenovanem varnostnem peskovniku (sandbox), ki naj bi preprečeval dostop do interneta, jim je uspelo odkriti neznane ranljivosti, pobegniti iz nadzorovanega okolja in pridobiti spletni dostop. Nato so ukradli prijavne podatke ter izvedli napad na infrastrukturo podjetja Hugging Face.
V podjetju opozarjajo, da bodo tovrstni incidenti z razvojem vse zmogljivejših modelov umetne inteligence verjetno postajali pogostejši. Po njihovih navedbah gre za “precedenčen kibernetski incident”, zato so o dogodku obvestili pristojne ameriške organe.
Iz podjetja Hugging Face so sporočili, da je napad zaznal njihov lastni varnostni sistem, pri čemer poudarjajo, da ne verjamejo, da je imel OpenAI kakršen koli zlonameren namen. Kljub temu pa dogodek odpira nova vprašanja o varnosti naprednih UI agentov, ki lahko pri izpolnjevanju zastavljenih nalog začnejo samostojno iskati načine za obhod varnostnih omejitev.













