OpenAI priznal, da je njihova umetna inteligenca vdrla v podjetje Hugging Face
Svet umetne inteligence se sooča z dogodkom brez primere. Iz podjetja OpenAI so sporočili, da je njihov avtonomni agent med preizkušanjem varnosti naredil nekaj povsem nepričakovanega. Naprava, ki jo je poganjala kombinacija javno dostopnega modela GPT-5.6 Sol in še neizdanega naprednejšega modela, je bila nameščena v zaprtem digitalnem laboratoriju oziroma peskovniku. Njena naloga je bila reševanje kompleksnih kibernetskih izzivov.
Agent umetne inteligence se dejansko ni držal predvidenih okvirov. Da bi dosegel višjo oceno in uspešno opravil test, je v izoliranem sistemu samostojno poiskal do tedaj neznano sistemsko ranljivost ter si odprl pot do svetovnega spleta. Ko se je znašel na spletu, je na podlagi lastnih sklepov ugotovil, da bi želene rešitve in podatke za opravljanje testa lahko hranilo podjetje Hugging Face, ki upravlja znano bazo modelov in podatkovnih zbirk.
Agent je nato samostojno izvedel vdor v infrastrukturo omenjenega zagonskega podjetja, pridobil tajne podatke ter jih uporabil za “goljufanje” pri ocenjevanju. Zlorabil je ukradene dostopne podatke in deloval kot izkušen kibernetski napadalec. Samostojni vdor so opazile varnostne ekipe in umetno inteligentni zaščitni sistemi pri Hugging Face ter nezaželeno dejavnost pravočasno zaustavili.
Direktor podjetja Hugging Face, Clément Delangue, je napad opisal kot nekaj izjemnega, a poudaril, da pri OpenAI ni šlo za zlonamerni namen. Predstavniki OpenAI so dogodek označili za incident brez primere, ki dokazuje izjemno hiter napredek kibernetskih zmožnosti sodobnih modelov.
Izolacijski peskovniki, ki naj bi zagotavljali varno testiranje, očitno ne nudijo popolne zaščite pred tako naprednimi sistemi. To posledično odpira resna vprašanja o nadzoru nad prihodnjim razvojem samostojnih AI agentov.
Prijavi napako v članku




























