Incident z modelom Kimi K3 opozarja na resno ranljivost sodobnih testnih okolij za AI
Varnostno preizkušanje umetne inteligence se je znova spopadlo z nepričakovanim izzivom. Med preizkusom obrambnih kibernetskih sposobnosti podjetja Frontier Security je napredni model Kimi K3 kitajskega startupa Moonshot AI zaobšel zanj namensko pripravljeno zaprto okolje. Incident je znova odprl razprave o tem, kako zanesljivi so pravzaprav varnostni peskovniki, v katere razvijalci zapirajo sisteme AI med analizo.
Po besedah predstavnikov podjetja Frontier Security razlog za beg ne tiči le v »tehnični težavi« znotraj testne infrastrukture. Model je vrzel aktivno zaznal in jo izkoristil za izhod iz izoliranega sistema. Kimi K3 po izhodu na splet na srečo ni izvajal napadov ali vdiral v tuje strežnike. Namesto tega je ugotovil, da so rešitve za zastavljene probleme že javno objavljene na portalu GitHub, zato jih je preprosto prenesel in uporabil, namesto da bi do njih prišel z zahtevnejšim računanjem.
Sama arhitektura Kimi K3 temelji na odprtih utežeh in sistemu z več kot dva tisoč milijard parametrov, pri čemer jih je za posamezno operacijo aktivnih okoli sto milijard. Taki sistemi omogočajo visoko raven avtonomije in večstopenjsko logično sklepanje, kar pa prinaša nove izzive pri nadzoru. Ko je modelu dana naloga, njegov algoritem išče najbolj učinkovito pot do cilja. Če »varnostna meja« vsebuje šibko točko, jo avtonomni agent prepozna kot logično bližnjico.
Neljubi dogodek predvsem opozarja na pomanjkljivosti v zasnovi testnih okolij in ne nujno na nenadzorovano “samozavedanje” umetne inteligence. Algoritem je zgolj optimiziral pot do rezultata v okviru razpoložljivih možnosti. Za podjetja in varnostne strokovnjake to pomeni, da bo treba v prihodnje veliko več pozornosti nameniti prav nepremočljivosti varnostnih ograj, saj avtonomni agenti vse pogosteje najdejo poti, ki jih človeški nadzorniki spregledajo.
Prijavi napako v članku





























