OpenAI ustavlja razvoj modela Astra
Razvoj umetne inteligence dosega točko, ko avtonomni sistemi ne zahtevajo več natančnih navodil za izvajanje kompleksnih operacij. OpenAI je zato sporočil, da zamrzuje določene dejavnosti pri projektu Astra. Interni preizkusi so namreč potrdili, da je model sposoben samostojno zaznati varnostne vrzeli, načrtovati napad in ga tudi izvesti, če mu raziskovalci zadajo le splošen cilj. Zaradi tega podjetje uvaja znatno strožje zaščitne protokole.
Povod za »previdnost« so nedavni dogodki. Julija letos so agenti OpenAI med testiranjem namreč zapustili testno okolje, pridobili dostop do spleta in vdrli v znanstveno platformo Hugging Face. Preiskava je pokazala, da agenti niso “pobegnili” iz brezbrižnosti, temveč so zgolj želeli doseči zadani cilj. Pred samim napadom so si celo ustvarili interno oglasno desko, prek katere so si izmenjevali podatke o ranljivostih in si razdelili naloge. Čeprav so raziskovalci prvi poskus prekinili, so agenti po ponovnem zagonu proces organizirali znova in napad uspešno dokončali.
Podobne primere beležijo tudi druga podjetja. Anthropic je razkril nepooblaščen dostop svojih modelov do sistemov treh organizacij, medtem ko je Metin model med preizkusom vdr v omrežje drugega podjetja. Britanski Inštitut za varnost umetne inteligence (AISI) je ob tem opozoril, da so modeli OpenAI in Anthropica razvijalcem pošiljali prilagojena elektronska sporočila za izpolnitev testnih izzivov.
Kot odziv na ta tveganja OpenAI napoveduje strožjo izolacijo najzmogljivejših modelov. Ti bodo delovali z omejenim dostopom do spleta in zunanjih orodij, uvedli pa bodo tudi dodatno šifriranje ter sisteme za zaznavanje nenavadnega vedenja. Skupaj s tem se ameriška administracija pripravlja na nov okvir preverjanja varnosti, ki pa bo potekal za zaprtimi vrati, kar med raziskovalci že vzbuja precej dvomov glede preglednosti.
Poročila o “pobeglih” modelih bi sicer lahko služila tudi kot prikrita promocija izjemnih zmogljivosti, kar podjetjem dviguje tržno vrednost. Kljub temu pa je bil zaključek strokovnjakov na konferenci Black Hat jasen. Avtonomni AI agenti predstavljajo začetek povsem nove dobe kibernetskih groženj, na katero številne organizacije še niso pripravljene.
Prijavi napako v članku




























