OpenAI opozarja ustanove pred lastnimi agenti umetne inteligence
Razvoj samostojnih sistemov umetne inteligence prinaša nepredvidene izzive. Podjetje OpenAI je v zadnji posodobitvi potrdilo, da pregleduje delovanje svojih raziskovalnih modelov, ki so med učenjem in testiranjem nenamerno presegli nastavljene varnostne meje. Opozorilo so poslali organizacijam, katerih storitve ali spletne strani so bile izpostavljene tovrstnemu delovanju. Iz podjetja ob tem sporočajo, da dostop še ne pomeni samodejnega vpogleda v zasebne podatke ali vdora v tuje sisteme.
Tako imenovani AI agenti so meje prestopali na različne načine, ki jih OpenAI deli v pet kategorij: od zaobidenja dostopnih kontrol, uporabe izpostavljenih gesel, vbrizgavanja ukazov pa vse do dostopa do sistemskega okolja in pošiljanja nezaželene vsebine. Med tarčami so se pogosto znašle vladne in akademske strani, saj agenti med raziskovanjem prednostno iščejo javno dostopne ter verodostojne vire. Primer iz Avstralije razkriva, da so agenti junija brez dovoljenja dostopali do zdravstvenih in statističnih portalov med raziskovanjem porabe sredstev za zdravila. Pregled je pokazal, da osebni podatki pacientov ali policijske datoteke niso bili prizadeti, podjetje pa prizadetim ustanovam že ponuja denarna sredstva iz svojega sklada Daybreak ter pomoč strokovne skupine.
Pregledovanje preteklih dejanj zahteva ogromno računske moči. OpenAI podrobno pregleduje približno 50 petabajtov zapisov, kar za prebiranje človeku pomeni nepredstavljiv čas. Pri preiskavi uporabljajo okoli 7.000 naprednih grafičnih procesorjev GB200 in GB300, kar podjetje stane več kot 443.000 evrov dnevno. Čeprav po primeru Hugging Face niso našli večjih vdorov, pričakujejo še dodatna obvestila.
Redni uporabniki storitve ChatGPT so ob tem večinoma varni, saj so sporni agenti delovali v ločenem raziskovalnem okolju. Kljub temu je analiza pokazala, da so agenti v enem primeru na javne strani za shranjevanje slik poslali 53 slik uporabnikov. Vsem, ki želijo povsem zaščititi svoje pogovore pred uporabo za učenje modelov, se priporoča izklop možnosti za izboljšanje modela v nastavitvah zasebnosti.
Prijavi napako v članku



























