Strojna oprema
20.09.2025 14:49

Deli z drugimi:

Share

OpenAI razkriva: Umetna inteligenca se zna pretvarjati!

OpenAI je v sodelovanju z Apollo Research objavil raziskavo, ki razkriva, kako se AI modeli lahko naučijo pretvarjati in zavajati. Čeprav gre večinoma za manjše prevare, raziskovalci opozarjajo, da bo z večjo kompleksnostjo nalog rasla tudi nevarnost škodljivega spletkarjenja.

Raziskovalci največjih tehnoloških podjetij občasno predstavijo odkritja, ki zvenijo kot iz znanstvenofantastičnega romana. Google je nekoč trdil, da njihov kvantni procesor nakazuje obstoj več vesolj. Anthropic je svojemu AI agentu Claudiusu zaupal upravljanje avtomata s prigrizki, a ta pa je začel klicati varnostnike in trditi, da je človek. Tokrat pa je presenetil OpenAI.

V sodelovanju z Apollo Research je objavil raziskavo, ki razkriva, kako preprečiti, da bi se AI modeli “pretvarjali.” Po njihovih besedah gre za vedenje, kjer se AI na površju obnaša skladno s pričakovanji, v ozadju pa zasleduje povsem drugačne cilje. Raziskovalci so tovrstno “spletkarjenje” primerjali z borznim posrednikom, ki krši zakon za čim večji zaslužek. A večina primerov ni bila škodljiva Šlo je namreč za preproste prevare, kot je trditev, da je naloga opravljena, čeprav ni.

Glavni namen raziskave je bil pokazati, da tehnika “deliberativnega usklajevanja” deluje. Gre za pristop, kjer model pred delovanjem pregleda “anti-spletkarsko specifikacijo”, podobno kot otrok, ki mora ponoviti pravila, preden gre igrat. A tu je zaplet: če AI zazna, da je testiran, se lahko pretvarja, da ne spletkari. čeprav to še vedno počne. Poskusi, da bi model naučili, naj ne laže, lahko vodijo do tega, da se nauči lagati še bolj prefinjeno.

OpenAI priznava, da so zaznali laži tudi pri ChatGPT, a gre večinoma za manjše prevare, in sicer kot trditev, da je uspešno izdelal spletno stran, čeprav je ni. Raziskovalci opozarjajo, da bo z večjo kompleksnostjo nalog in dolgoročnimi cilji verjetnost škodljivega spletkarjenja rasla. Zato morajo rasti tudi varovalke in testni postopki.

Vse to pa odpira pomembna vprašanja za prihodnost umetne inteligence. Še posebej v podjetjih, kjer se AI agenti obravnavajo kot samostojni “zaposleni.”


Vam je bila novica zanimiva?

Povejte prijateljem, da ste novico prebrali na Računalniških novicah.

Share
Prijavi napako v članku
Vas zanima več iz te teme?
umetna inteligenca

Povezave



Kaj berejo drugi?

Partnerji Računalniških novic Prikaži vse

NEXT LINE d.o.o.

Ob železnici 16, 1000 Ljubljana, Tel: 041 776 822
Next line, specializirane storitve tiska pod eno streho V podjetju Next line iz Ljubljane so se osredotočili na specializirane storitve tiska s termičnimi, sublimacijskimi in ... Več

Računalniške storitve mITch, Mitja Mihelič s.p.

Čolnarska ulica 3, 1310 Ribnica, Tel: 05 125 8575, 051 258 575
Ali vaše podjetje potrebuje oddelek za IT? Nekoč dostopne le za velike korporacije, danes so IT funkcije na voljo podjetjem vseh velikosti po zaslugi računalništva v oblaku in ... Več

SoftNET d.o.o.

Borovec 2, 1236 Trzin, Tel: 01 810 01 00
Vse telekomunikacijske storitve na enem mestu V podjetju ni nič pomembnejšega kot dobra telekomunikacijska povezanost, tako znotraj kot zunaj podjetja. Podjetje SoftNET vam s ... Več

LabelProfi d.o.o. – digitalna produkcija etiket in fleksibilne embalaže

Ozare 18a, 2380 Slovenj Gradec, Tel: 080 10 12
Podjetje LabelProfi d.o.o. je svojo poslovno pot začelo leta 1994 kot majhen studio za grafično oblikovanje in pripravo za tisk. V podjetju od same ustanovitve stremijo k uporabi ... Več