Izobraževanje
28.09.2025 05:43

Deli z drugimi:

Share

Kako blizu je umetna inteligenca človeškim strokovnjakom?

OpenAI je razvil GDPval, testni standard za oceno zmogljivosti AI v primerjavi s človeškimi strokovnjaki v ključnih industrijah. GPT-5-high in Claude Opus sta pokazala visoko stopnjo uspešnosti, kar nakazuje hitro približevanje AI realnim delovnim nalogam.

OpenAI je predstavil nov testni standard z imenom GDPval, ki ocenjuje, kako se njegovi AI modeli primerjajo s človeškimi strokovnjaki v ključnih industrijah. Test je del širše misije podjetja za razvoj umetne splošne inteligence (AGI), ki bi lahko opravljala gospodarsko pomembna dela.

GDPval se osredotoča na devet glavnih sektorjev, ki prispevajo k ameriškemu BDP, vključno z zdravstvo, financami, proizvodnjo in javnim sektorjem. Ocenjuje zmogljivost AI v 44 poklicih tako, da strokovnjaki primerjajo poročila, ki jih je ustvaril AI, s tistimi, ki jih je pripravil človek.

V prvi različici GDPval-v0 je OpenAI ugotovil, da je GPT-5-high, zmogljivejša različica GPT-5, dosegel ali presegel raven strokovnjakov v 40,6 odstotkov nalog. Claude Opus 4.1 podjetja Anthropic je dosegel še višjo oceno, 49 odstotkov, čeprav OpenAI del uspeha pripisuje vizualno privlačnim izhodom.

Čeprav test trenutno ocenjuje le naloge pisanja poročil, OpenAI načrtuje širitev na bolj interaktivne in raznolike delovne tokove. Podjetje vidi GDPval kot obetaven korak k temu, da strokovnjaki prenesejo rutinska opravila na AI in se osredotočijo na naloge z večjo dodano vrednostjo.

GPT-4o je pred 15 meseci dosegel le 13,7 odstotkov, kar kaže na hiter napredek. Ker tradicionalni testi, kot sta AIME in GPQA, dosegajo zasičenost, bi lahko GDPval postal ključno orodje za merjenje zmogljivosti AI v resničnem svetu.


Prijavi napako v članku
Vas zanima več iz te teme?
umetna inteligenca

Povezave



Kaj berejo drugi?

Partnerji Računalniških novic Prikaži vse

NUFIRA d.o.o.

Ob Suhi 4d, 2390 Ravne na Koroškem, Tel: 041 722 132
Vsako hitro rastoče podjetje se spopada z odločitvami glede najboljšega poslovnega sistema za upravljanje svojih poslovnih procesov. Pravilna integracija integriranega programskega ... Več

CICERO, BEGUNJE, d.o.o.

Stegne 21c, 1000 Ljubljana, Tel: 01 507 42 92, 041 662 178
Zlati partner

LENOVO TECHNOLOGY B.V. AMSTERDAM

Pot za Brdom 100 (Tehnološki Park - G), 1000 Ljubljana, Tel: 01 620 71 80
Lenovo stremi k izdelavi vrhunskih računalnikov in internetnih naprav z vgrajenimi najnovejšimi tehnologijami, z edinstvenim dezajnom. Vse to za za brezkompromisno doživetje uporabnikov! Ena ... Več
Diamantni partner

ADM ADRIA d.o.o.

Prvomajska ulica 17, 3000 Celje, Tel: 05 925 19 55
O nas Večina podjetij se ustanavlja zaradi poslovne ideje, prodajnega koncepta ali pa zaradi potrebe po formaliziranju opravljanja poslovnih aktivnosti. Na primeru družbe ADM-Adria, ... Več