Google predstavlja Gemini 3.7 Flash za kodiranje in agentne naloge
Google ga opisuje kot svoj doslej najzmogljivejši “delovni” model za kodiranje in agente. Pri tem je pomembno, da je bil Gemini 3.7 Flash predstavljen le tri tedne po različici 3.6 Flash. Tako hiter razvoj kaže, da se tekma med ponudniki umetne inteligence vse bolj premika od velikih generacijskih preskokov k pogostim izboljšavam, ki so namenjene konkretnim poslovnim nalogam.
Več kot le hitrejši klepetalnik
Flash je v Googlovi ponudbi praviloma namenjen modelom, ki morajo zagotavljati krajši odzivni čas in nižje stroške. Gemini 3.7 Flash naj bi to prednost ohranil, hkrati pa naj bi bil bolj zanesljiv pri daljših in bolj zapletenih potekih dela.
Model naj bi bolje razumel navodila, se učinkoviteje odzival na zaplete ter po potrebi zahteval dodatna pojasnila. Google posebej izpostavlja izboljšave pri večstopenjskem načrtovanju in uporabi zunanjih orodij. To je pomembno za agentne sisteme, saj ti ne pripravijo le odgovora, ampak lahko na primer pregledajo dokumente, napišejo elektronsko sporočilo, posodobijo preglednico in pripravijo poročilo.
Takšen način uporabe umetne inteligence je zahtevnejši od klasičnega klepeta. Sistem mora ohraniti kontekst, izbrati pravilno orodje, preveriti vmesne rezultate in se po napaki vrniti na ustrezno točko. Vsaka dodatna napaka lahko pri avtomatiziranem procesu povzroči več težav, zato je natančno sledenje navodilom pomembnejše od same hitrosti odgovora.
Izboljšave pri programiranju
Google navaja, da je Gemini 3.7 Flash uspešnejši pri odpravljanju napak, reševanju težav v programski opremi in izdelavi kode pripravljene za uporabo v produkciji.
Na internem preizkusu FrontierCode 1.1 Main je model dosegel 43,6 odstotka, medtem ko je Gemini 3.6 Flash dosegel 34,4 odstotka. Pri preizkusu DeepSWE v1.1, ki meri sposobnost reševanja zahtevnejših programerskih nalog, je novejši model dosegel 65,3 odstotka v primerjavi z 49 odstotki pri predhodniku.
Google pravi, da Gemini 3.7 Flash pri spletnem razvoju izdela bolj funkcionalne postavitve in celovitejše aplikacije z manj pozivi. Pri izdelavi uporabniških vmesnikov lahko kot izhodišče uporabi posnetek zaslona, sliko ali celoten oblikovalski sistem ter se jim natančneje prilagodi.
To ne pomeni, da lahko razvijalci modelu preprosto prepustijo izdelavo aplikacije brez nadzora. Koda lahko vsebuje varnostne pomanjkljivosti, napačne predpostavke ali težave pri vzdrževanju. Prednost novega modela je predvsem v tem, da lahko hitreje pripravi uporabno začetno različico in zmanjša količino ročnega dela pri ponavljajočih se nalogah.
Bolj uporaben pri dokumentih in poslovnih procesih
Gemini 3.7 Flash ni omejen na programsko opremo. Google ga je preizkusil tudi pri finančnih, pravnih in biomedicinskih dokumentih.
Na preizkusu GDP.pdf, ki meri razumevanje zapletenih dokumentov, je dosegel 34 odstotkov v primerjavi z 22 odstotki pri prejšnjem modelu. Pri preizkusu AutomationBench, namenjenem merjenju uspešnosti pri resničnih poslovnih potekih dela, je dosegel 30,4 odstotka, Gemini 3.6 Flash pa 17 odstotkov.
Google je kot primere uporabe pokazal pretvorbo letnih poročil v interaktivne podatkovne zgodbe z grafikoni, izdelavo spletnih strani ter ustvarjanje preprostih 3D-iger. Takšne predstavitve so zanimive, vendar same po sebi še ne dokazujejo, kako dobro bo model deloval v neurejenih poslovnih okoljih z občutljivimi podatki in zapletenimi pravili dostopa.
Nižja cena za širšo uporabo
Gemini 3.7 Flash bo do konca leta na voljo po začetni ceni 0,75 dolarja oziroma približno 0,64 evra za milijon vhodnih žetonov ter 3,75 dolarja oziroma okoli 3,23 evra za milijon izhodnih žetonov. Od 1. januarja 2027 naj bi se cena podvojila na 1,50 dolarja oziroma približno 1,29 evra za vhodne in 7,50 dolarja oziroma okoli 6,45 evra za izhodne žetone.
Cena je pomembna, ker morajo agentni sistemi pogosto izvesti več klicev modela in uporabljati več orodij. Če vsak korak ustvari dodatne stroške, lahko avtomatizacija hitro postane predraga. Google želi z nižjo uvodno ceno spodbuditi razvijalce in podjetja, da model vključijo neposredno v produkcijske sisteme, ne le v poskusne projekte.
Model bo na voljo prek Gemini API, Google AI Studio, Android Studia, platforme Vertex oziroma Gemini Enterprise Agent Platform ter razvojnega okolja Google Antigravity. V aplikaciji Gemini ga bo uporabljal tudi osebni agent Gemini Spark, ki je na voljo naročnikom Google AI Pro in Ultra v več kot 160 državah.
Google ob predstavitvi poudarja tudi posodobljene zaščite pred zlorabami na področjih kibernetskih napadov ter kemičnih, bioloških, radioloških in jedrskih tveganj. To je pomemben dodatek, saj večja sposobnost izvajanja nalog pomeni tudi večjo potrebo po nadzoru. Gemini 3.7 Flash tako ni le nova različica modela, temveč del širšega premika k umetni inteligenci, ki naj bi namesto odgovarjanja na vprašanja vse pogosteje opravljala konkretno delo.
Prijavi napako v članku




























