„Google Gemini 3.8 Flash“ dirbtinio intelekto modelio iliustracija
„Google“ pristatė „Gemini 3.8 Flash“: kai kur lenkia GPT-5.6 ir „Claude Opus 5“
„Google“ pristatė naują „Gemini 3.8 Flash“ dirbtinio intelekto modelį, skirtą ilgoms programavimo užduotims, autonominiams DI agentams ir sudėtingiems verslo procesams. Nors tai nėra modelis, kuris visuose testuose aplenkia brangiausius konkurentus, dalyje oficialiai pateiktų rezultatų jis pranoksta tiek „GPT-5.6 Sol“, tiek „Claude Opus 5“ – ir tuo pat metu kainuoja gerokai mažiau.
Naujiena pasirodė praėjus vos maždaug trims savaitėms po „Gemini 3.7 Flash“ pristatymo. Tai dar kartą parodo, kokiu tempu „Google“ šiuo metu atnaujina savo „Flash“ modelių liniją. Bendrovė naująjį modelį apibūdina kaip išmaniausią iki šiol „Flash“ šeimos modelį, sukurtą ilgoms programinės įrangos kūrimo užduotims, autonominiams agentams ir sudėtingiems įmonių darbo srautams.
Oficialioje „Google“ kūrėjų dokumentacijoje nurodoma, kad „Gemini 3.8 Flash“ palaiko tekstą, vaizdus, vaizdo įrašus, garsą ir PDF failus, turi daugiau nei 1 mln. žetonų įvesties konteksto langą ir iki 65 536 žetonų išvestį. Modelis taip pat palaiko kodo vykdymą, funkcijų iškvietimą, paieškos pagrindimą, struktūrizuotą išvestį ir kompiuterio valdymą peržiūros režimu.
Kai kuriuose testuose lenkia daug brangesnius modelius
Didžiausią dėmesį patraukė „Google“ paskelbta palyginimo lentelė. Joje „Gemini 3.8 Flash“ lyginamas su „Gemini 3.7 Flash“, „Claude Opus 5“, „Claude Sonnet 5“, „GPT-5.6 Sol“ ir „GPT-5.6 Terra“.

Pavyzdžiui, „Vals Finance Agent v2“ finansinių analitikų užduočių teste „Gemini 3.8 Flash“ surinko 61,4 proc., kai „Claude Opus 5“ pasiekė 58,6 proc., o „GPT-5.6 Sol“ – 53,8 proc. Sudėtingų teisinių darbo srautų „Harvey’s Legal Agent Benchmark“ teste naujasis „Gemini“ modelis surinko 10 proc. – daugiau nei visi lentelėje pateikti konkurentai.
„Terminal-bench 2.1“ agentinio programavimo teste rezultatas siekė 89,4 proc., vos lenkiant „Claude Opus 5“ su 89,1 proc. Tuo tarpu informacijos iš sudėtingų grafikų sintezės „CharXiv Reasoning“ teste „Gemini 3.8 Flash“ surinko 86,2 proc., o „GPT-5.6 Sol“ – 85,8 proc.
Stiprus rezultatas matomas ir ilgo vaizdo supratimo teste „LVBench“: agentiniame režime modelis pasiekė 87,8 proc., statiniame – 87,1 proc. Tarpdisciplininiame „HLE-Verified“ teste rezultatas siekė 54,9 proc., o biologijos realaus pasaulio tyrimų užduočių „LABBench2“ – 86,2 proc.
Vis dėlto svarbu pabrėžti, kad tai nėra absoliutus „Gemini“ dominavimas. Ilgų programinės įrangos kūrimo užduočių „DeepSWE v1.1“ teste „Claude Opus 5“ pasiekė 74 proc., o „Gemini 3.8 Flash“ – 73,7 proc. „GDPval-AA v2“ žinių darbo teste pirmavo „Claude Opus 5“, o „Terminal-bench 4.0“ teste jo persvara taip pat buvo ryški. Kitaip tariant, rezultatai rodo labai konkurencingą, bet ne universaliai geriausią modelį.
Tokį palyginimą verta vertinti atsargiai ir dėl dar vienos priežasties: atskiri testai matuoja labai skirtingas užduotis, o nedidelis procentinis skirtumas nebūtinai reiškia tokį pat juntamą skirtumą kasdienėje praktikoje.
Svarbiausias koziris – kaina
Ne mažiau svarbi naujiena yra kaina. Iki 2026 m. gruodžio 31 d. „Google“ taiko įvadinį tarifą: 0,75 JAV dolerio už 1 mln. įvesties žetonų ir 3,75 JAV dolerio už 1 mln. išvesties žetonų. Nuo 2027 m. sausio 1 d. numatyta reguliari 1,50 ir 7,50 JAV dolerio kaina.
Palyginimui, pačios „Google“ pateiktoje lentelėje „Claude Opus 5“ kainuoja 5 JAV dolerius už 1 mln. įvesties žetonų ir 25 JAV dolerius už 1 mln. išvesties, o „GPT-5.6 Sol“ – atitinkamai 4 ir 20 JAV dolerių. Todėl net tais atvejais, kai naujasis „Gemini“ nėra pirmas pagal rezultatą, jo kainos ir pajėgumo santykis gali būti svarbiausias argumentas programuotojams ir įmonėms, kurios DI naudoja dideliu mastu.
„Google Cloud“ dokumentacijoje nurodoma, kad „Gemini 3.8 Flash“ jau pasiekė bendrojo prieinamumo stadiją ir oficialiai išleistas 2026 m. rugsėjo 2 d. Modelis prieinamas per „Gemini API“ ir „Google“ DI kūrėjų įrankius. Bendrovės vadovas Sundaras Pichai taip pat viešai paskelbė apie naują modelį socialiniame tinkle X.
„Gemini“ plėtra vyksta tuo metu, kai „Google“ DI ekosistema sparčiai auga. Kaip jau rašė „TechNaujienos.lt“, „Gemini“ paslaugomis jau naudojasi apie 1 mlrd. žmonių. Tuo pačiu konkurencija su „OpenAI“ ir „Anthropic“ persikelia ne tik į modelių „intelekto“ lenktynes, bet ir į kainą, greitį bei gebėjimą autonomiškai atlikti ilgas darbo užduotis.
Jei toks atnaujinimų tempas išliks, „Flash“ modelių segmentas gali tapti viena svarbiausių DI rinkos kovos vietų: čia lemiamas bus ne vien maksimalus testų rezultatas, bet ir tai, kiek realios naudos modelis gali suteikti už kiekvieną išleistą eurą ar dolerį.
Kaip vertinate šį straipsnį?
Prenumeruokite mūsų „YouTube“ kanalą ir mėgaukitės įdomiais vaizdo reportažais apie mokslą ir technologijas.
Trumpai, aiškiai ir be triukšmo – gaukite svarbiausias technologijų ir mokslo naujienas pirmieji.
DIENOS SKAITOMIAUSI
Paaiškėjo, ko slaptam vizitui į Maskva vyko CŽV vadovas – minima ir Lietuva
2Baigiasi vairuotojo pažymėjimo galiojimas: kaip pasikeisti ir ar būtina vykti į „Regitrą“?
3Po audros generatorių pardavimai Lietuvoje šoktelėjo 150 kartų: ar 400 eurų įrenginio pakanka namams?
4Ar galima paskambinti 112, jei nėra mobilaus ryšio?
5Šie išmanieji laikrodžiai per pusmetį praranda iki 60 proc. vertės: kurie nuvertėja greičiausiai?
NAUJAUSI
Taip pat skaitykite
Atrinkome panašius straipsnius, kurie gali jums patikti.