A kínai nyelvi modellek népszerűségének emelkedése a jelek szerint teljesen átalakítja a fejlesztési irányzatokat. Az elmúlt hetekben már rendre azt lehet látni a legtöbb újdonságnál, hogy a hatékonyságot igyekeznek növelni, miközben persze a teljesítmény javítása is fontos maradt. Most egyszerre futott be több hatékony Gemini variáns is.
Gemini 3.6 Flash
A Google frissítette a Geminit, megérkezett a 3.5 után a 3.6-os kiadás, és ahogy az elődjéből, úgy ebből is a Flash variáns állt először munkába. A fejlesztés során a programozási képességek erősítése, a tudásalapú munka javítása és a multimodális működés került a fókuszba. Ezek mellett pedig még az teszi érdekessé, hogy sokat csökkent a fogyasztása, kevesebb tokent emészt fel a munkája során.
Az Artificial Analysis Index szerint 17 százalékkal kevesebb tokent használ fel, mint a Gemini 3.5 Flash korábban. De ennél akár lényegesen drámaibb is lehet a különbség feladattól, kihívástól függően. Így például a DeepSWE alatt már 65%-kal kevesebb tokennel üzemelt.
A különböző fejlesztések révén az új Gemini 3.6 Flash modell kevesebb érvelési lépést és eszközhívást igényel a több lépésből álló munkafolyamatok esetében is. A hatékonyság javítása révén még az árazáson is tudott faragni a Google. A Gemini 3.6 Flash a bemeneti oldalon ugyanúgy 1,5 dollárból oldja meg 1 millió token feldolgozását, de a kimeneti oldalon a korábbi 9 dollárt sikerült a cégnek 7,5 dollárra levinnie. Hasonló árazás mellett lehet dolgozni az ugyancsak új GPT-5.6 Luna és a Grok 4.5 modellekkel is, és a teljesítmény is hasonlóan alakul.
Az MLE-Bench keretében a Gemini 3.6 Flash 63,9 százalékot ért el, míg a GPT-5.6 Luna csak 47,6%-os, a Grok 4.5 pedig már csak 43,2%-ot hozott össze. Ellenben az SWE-Bench Pro alatt csupán 58,7%-os sikeraránnyal büszkélkedhet, melyhez képest a GPT-5.6 Luna (62,7%) és a Grok 4.5 (64,7%) is komolyabb teljesítményt tud felmutatni. A számítógép kezelését mérő OSWorld tesztet pedig már újra az élen zárta 83 százalékkal, miközben a GPT-5.6 Luna csak 72,6%-os sikerarányt hozott össze.
A programozási feladatokban nagyobb pontosságot biztosít majd a Gemini 3.6 Flash, miközben kevesebb felesleges kódszerkesztéssel és visszafogottabb végrehajtási ciklussal fog szolgálni. Kitért még a Google arra is, hogy a biztonságra nagy hangsúlyt helyeztek. Kémiai, biológiai, nukleáris és kiberbűnözéssel kapcsolatos visszaélésekre egyaránt van itt védvonal.
Gemini 3.5 Flash-Lite és Flash Cyber
Elindítja a Google a Gemini 3.5 Flash tovább egyszerűsített variánsát is, ami a Lite jelzőt viseli, és minimális késleltetéssel képes még egészen magas minőségű válaszokat adni. Jól használható lesz ez fordítási műveletekre, dokumentum feldolgozásra, ágens munkákra egyaránt.
A Gemini 3.5 Flash-Lite az SWE-Bench Pro megmérettetésben még mindig 54,2%-os teljesítményre képes, amivel megveri a nem is olyan nagyon régi Gemini 3 Flash (42,6%) modellt, miközben az lényegesen drágább. Az OSWorld-Verified esetében 74%-os sikeraránnyal zárt, amivel még mindig a GPT-5.6 Luna (72,6%) előtt van.
Ezzel a modellel 1 millió tokennyi információ feldolgozása már csak 0,3 dolláros költséget jelent, ugyanennyi adat létrehozása azonban már 2,5 dollár. Viszont lényegesen jobb hatékonyság fogja jellemezni, így összességében több pénzt lehet spórolni a használata során. Ráadásul nagyon gördülékeny lehet vele a munka, hiszen az Artificial Analysis Index szerint 350 tokent képes előállítani egyetlen másodperc alatt.
A Gemini 3.5 Flash Cyber
A Google bemutatta a Gemini 3.5 Flash Cyber modellt is, amely a kiberbiztonságra összpontosít, és integráltan használható a CodeMender programozó biztonsági ágenssel. Ez az eszköz már úgy lett finomhangolva, hogy felismerje, ellenőrizze és kijavítsa a szoftveres sebezhetőségeket.
A CodeMender rendszeren belül több Gemini 3.5 Flash Cyber ágens üzemelhet párhuzamosan egy összevont biztonsági jelentés elkészítéséhez; a Google szerint a modell a CyberGym teszten élvonalbeli teljesítményt nyújt. 83,2%-os sikerarányt tud felmutatni, miközben a sokkal nagyobb GPT-5.6 Sol és a Mythos 5 csak egy hajszállal szerepel jobban, kevesebb mint 1% az előnyük. Mindössze a GPT-5.5-Cyber van érdemi előnyben, az 85,6%-os eredményt hozott össze.
No, de hol a Gemini 3.5 Pro? A Google jóval korábbra ígérte, hogy a Gemini 3.5 családból szállítani fogja a Pro modellt, de még mindig nem elérhető. A cég azt állítja, hogy folyamatban van a tesztelése a partnerekkel, nem feledkezett meg erről, csak elsodorták a fejlesztést a legfrissebb trendek. Végül még azt is megtudtunk, hogy a cég dolgozik a Gemini 4 modellcsaládon. Folyamatban van az előzetes tréningezése, vélhetően még idén debütálni fog.