Shop menü

ÚJABB NAGYON ERŐS KÍNAI NYELVI MODELL JÖTT, EZÚTTAL AZ ALIBABÁTÓL

A fejlesztők kiemelték, hogy 2,4 billió paraméteres modell lett az új Qwen, és helyzettől függően megizzaszthatja a nyugati csúcsmodelleket is.
Szécsi Dániel (DemonDani)
Szécsi Dániel (DemonDani)
Újabb nagyon erős kínai nyelvi modell jött, ezúttal az Alibabától

Az Alibaba a technológiai szektor egyik jelentős szereplője lett, nemcsak Kínában, hanem globálisan is, és a mesterséges intelligencia révén még magasabbra törne. Az idei évben valósággal záporoztak a jó potenciállal szolgáló kínai nyelvi modellek, egyre több amerikai cég választja ezeket, és a nagy frissítésen átesett Qwen is ígéretes.

Júliusban már adott egy ízelítőt az Alibaba a Qwen3.8-Maxból, de csak most jelent meg ez a fejlesztés. A cég új zászlóshajója a MoE (Mixture-of-Experts) irányvonalat erősíti, mint a legtöbb kínai fejlesztés, és egyébként 2,4 billió paraméterrel dolgozhat. A fejlesztők beszámolója szerint az újdonság elsősorban a programozók és az összetett, kifejezetten hosszú vállalati feladatok végrehajtásában fog jeleskedni. Az első tesztek alapján vannak olyan területek, melyekben az élen jár, de nagy általánosságban azért még nem egy “trónfoglaló” megoldásról van szó.

Az OSWorld-Verified megmérettetésben már egyedülálló módon 86,1%-ot ért el a Qwen3.8-Max, míg a Claude Fable 5, ami a Mythos alapjára épül, “csak” 85 százalékos eredménnyel büszkélkedhet, a GPT-5.6 Sol pedig 83,2%-ot tudott összehozni. Ez a teszt a számítógépes ügynöki feladatok végrehajtását veszi górcső alá.

A TerminalBench 2.1 keretei között 86,6 százalékot teljesített, amivel már “csak” a második a GPT-5.6 Sol (88,8%) mellett, viszont a Fable 5-öt így is megelőzi 2 százalékkal. A népszerű SWE-Bench Pro tesztben 67,7 százalékos eredményt produkált, így ebben visszaelőzte a legjobb publikus GPT modellt, viszont ebben meg a Fable 5 a jobb 80%-os teljesítménnyel.

Galéria megnyitása

Az Alibaba nem arra fókuszált, hogy jó beszélgetőpartnert hozzon létre, így csevegésben nem lesz kiemelkedő a Qwen3.8-Max. Ez sokkal inkább egy önálló munkatárs, ami képes olyan projekteket is végrehajtani, melyek hossza nem percekben, de még csak nem is órákban, hanem már inkább napokban mérhetők. Képes önállóan programozni több mint 10 napon keresztül, sok ezer sornyi kóddal dolgozhat, chiptervezési és dizájnoptimalizálási feladatokat láthat el, valamint multimodális visszacsatolási ciklusok segítségével folyamatosan felülvizsgálhatja a munkafolyamatokat.

Egymillió tokenes kontextusablakkal dolgozik a Qwen3.8-Max, ez mostanában már szinte alapértelmezett lett. Egy “nyílt” modellről beszélhetünk, ahogy az a kínaiaknál a legtöbb esetben alakulni szokott. A súlyokat jövő héten fogja publikálni az Alibaba, és azzal együtt bevezeti majd a Qwen3.8-27B variánst is, ami egy kisebb, hatékonyabb, olcsóbb megoldás lesz a Maxnál, de készülhet még ennél lényegesen kisebb modell is, nem egy “mini” variánst kell itt elképzelni.

Galéria megnyitása

Hazai pályán a Kimi-K3 modell lesz a legerősebb ellenfele a Qwen3.8-Maxnak. Ez is az elmúlt hetekben jött, és nagyon hasonló területek számítanak az erősségének, mint ahol az Alibaba fejlesztése is jeleskedik. A Kimi-K3 több trükköt is bevezetett a hatékonyság fokozására, és az már egy 2,8 billió paraméteres MoE nyelvi modell lett.

A Qwen3.8-Max pontosan olyan árazással fut, mint a Xiaomi által készített MiMo-V2.5 Pro modell, miközben azt rendszerint képes felülmúlni. Külön érdekes az árazásában, hogy még olcsóbb lett, mint a Qwen3.7-Max volt, és a Kimi-K3-tól is lényegesen kedvezőbb áron fut. Ez az egyik legjobb árazással alkalmazható zászlóshajó nyelvi modell. 2 dollárba kerül 1 millió token a bemeneti oldalon, a kimeneti oldalon pedig 6 dollárt kell ezért kifizetni.

Hírlevél feliratkozás
A feliratkozással elfogadom a Felhasználási feltételeket és az Adatvédelmi nyilatkozatot.

Neked ajánljuk

    Tesztek

      Kapcsolódó cikkek

      Vissza az oldal tetejére