Shop menü

AZ OPENAI SZERINT A GPT-6 ASTRA MODELLJE MÁR EGY ÚJ KORSZAKOT NYIT

A tesztek összességében azt mutatják, hogy a cégnek ezzel sikerült a Claude Fable modelljének nyomába érnie, de ennek meg is van az ára.
Szécsi Dániel (DemonDani)
Szécsi Dániel (DemonDani)
Az OpenAI szerint a GPT-6 Astra modellje már egy új korszakot nyit

Az OpenAI körül az utóbbi időben felpörögtek az események, ami nem pusztán annak köszönhető, hogy nagyobb fejlesztési ütemre kapcsolt. A vállalat még az idei évben szeretne tőzsdére menni, és nagyjából borítékolható, hogy emiatt is igyekszik folyamatosan fenntartani az emberek érdeklődését. 

A most bejelentett GPT-6 Astra minden eddiginél jobb teljesítményre képes, és a cég nagyjából úgy vezette fel, mint ahogy az Anthropic is tette a Claude Mythos és a Fable modellekkel. Ahogy korábban a Mythos is egy rendkívül veszélyes, nehezen megszelídíthető nyelvi modellnek lett kikiáltva, úgy az Astra kapcsán is ezt kommunikálta az OpenAI. Szerencsére mindkét cégnek sikerült parádésan rövid idő alatt közkézre adni ezeket a “fegyvereket”.

Galéria megnyitása

Az OpenAI egyik szakembere a GPT-6 Astra kapcsán már egyenesen arról beszél, hogy ezzel sikerült az AGI-korszakba lépni. Minden eddiginél összetettebb és nagyobb kihívást jelentő tanítási folyamatok előzték meg az újdonság megjelenését. A cég elsősorban az ügynöki képességekre igyekezett rávilágítani, melyben tisztességes előrelépést mutat a modell, mivel már eleve ilyen igényeket szem előtt tartva fejlesztették – azon túl, hogy az alapjaiban multimodális működésre lett kihegyezve. 

Galéria megnyitása

Képes a GPT-6 online nyomtatványok kitöltésére, rendezni tudja a naptárakat, és online kutatásokat végezhet. Komplex üzenetek megfogalmazásában tud segíteni, amihez dokumentumok összefoglalóit is felhasználhatja. Tudományos anyagok elemzésében is jeleskedni fog, miközben minden eddiginél ügyesebben tud összeállítani diagramokat. Önállóan lehet vele létrehozni weboldalakat, melyeket már ellenőrizni is képes a hibák, sebezhetőségek után kutatva. Megkérhető programok telepítésére és kezelésére is, és összetett hibakeresésre is be lehet fogni. 

Az OpenAI elmondása alapján lehet élesben használni a GPT-6 Astra modellt adatbányászatra, játékok fejlesztése során is magában boldogul, összetett formanyomtatványokkal is boldogul, de ha kell, akkor egy autó váltójának a javításában is tud segíteni, és jogi segítséget is biztosíthat. 

Az OSWorld 2.0 tesztben a GPT-6 modell 72,6 százalékos eredményt tudott felmutatni, míg a GPT-5.6 Sol csak 65,7%-ot ért el korábban. Ami ennél is látványosabb, hogy a feladatokat az új modell 40 perc alatt letudja, míg az elődjének ehhez 75 percre van szüksége. A Codexben az Astra használatával majdnem kétszer gyorsabban lehet majd haladni nagyobb pontosság mellett. 

A Humanity’s Last Exam megmérettetésben a GPT-6 kiegészítők használatával már 57,2%-os sikeraránnyal zárt, de az Anthropic ellen ez még nem elég, a Claude Fable 5.1 ugyanis ebben már 65%-ot ért el. A DeepSWE 1.1 teszt alatt a GPT-6 74,1%-ot teljesít, míg a Google Gemini 3.8 Flash 73,8%-os eredményt tud felmutatni, a Claude Opus 5 pedig 73,7%-kal áll a dobogó harmadik fokán. A Terminal-Bench 4.0-ben viszont már az élre áll a GPT-6, ebben 57,9%-os sikerarányt hoz össze, míg a Claude Fable 5.1 neve mellett “csak” 55,8% szerepel.

Az ExploitBench alatt először ér el nyelvi modellként 100%-ot az OpenAI, ebben a Claude Opus 5 csak 70%-ot teljesít, és az Exploit Gymben is remekel, 42,4% szerepel a neve mellett, miközben a Claude Fable 5.1 30,4%-os eredményt hozott össze. A kiberbiztonsági kihívásokban nagyon jó az Astra modell, ezt ugyebár a fejlesztés korábbi szakaszaiban is igyekezett az OpenAI kiemelni, mikor még nem lehetett tudni, hogy ez lesz a GPT-6.

Galéria megnyitása

A GPT-6 Astra kiváló eszköz lett, de abból a szempontból nem történt csoda, hogy a fenntartási költsége is brutálisan magas. Messze ez a legdrágább modellje az OpenAI-nak. 1 millió token feldolgozása nem kevesebb mint 10 dollárba kerül, generálni pedig már 50 dollárból képes ekkora mennyiségű adatot. Ha pedig valaki kifejezetten hosszú kontextussal vagy kiemelt sebességgel akar dolgozni az API-n keresztül, akkor ez a költség a többszörösére is emelkedhet. Viszonyításképpen a GPT-5.6 Sol házon belül 4 és 20 dolláros árszabással futott 1 millió token esetén. 

Első körben szervezeti szinten lehet elérni a GPT-6 Astrát, de hamarosan hozzáférhető lesz minden előfizető számára is. Megkapják a ChatGPT Plus, Pro, Business és Enterprise tagsággal rendelkezők egyaránt, persze más-más használati keretekkel kell számolni a különböző csomagok esetén.

Hírlevél feliratkozás
A feliratkozással elfogadom a Felhasználási feltételeket és az Adatvédelmi nyilatkozatot.

Neked ajánljuk

    Tesztek

      Kapcsolódó cikkek

      Vissza az oldal tetejére