Az OpenAI kiadta a GPT-6 Astrát, és megnyitottnak tekinti az AGI-korszakot

Hírek2026.09.04.5 megtekintés

Röviden:

  • OpenAI bemutatta a GPT-6 Astrát, amelyet a vállalat eddigi legerősebb modelljeként pozicionál.[^1]
  • A modell kezdetben korlátozott körben, majd a ChatGPT fizetős csomagjaiban, API-n és felhőplatformokon válhat elérhetővé.[^1]
  • Greg Brockman szerint nincs élesen meghatározható AGI-pillanat, de a vállalat már „AGI-korszakról” beszél.[^1]
  • Az Astra kiberbiztonsági képességei miatt az OpenAI „kritikus” besorolást alkalmaz, ezért a legfejlettebb funkciókat kezdetben korlátozza.[^1]

Bevezető: GPT-6 Astra az OpenAI új csúcsmodellje

OpenAI közzétette a GPT-6 Astra nevű új MI-modellt. A vállalat állítása szerint az Astra több területen is jelentős előrelépést hoz az előző generációhoz, a GPT-5.6 Solhoz képest: a logikai következtetéstől és matematikától kezdve a programozáson át a számítógépes feladatok automatizálásáig.[^1]

A bevezetéshez az OpenAI az általános mesterséges intelligencia, vagyis az AGI fogalmáról szóló új kommunikációt is társította. Greg Brockman, a vállalat elnöke a sajtótájékoztató végén úgy fogalmazott: „Üdvözöljük az AGI-korszakban.”[^1]

A GPT-6 Astra fokozatosan válhat elérhetővé

A modell elsőként az OpenAI Daybreak programjában részt vevő, kiválasztott szervezetekhez kerülhet. A vállalat tervei szerint ezt követően a ChatGPT Plus-, Pro-, Business- és Enterprise-előfizetők, valamint az API-t használó fejlesztők és egyes felhőplatformok, köztük az AWS Bedrock és a Microsoft Azure ügyfelei is hozzáférhetnek.[^1]

A Pro-, Business- és Enterprise-csomagokhoz az Astra Pro változat is társulhat. Az Enterprise-ügyfeleknél a modell nem aktiválódik automatikusan: a munkahelyi környezet rendszergazdájának kell engedélyeznie azt.[^1]

Több mint 100 ezer GPU-val tanították

Aidan Clark, az OpenAI kutatója szerint az Astra előtanítása több mint 100 ezer GPU felhasználásával zajlott a texasi Stargate helyszínen. A vállalat ezt az eddigi legnagyobb saját tanítási futtatásaként írta le, és azt is közölte, hogy korábbi MI-modellek érdemi szerepet kaptak a tréning felügyeletében.[^1]

Benchmarkok: erős eredmények programozásban és következtetésben

Az OpenAI által közzétett mérések szerint a GPT-6 Astra 99,9 százalékot ért el az ARC-AGI-3 teszten, 97,6 százalékot a FrontierMath Tier 4 v2 feladatsoron, 74,1 százalékot a DeepSWE v1.1 programozási értékelésen, valamint 95,9 százalékot a BenchCAD mérésen.[^1]

Ezek az eredmények a vállalat saját publikációjából származnak, ezért az összehasonlítások értelmezésénél fontos figyelembe venni a tesztelési beállításokat, a felhasznált eszközöket és az egyes benchmarkok eltérő módszertanát.[^1]

Számítógép-kezelés és hosszú kontextus

Az OpenAI az Astrát olyan modellként mutatja be, amely összetettebb számítógépes műveleteket is képes végrehajtani. Az OSWorld 2.0 értékelésen a vállalat szerint 72,6 százalékos eredményt ért el, miközben egy feladat átlagosan körülbelül 40 percet vett igénybe.[^1]

„Mindent, amit számítógépen meg tudsz csinálni, az Astra is meg tud tenni helyetted. És gyorsan.”[^1]

A hosszú kontextus kezelésében is javulást közöltek: az MRCR v2 teszt 512 ezer és 1 millió token közötti változatán az Astra 96,3 százalékot ért el, míg a Sol eredménye 73,8 százalék volt.[^1]

Árazás: magasabb tokenár, alacsonyabb feladatonkénti költség ígérete

A standard API-árazás szerint a GPT-6 Astra egymillió bemeneti tokenje 10 dollárba, egymillió kimeneti tokenje pedig 50 dollárba kerül. A gyorsabb, Fast üzemmód ára ennek a kétszerese lehet. A vállalat szerint ez tokenalapon körülbelül 2,5-szer magasabb költséget jelent a GPT-5.6 Solhoz képest.[^1]

Greg Brockman ugyanakkor azzal érvelt, hogy a tokenenkénti ár önmagában egyre kevésbé alkalmas az összehasonlításra. Az OpenAI szerint célszerűbb az elvégzett feladatra jutó költséget vizsgálni; a vállalat saját becslése alapján az Astra legerősebb konfigurációja a DeepSWE v1.1 teszten mintegy 57 százalékkal alacsonyabb becsült API-költséget produkált feladatonként, mint a Sol.[^1]

Az AGI-korszak és a biztonsági kockázatok

Greg Brockman elismerte, hogy nincs egyetlen, mindenki számára felismerhető pillanat, amikor egy rendszer egyértelműen AGI-vá válik. Az OpenAI meghatározása szerint az AGI olyan rendszer, amely a legtöbb gazdaságilag értékes munkában felülmúlja az embert.[^1]

Az Astra egyúttal az első modell, amelyet az OpenAI a saját Preparedness Framework keretrendszerében „kritikus” szintre sorolt. A vállalat szerint megfelelő eszközökkel és hozzáférésekkel a modell korábban ismeretlen sérülékenységeket találhat, illetve védett rendszereken átívelő támadási láncokat fejleszthet ki.[^1]

Korlátozott hozzáférés a fejlett kiberbiztonsági képességekhez

Az OpenAI közlése szerint az ExploitBench teszten az Astra 100 százalékos eredményt ért el, és az értékelés során két, korábban ismeretlen sérülékenységet is azonosított. A vállalat állítása szerint ezeket később jelentette az érintett üzemeltetőknek.[^1]

A legfejlettebb kiberbiztonsági funkciók kezdetben kizárólag megbízható védelmi szereplők számára érhetők el a Daybreak-Blue programon keresztül. Az OpenAI korábbi biztonsági tesztek miatt késleltette a modell kiadását, mivel az ilyen képességek védelmi és támadó célokra egyaránt felhasználhatók.[^1]

Összefoglaló: a teljesítmény mellett a kontroll is központi kérdés

A GPT-6 Astra bemutatásával az OpenAI egyszerre hangsúlyozza az MI-rendszerek növekvő képességeit és az ezekből fakadó biztonsági kockázatokat. A vállalat által közölt eredmények alapján a modell különösen a programozási, tudományos, számítógép-kezelési és kiberbiztonsági feladatokban lehet erős.[^1]

Az AGI-korszakról szóló nyilatkozat inkább stratégiai és fogalmi állásfoglalás, mint egy mindenki által elfogadott technológiai határ átlépésének igazolása. A szélesebb körű hozzáférés, a független értékelések és a biztonsági korlátozások gyakorlati működése határozhatja meg, hogyan ítélik meg az Astra szerepét a következő időszakban.[^1]

Forrás:

[^1]: THE DECODER (2026. 09. 03.). „OpenAI veröffentlicht GPT-6 Astra und erklärt die AGI-Ära für eröffnet”. THE DECODER. Közzétéve [2026. 09. 03. 19:06:40 +0000].

Follow
Keresés Népszerű
Loading

Signing-in 3 seconds...

Signing-up 3 seconds...