Modellbevezetés

Mesterséges intelligenciával generált szöveg

OpenAI bemutatja a GPT‑6 Astrát és teljesítmény‑ és költségoptimalizáló számítási stratégiáját

A központi szereplő az OpenAI, amely bejelentette a GPT‑6 Astra modell megjelenését, és részletezte a kutatás, termék és számítási infrastruktúra összhangját.

OpenAI bemutatja a GPT‑6 Astrát és teljesítmény‑ és költségoptimalizáló számítási stratégiáját

OpenAI bejelentette a GPT‑6 Astra névre keresztelt modellt, amelyet a vállalat a legintelligensebbnek és leginkább „aligned” (értékekhez igazított) modelljének nevez. A cég szerint az új modell különösen előrelépést hoz olyan területeken, mint a számítógép‑használat, böngészés, szoftvermérnökség, kiberbiztonság, tudomány és professzionális feladatok.

Miért fontos ez és hogyan érvényesül a gyakorlatban

OpenAI hangsúlyozza, hogy a kutatási fejlődés közvetlenül jut el a felhasználókhoz mind fogyasztói termékeken, mind vállalati megoldásokon keresztül. A cég globális elérése nagyjából több mint egymilliárd heti aktív felhasználót és 2,5 millió vállalkozást jelent, és minden modellfejlesztés közvetlenül javítja a ChatGPT, ChatGPT Work, Codex és az API‑ra épülő alkalmazások teljesítményét.

A modellfejlesztés és az infrastruktúra fejlesztése kölcsönösen hatnak egymásra: jobb modellek új feladatokat tesznek lehetővé, hatékonyabb számítás pedig megfizethetővé teszi ezek tömeges használatát. A növekvő használatból származó bevétel pedig további kutatást és beruházást finanszíroz.

Felhasználói viselkedés és vállalati hatás

OpenAI saját vizsgálatai szerint az egyéni ChatGPT‑terveket használók napi üzenetforgalma körülbelül 50%-kal magasabb volt hat hónappal a regisztráció után, mint az első hónapban, és az emberek mintegy kétszer annyi különböző feladatot próbáltak ki. A vállalati telepítések jellemzően összetettebb munkafolyamatokra adnak eszköztárat, és a munkakörnyezetben szerzett tapasztalatok visszahathatnak a személyes használatra is.

A cég kutatócsapata arról számolt be, hogy egyre több kódot adnak hozzá gyorsabban és több kísérletet futtatnak, miközben egyre összetettebb feladatokat delegálnak ügynököknek (agents). A kutatásszervezetnél jelenleg 3,1 agent‑munka‑napnyi erőforrást használnak fel minden egyes emberi munkanap helyett, ami azt jelzi, hogy az ügynökök növelik a kutatók kapacitását, bár a stratégiai döntéseket és az eredmények értékelését továbbra is emberek végzik.

Teljes stacket átfogó számítási stratégia

A kiszolgálható igény növekedése kapacitást és jobb költséghatékonyságot követel. OpenAI számítási stratégiája az adatközpontoktól és chipektől a szoftvereken és modelleken át a termékekig terjed: ahol érdemes, saját fejlesztéseket terveznek és üzemeltetnek, máshol partnerekkel dolgoznak együtt, hogy minden munkafolyathoz megtalálják a legjobb egyensúlyt a képesség, sebesség, megbízhatóság, hatékonyság és költség szempontjából.

A tréning és a valós idejű, interaktív ügynökök futtatása eltérő infrastruktúra‑igényeket támaszt. OpenAI azokat a feladatokat belsőleg fejleszti, ahol a komponensek együttes tervezése jelentős előnyt ad, és partneri megoldásokat választ, amikor mások jobb opciót kínálnak.

Konkrét hatékonysági eredmények

OpenAI részletezte a közelmúlt eredményeit is:

  • GPT‑5.6 Sol javításai révén 20%-kal csökkent az end‑to‑end kiszolgálási költség egyes munkafolyamatoknál, és további fejlesztések több mint 15%-kal növelték a token‑generálás hatékonyságát.

  • Jalapeño, az OpenAI első saját tervezésű inference (inferencia) chipje, InferenceX teszteken három nyilvános modellen 1,5–1,9×‑es csúcsteljesítményt (peak token throughput per watt) produkált a vizsgált kereskedelmi rendszerekhez képest, a chip névleges teljesítményét alapul véve. Az end‑to‑end késleltetés 1,7–3,6×‑kal kisebb volt. A vállalat tervei szerint a Jalapeñót év végéig kezdi telepíteni, párhuzamosan az NVIDIA, AMD és más partnerek gyorsítótáraival.

Ezek az eredmények azt jelentik OpenAI számára, hogy jobb modellek kevesebb próbálkozással eljuttathatják a felhasználót a kívánt eredményhez, és a hatékonyabb szoftver‑hardver páros révén minden egyes próbálkozás gyorsabb és olcsóbb lesz.

Gazdasági és stratégiai megfontolások

OpenAI üzleti modellje a növekvő használatból profitál: a szabad hozzáférés (reklámokkal támogatva) segít új felhasználókat bevonzani, míg a előfizetések és használat‑alapú termékek lehetővé teszik a bevétel növekedését, amikor az ügyfelek több értéket találnak. A cég kiemeli a tőkepiaci fegyelmet: minden beruházást az alapján mérnek fel, hogy milyen igényt képes kiszolgálni, mennyire gyorsan válik produktívvá, és visszahozza‑e az elvárt tőkét.

OpenAI álláspontja szerint a jobb modellek és az alacsonyabb költségek együtt bővítik azokat a feladatokat, amelyek gazdaságosan kiszolgálhatók, míg a növekvő használatból származó bevétel finanszírozza a következő generációs kutatásokat és infrastruktúrát. Ez adja meg számukra a meggyőződést, hogy képesek vezetni a mesterséges intelligencia következő hullámait, és minden előrelépéssel többet segíteni az emberek törekvéseiben.

Összegzés

A GPT‑6 Astra bemutatása mellett OpenAI a teljes technológiai veremre kiterjedő stratégiát ismertette: modellek, szoftver és egyre inkább saját hardver kombinációjával törekszik jobb teljesítményre és alacsonyabb költségekre. A cég szerint ezek az elemek együtt teszik lehetővé, hogy a növekvő keresletet kiszolgálják, miközben a bevételek visszaforgatásával folytatódhat a kutatás és az infrastruktúra fejlesztése.