Modellbevezetés

OpenAI bemutatja a GPT‑5.6 családot: Sol, Terra és Luna korlátozott előzetesben

Az OpenAI bejelentette a GPT‑5.6 sorozat korlátozott előzetesét, amely három modellt tartalmaz: Sol (csúcsmodell), Terra (költséghatékony, napi munkára) és Luna (gyors, alacsony költségű).

OpenAI bemutatja a GPT‑5.6 családot: Sol, Terra és Luna korlátozott előzetesben

OpenAI bejelentette a GPT‑5.6 modellcsalád korlátozott előzetesét, amely három tagból áll: GPT‑5.6 Sol, a legnagyobb képességű modell; GPT‑5.6 Terra, a mindennapi munkára optimalizált, kiegyensúlyozott változat; és GPT‑5.6 Luna, a gyors és olcsóbb opció. A vállalat azt közölte, hogy a modelleket a következő hetekben tervezik szélesebb körben elérhetővé tenni, de az indulásnál először egy kis, megbízható partnerekből álló csoport számára nyitott előzeteshez férnek hozzá, amelynek részvételét az Egyesült Államok kormánya is ismeri.

Teljesítmény és képességek

OpenAI szerint a Terra teljesítménye versenyképes a GPT‑5.5‑tel, ugyanakkor kétszer olcsóbb. Luna a cég közlése szerint erős képességet nyújt a legalacsonyabb költségek mellett. A GPT‑5.6 Solról OpenAI úgy ír, hogy ez a legkifinomultabb és legképzettebb modellük eddig, amely különösen javulást mutat az agent‑szerű, többlépéses feladatokban.

A cég bemutatott értékeléseket említ: Sol új csúcsot állít fel a parancssoros munkafolyamatokat vizsgáló Terminal‑Bench 2.1‑en, javulást mutat a genomikai és kvantitatív biológiai feladatokat mérő GeneBench v1‑en — kevesebb token használata mellett —, és előrelépést jelez a kiberbiztonsági feladatok terén az ExploitBench és ExploitGym benchmarkokon. Az OpenAI ígérete szerint a szélesebb elérhetőségkor további, részletesebb értékelési eredményeket tesznek közzé.

Új működési módok és késleltetés‑kezelés

A GPT‑5.6‑tal bevezetnek egy új „max reasoning effort” beállítást, amely több időt ad Solnak a mélyebb következtetésre. Emellett egy „ultra mode” is elérhető, amely alügynököket (subagents) használva próbálja gyorsítani a komplex munkákat.

OpenAI említette továbbá, hogy júliusban GPT‑5.6 Sol elérhető lesz Cerebras architektúrán akár 750 token/másodperc sebességgel, kezdetben korlátozott ügyfélhozzáféréssel.

Biztonság és fázisos kiadás

A cég hangsúlyozza, hogy a GPT‑5.6 Sol a mostani legrobosztusabb biztonsági védelmi rétegekkel érkezik. Több hétig keresték a gyenge pontokat, nyomták a rendszert valós támadási forgatókönyvek alatt, és fokozatosan erősítették a védelmet. Az OpenAI részletezi, hogy a modelleket úgy konfigurálták, hogy a képességek növekedésével párhuzamosan a védelmi mechanizmusok is erősebbek legyenek.

A bevezetésnél az OpenAI a kormányzati együttműködés részeként előzetesen bemutatta terveit és a modellek képességeit az Egyesült Államok kormányának. Az Egyesült Államok kérése alapján a cég ideiglenesen korlátozott előzetest indít egy kis, megbízható partnercsoporttal, és ezt a rövid lépést a vállalat a szélesebb elérhetőség gyorsabb és biztonságosabb biztosításának legjobb útjaként indokolja, miközben a közelgő „cyber Executive Order” keretrendszer kialakításán dolgoznak.

Többrétegű védelmi megközelítés

OpenAI kiemeli, hogy egyetlen védelmi réteg sem elegendő eltökélt vagy adaptív visszaélés ellen. A GPT‑5.6 előzetes során több réteget alkalmaznak, amelyek modellbe épített tiltásokból, generálás közbeni valós idejű ellenőrzésekből, fiókszintű jelzésekből, differenciált hozzáférésből, monitorozásból és végrehajtásból állnak, továbbá folyamatos tesztelést is végeznek.

A modellek kifejezetten elutasítják a tiltott kibersegítséget, még akkor is, ha a felhasználó megpróbálja elrejteni a szándékot vagy "jailbreakelni" a modellt. Valós idejű kiber‑ és biológiai visszaélés‑osztályozók figyelik a generálást; magasabb kockázat esetén a generálás megállhat, míg egy nagyobb következtető modell felülvizsgálja a beszélgetést. Ha az eredmény tiltottként értékelődik, az kimenet megvonható, mielőtt eljutna a felhasználóhoz. Emellett a gyanús aktivitás fiókszintű vizsgálatot indíthat több beszélgetés és kockázati jel alapján.

OpenAI elismeri, hogy az előzetes során a védelmi rétegek időnként jogos kéréseket is blokkolhatnak, illetve plusz időbe telhet a generálás, ha további ellenőrzésre van szükség. Pontosan ez az előzetes célja: megérteni, hogy a tiltások mennyire akadályozzák a visszaélést, és közben mennyire teszik nehezebbé a legitim, kettős felhasználású munkát. A partnerek visszajelzései segítik majd a hamis pozitívok csökkentését és a folyamat simítását a szélesebb körű kiadás előtt.

Automatizált és emberi red‑teaming

A biztonság javítása érdekében OpenAI eddig több mint 700,000 A100‑egyenértékű GPU‑órát használt automatizált red‑teamingre, amelynek célja univerzális jailbreak‑ek felderítése — olyan támadások, amelyek sok prompton vagy kontextuson át működhetnek. Az automatizált munka kiegészül független harmadik felekkel végzett emberi szakértői red‑teaminggel, amely folyamatosan zajlik az előzetes alatt.

A vállalat hangsúlyozza, hogy nincs olyan értékelés, amely minden konfigurációt vagy többlépéses támadást lefedne, ezért fenntartanak egy gyors reagálási folyamatot újonnan felfedezett jailbreakek reprodukálására, priorizálására és javítására.

Hozzáférés és árképzés

A GPT‑5.6 modellek az előzetes idején az API és Codex felületen lesznek elérhetők egy kiválasztott, megbízható partnerekből álló csoport számára. OpenAI tervezi, hogy a modelleket hamarosan szélesebb körben elérhetővé teszi ChatGPT‑ben, Codex‑ben és az API‑n keresztül.

A modellcsalád új elnevezési rendszere szerint a szám a generációt azonosítja, míg a Sol, Terra és Luna a tartós képesség‑szinteket jelölik, amelyek önálló ütemben fejlődhetnek. Az árak 1 millió tokenre vonatkoznak: Sol bemenetenként 5 USD / kimenetenként 30 USD; Terra bemenetenként 2,50 USD / kimenetenként 15 USD; Luna bemenetenként 1 USD / kimenetenként 6 USD. Emellett a GPT‑5.6 bevezeti a kiszámíthatóbb prompt‑cache‑elést, köztük explicit cache töréspontok támogatását és 30 perces minimális cache‑élettartamot. A cache‑írás számlázása 1,25‑szeres a nem‑cache‑elt bemeneti díjnak, míg a cache‑olvasás a 90%‑os kedvezményt kapja.

Összegzés

OpenAI szerint a GPT‑5.6 Sol, Terra és Luna család lépést jelent a teljesítmény, sebesség és költség közötti választásban, miközben új biztonsági rétegekkel és intenzív red‑teaminggel igyekszik csökkenteni a visszaélések kockázatát. A céget az előzetes során szerzett visszajelzések és a kormányzati konzultációk alapján várhatóan néhány héten belül szélesebb hozzáférés felé mozdul el.