OpenAI áprilisban bejelentett hatékonyságjavulásaira hivatkozva csökkenti a GPT‑5.6 család két változatának árát, továbbá egy új Fast (gyors) üzemmódot vezet be a GPT‑5.6 Sol számára az API‑ban. A vállalat szerint a változtatások célja, hogy az ügyfelek több hasznos munkát kapjanak ugyanannyi pénzért, és gyorsabban léphessenek, ha időérzékeny a feladat.
Mire számíthatnak az ügyfelek?
- Azonnali árcsökkentés: GPT‑5.6 Luna, a leggyorsabb és legolcsóbb modell ára 80%-kal csökken; GPT‑5.6 Terra, a kiegyensúlyozott, mindennapi munkára szánt modell ára 20%-kal csökken.
- API‑árak (kezdődik: július 30):
- Terra: 2 USD/millió input token és 12 USD/millió output token.
- Luna: 0,20 USD/millió input token és 1,20 USD/millió output token.
- Sol ára nem változik.
- Fast mód az API‑ban: a korábbi Priority Processing helyébe lépő Fast mód GPT‑5.6 Sol számára most legfeljebb 2,5× gyorsabb válaszidőt ad Standard feldolgozáshoz képest, az ár kétszerese mellett. A Fast mód nem változtatja meg a modell „intelligenciáját”, és visszafelé kompatibilis: a priority címkével megadott kérések automatikusan Fast módba kerülnek.
Milyen gyakorlati hatásokat ígér OpenAI?
OpenAI szerint a Luna olcsóbbá tétele lehetővé teszi a nagy volumenű, magas minőségű feladatok költséghatékony futtatását. A vállalat azt állítja, hogy a Luna teljesítménye hasonló ahhoz, amit egy éve frontier‑szintű modellek nyújtottak, de „nagyjából 6 centen a dollár per feladaton” és közel kilencszeres sebességnövekedéssel. Profi feladatokon (Agents’ Last Exam mérés) a Luna állítólag jobb eredményt ad Fable 5‑nél, miközben egy feladatra jutó költsége becslésük szerint közel 99%-kal alacsonyabb.
A gyakorlatban a cégek felépíthetnek kevert munkafolyamatokat: például a Sol használható a bizonytalanság feloldására és tervkészítésre, majd a Luna a jól meghatározott változtatások megvalósítására, tesztek írására és futtatására, valamint eredmények kiértékelésére.
Mi áll a megtakarítások mögött?
OpenAI szerint a megtakarítások sokrétűek: a modellek tervezésén, az azokat futtató inferencia‑rendszereken és az ügynöki (agentic) rétegen végzett fejlesztések együttesen növelik az egy dollárra jutó hasznos munkát. Konkrét mérőszámok, amelyeket a cég említ:
- A GPT‑5.6 Sol autonóm módon átírta és optimalizálta a gyártási kernelt, több száz kísérletet tervezett és futtatott a token‑generálás javítására, valamint monitorozta a tanítást és beavatkozott problémák esetén.
- A kernel‑munka az OpenAI közlése szerint 20%-kal csökkentette a modell kiszolgálásának végponttól végpontig terjedő költségét.
- A token‑generálási kísérletek több mint 15%-kal növelték a token‑generálás hatékonyságát.
Ezek az iteratív, modellvezérelt fejlesztések állítólag gyorsabb visszacsatolási kört hoznak létre: a jobb modellek önmagukban is segítik a további hatékonyságjavulást.
Infrastruktúra és alkalmazási területek
OpenAI hangsúlyozza, hogy a nagyszabású, megfizethető intelligencia megvalósításához mind több számítási kapacitásra, mind pedig hatékonyabb számításra van szükség. Az új árak a skála alsó részén (Luna, Terra) teszik gazdaságossá a nagy volumenű feladatokat, míg a Fast mód a válaszidő szempontjából kritikus Sol‑feladatokhoz biztosít gyorsabb hozzáférést.
Gyakorlati példaként a vállalat nagy tömeges dokumentumelemzéseket, ügyfélinterakciók osztályozását és rutinszerű végrehajtásokat említ, amelyek most gazdaságosan futhatnak széles körben, miközben a bonyolultabb Sol‑terhelések gyorsabban végezhetnek, ha a prémium megéri.
Hozzáférés és előfizetések
A GPT‑5.6 Terra és Luna továbbra is elérhető marad ChatGPT Work, Codex és az OpenAI API felületein. ChatGPT Work és Codex esetén Free és Go felhasználók Terra‑hoz férhetnek hozzá, míg Plus, Pro, Business és Enterprise felhasználók Terra és Luna közül választhatnak. A ChatGPT és Codex előfizetési díjak és kvóta‑keretek nem változnak, de Terra és Luna használata kevesebb kreditet fogyaszt majd.
Bevezetés és ütemezés
A vállalat közlése szerint az árváltozások július 30‑i kezdettel érvényesülnek az API‑ban a megadott token‑árakkal; az árváltozások később az AWS‑es telepítésekben is fokozatosan megjelennek. A Fast mód leváltja az API‑ban a Priority Processinget, a priority címkével érkező régi kérések továbbra is működnek.
Összegzés
OpenAI a GPT‑5.6 modellcsalád mögötti hatékonyságra építve jelentős árengedményeket ad a Luna és Terra modellekre, valamint gyorsabb válaszopciót kínál Solhoz az API‑felhasználóknak. A cég állítása szerint a fejlesztések mögötti műszaki intézkedések — jobb modellek, hatékonyabb inferencia‑szoftver és okosabb ügynöki kezelések — lehetővé teszik, hogy a vállalati ügyfelek rugalmasabban alakítsák a sebesség, költség és intelligencia közötti kompromisszumot.



