Iparág

OpenAI és Broadcom bemutatta a Jalapeño nevű, kifejezetten inferenciára tervezett egyedi chipet

Az OpenAI és a Broadcom bemutatta az OpenAI első, saját tervezésű inferenciafeldolgozó processzorát, a Jalapeñót, amelyet kifejezetten az OpenAI inferenciarendszereinek igényeire fejlesztettek.

OpenAI és Broadcom bemutatta a Jalapeño nevű, kifejezetten inferenciára tervezett egyedi chipet

OpenAI szerdán bemutatta első, kifejezetten inferenciára tervezett egyedi processzorát, amelyet a Broadcom-mal közösen terveztek és gyártanak. A chip hivatalos neve Jalapeño; a vállalat közlése szerint tervezésében az OpenAI saját mesterséges intelligencia modelljei is segítettek.

A partnerség létrejöttét hivatalosan októberben jelentették be, de az OpenAI saját chipes terveiről már korábban is szóbeszéd keringett, mivel a cég így csökkentené függését az Nvidia grafikus gyorsítókészleteitől. Google és Amazon is hasonló célú, „AI gyorsítónak” nevezett, saját tervezésű chipeket fejlesztett korábban.

Mire készült a Jalapeño?

A Jalapeño-t kifejezetten az inferencia folyamatára optimalizálták — vagyis arra, amikor már meglévő, betanított modelleket futtatnak felhasználói kérésekre válaszként. OpenAI a bejelentésben külön kiemelte, hogy a chip alacsony működési költséget biztosít valós idejű kódírási modellek futtatásakor.

A cég szerint a korai tesztek jelentősen jobb teljesítmény/watt mutatókat jeleznek, mint a jelenleg elérhető, állítólagos csúcskategóriás alternatívák. Ugyanakkor valószínű, hogy a nagy számításigényű feladatok — például a modellek előképzése (pre-training) — továbbra is Nvidia hardveren fognak történni.

Miért fontos ez?

OpenAI elnöke, Greg Brockman a vállalat belső podcastjában a Broadcom-mal kötött partnerség bejelentését követően arról beszélt, hogy az OpenAI mély megértéssel rendelkezik az általuk futtatott munkaterhelésekről, és célzottan olyan feladatokat keresnek, amelyeket jelenleg alul szolgálnak a meglévő megoldások, majd ezekre építve akarnak gyorsítani.

A chiptől várható költségcsökkentés különösen az inferencia-oldalon lehet jelentős: még kisebb megtakarítások is lényegesen javíthatják a működési eredményeket, mivel az inferencia sok esetben folyamatos, nagyszámú lekérést jelent.

OpenAI a bejelentésben hangsúlyozta, hogy a vállalat nemcsak a modelljeinek fejlesztésén és a termékek építésén dolgozik, hanem az őket alátámasztó infrastruktúrát — így a chiparchitektúrát, kerneljeit, memória- és hálózatrendszereit, ütemezést és telepítési megoldásokat — is tervezi. A vertikális optimalizáció révén minden réteg ugyanazt a célt szolgálja: gyorsabb, megbízhatóbb és olcsóbb modellek a felhasználók számára.

Jelen állapot

A Jalapeño jelenleg tesztelés alatt áll; az OpenAI által közölt eredmények korai jellegűek, de ígéretesek a hatékonyság javítását tekintve. A cég közleménye alapján a chip bevezetése egy újabb lépés abba az irányba, hogy az OpenAI a teljes technológiai verem mentén optimalizálja működését.