Modellbevezetés

Mesterséges intelligenciával generált szöveg

DeepSeek V4.1 Flash: olcsóbb modell, új árháború az AI-piacon

A főszereplő a kínai DeepSeek, amely bemutatta V4.1 Flash nevű nyelvi modelljét, és újabb árnyomást helyezett riválisaira.

DeepSeek V4.1 Flash: olcsóbb modell, új árháború az AI-piacon

A kínai DeepSeek bemutatta V4.1 Flash nevű nyelvi modelljét, amelynek piaci bevezetése újabb árversenyt indított el az AI-szolgáltatók között. A cég állítása szerint az új modell használati költsége egyes esetekben egymillió tokenenként mindössze egy cent töredéke lehet, miközben teljesítménye bizonyos feladatoknál közelíti az amerikai és kínai versenytársakét.

Mit ígér a DeepSeek?

A vállalat közlése szerint a V4.1 Flash 552 milliárd paraméterrel rendelkezik, de az architektúra úgy lett kialakítva, hogy egyszerre csak a kapacitás kis részét aktiválja, így alacsonyabb erőforrásigénnyel működik. A DeepSeek hangsúlyozza, hogy az új modell programozási feladatokban és az AI-ügynökökhöz kötődő munkákban felülmúlja korábbi V4-Pro változatát, és egyes ismert kínai riválisok — köztük a Moonshot Kimi K3 — teljesítményét is meghaladja saját méréseik szerint. Ugyanakkor a V4.1 Flash a nyilvánosan ismertetett benchmarkok alapján még nem érte el az Anthropic és az OpenAI legfejlettebb amerikai modelljeinek szintjét.

Árstratégia és a verseny dinamikája

A DeepSeek stratégiája az, hogy nem az abszolút csúcsteljesítményt célozza meg, hanem alacsonyabb költségek mellett kínál elég jó teljesítményt a feladatok nagy részére. Ezzel különösen az AI-ügynökök terjedését célzó alkalmazásokban számítanak előnyre: ezek a rendszerek hosszú ideig dolgoznak automatikusan, sok tokent fogyasztanak, így a használati díj kisebb eltérései is nagy költségkülönbséget okozhatnak.

Az olcsó, nagy teljesítményű kínai modellek piaci hatását az "Artificial Analysis" nevű elemzés már a "DeepSeek-halálzóna" kifejezéssel írta le: a riválisoknak vagy árban kell felvenniük a versenyt, vagy olyan jelentős teljesítményelőnyt felmutatniuk, amely indokolja a magasabb árat. A Tencent, a ByteDance és az Alibaba is agresszív árazással próbál piaci részesedést szerezni, így a kínai árháború folytatódni látszik.

Piaci reakciók és félvezetőszektor

A bejelentés gyors tőzsdei reakciókat váltott ki: Hongkongban a MiniMax és a Z.AI árfolyama több mint 8 százalékkal esett, az Alibaba részvénye pedig több mint 2 százalékot veszített. A félvezetőgyártók papírjaira is hatással volt a hír: az SK Hynix amerikai forgalmú részvénye 5,8 százalékot zuhant, a Micron pedig 5,3 százalékot gyengült csütörtökön. A piac attól tart, hogy a modellüzemeltetés hatékonyságának javulása mérsékelheti az AI-modellekhez szükséges hardverkeresletet.

Műszaki módosítások

A DeepSeek a V4.1 Flashnél csökkentette az úgynevezett KV cache méretét, ami kevesebb nagy sávszélességű HBM memória és SSD-tárhely használatát teszi lehetővé. Ez a változtatás különösen fontos abban a piaci környezetben, ahol az AI-infrastruktúra iránti megnövekedett igény bizonyos memóriachipeknél tartós hiányt okozott.

Bevezetés, átállás és következő lépések

A DeepSeek szeptember 14-től kivonja a V4-Pro modellt, és az azon futó feladatokat automatikusan a V4.1 Flashre irányítja át az új, alacsonyabb díjszabás mellett. A cég további célja, hogy a következő növekedési hullámban a költségszint versenyképessége legalább akkora szerepet játsszon, mint a modellek abszolút teljesítménye — ez a megközelítés különösen a költségérzékeny vállalati használatban lehet meghatározó.

Miért fontos ez?

Az olcsóbb modellek terjedése alapvetően átalakíthatja, hogy mely szereplők és milyen megoldások lesznek versenyképesek a piacon. Ha a költségek döntő tényezővé válnak, az megnyithatja az utat olyan vállalati alkalmazások előtt, amelyek eddig a drágább, fejlettebb modellek miatt elérhetetlenek voltak.

A jelen írás nem minősül befektetési tanácsadásnak vagy ajánlásnak.

Címkék: Kína, mesterséges intelligencia, DeepSeek, árháború, AI-ügynök, Moonshot, Anthropic, OpenAI, Alibaba, Tencent, ByteDance, SK Hynix, Micron