Modellbevezetés

Mesterséges intelligenciával generált szöveg

Két gyors láncátvágás: olcsó és gyors LLM-ek felszámolják a teljesítmény-monopóliumot

A főszereplők a DeepSeek V4 Pro és a Grok 4.6 nagy nyelvi modellek, amelyek egy éjszaka, két óra különbséggel jelentek meg.

Két gyors láncátvágás: olcsó és gyors LLM-ek felszámolják a teljesítmény-monopóliumot

Az éjszaka során, két órás különbséggel bemutatott két nagyobb nyelvi modell — DeepSeek V4 Pro és Grok 4.6 — jelentős hatást gyakorolt a piacra azzal, hogy a csúcsteljesítménynek eddig adott ár- és sebességalibi egyaránt gyengült.

Mi történt

  • DeepSeek V4 Pro teljesítménye a Terminal Bench nevű eszközteszten 87,9-es pontszámot ért el, közel állva Claude Fable 5 88,0-ás eredményéhez. Ugyanakkor DeepSeek költsége nagyjából 0,87 dollár per egymillió token körül alakult, szemben Claude Fable 5 mintegy 50 dolláros árszintjével. A DeepSeek csapata ugyanakkor jelezte, hogy az árak később emelkedhetnek.
  • Grok 4.6 a sebesség és költséghatékonyság terén tett lépést: a cikk forrása szerint olyan kódolási feladatok, amelyek GPT-5.6 Sol alatt fél óránál tovább tartottak, Grok esetében húsz percen belül elkészültek, egyes esetekben pedig három perc alatt. A költségszerkezetet tekintve egyes mérések alapján belépésre körülbelül 2 dollár, kimenetre pedig 6 dollár körüli kiadás adódott.

Miért számít ez

A mesterséges intelligencia modellek piacán hosszú ideje érvényesült egyfajta „lehetetlen háromszög”: okos, olcsó vagy gyors — egyszerre csak kettőt lehet választani. Ez a helyzet lehetővé tette, hogy a legjobb modellek prémiumot kérjenek, mivel a minőség előnye gyakran igazolta a lassabb reagálást vagy a magasabb árazást.

A DeepSeek a költségoldalt tördeli meg, a Grok pedig a sebességet; egyik sem állítja magáról, hogy a legjobb minden tekintetben, de együtt megkérdőjelezik azt az érvet, hogy a csúcsteljesítményhez feltétlenül magas ár és lassabb kiszolgálás kell.

Konkrét következmények

  • Azok a szolgáltatók és fejlesztők, akik eddig a „legokosabb” modellek prémiumáért fizettek, most egyértelmű alternatívákat találnak, amelyek jelentősen csökkenthetik a futtatási költségeket és a fejlesztési időt.
  • A piacon maradás feltétele immár nemcsak a modellek nyers tudása lesz, hanem az, hogy milyen gyorsan és milyen áron teszik elérhetővé azt a gyakorlatban.

Összegzés

A DeepSeek V4 Pro és a Grok 4.6 egymástól függetlenül, de időben közeli megjelenésükkel kettős kihívást intéztek a korábbi teljesítmény-monopóliumhoz: az egyik modell az olcsóság, a másik a gyorsaság oldaláról törte meg az eddigi érveket. Amint a „jó elég” kategória egyszerre olcsóvá és gyorssá válik, a lassú és drága megoldások versenyképtelenné válhatnak.


(Nevesítve: DeepSeek V4 Pro, Grok 4.6, Claude Fable 5, GPT-5.6 Sol, Terminal Bench. A cikk a megadott teljesítmény- és árszámokat követi; a pontos megjelenési dátumok a forrásban „egy éjszaka, két óra különbséggel” megfogalmazással szerepelnek.)