Több felhasználói jelzés és nyomkövetési adatok szerint az OpenAI bizonyos előfizetői munkameneteket terhelés esetén alacsonyabb kapacitású modellekre irányít át anélkül, hogy a felhasználói felületen erről tájékoztatást adna. A rendelkezésre álló információk szerint a ChatGPT Plus fiókokat a dokumentáció alapján 160 üzenet után három órán belül a "mini" modellre terelik, és a felhasználó felé nincs külön értesítés.
Mi történt pontosan
- Egy felhasználó jelentése szerint a ChatGPT Extended Thinking munkamenete két óra után néma módon visszaváltott Instant (alacsonyabb) modellre, miközben a felületi jelzés nem változott.
- Az állítólagos OpenAI súgódokumentum megemlíti, hogy a Plus fiókokat átirányítják a "mini" modellre, ha elérik a 160 üzenetet három órán belül; ez történik figyelmeztetés vagy felugró értesítés nélkül.
- Hasonlóan, a Pro előfizetés esetében — amelyet a cikk szerint havi 200 dollárért kínálnak — a „Heavy thinking” munkaterhelésnél is előfordul ugyanilyen korlátozás.
- Egy februári Codex-nyomkövetésről készült feljegyzés szerint egy Pro kérést a 5.3 modellre irányítottak, de a válasz a 5.2 alapmodelltól érkezett.
Miért számít ez
Az állítások szerint ez nem egyszerű technikai hiba, hanem gyakorlatias terheléskezelési megoldás: a vállalatok a legdrágább infrastruktúra-költségeik csökkentésére igyekeznek, és a feliratkozott ügyfelek forgalmát arra használják, hogy a terhelést elnyeljék. A jelzések szerint ez a gyakorlat nem kizárólag az OpenAI-re jellemző — hasonló vádak merültek fel az Anthropic kapcsán is, amelyről azt állítják, hogy Opus 4.6 munkameneteket csendben kisebb testvérmodellre irányított át terhelés alatt.
Konkrét következmények a felhasználók számára
- A felhasználók a prémium jelzést és azt a teljesítményt várják, amelyre az előfizetésükkel számítanak; a láthatatlan visszaváltás ronthatja az eredmény minőségét és megbízhatóságát.
- Az érintett előfizetők technikai és üzleti használata is kiszolgáltatott lehet: hosszú promptok, kutatási vagy kreatív munkafolyamatok megszakadhatnak, bizonytalanná válhat a visszajövő válaszok konzisztenciája.
Mit állít a forrásanyag és mi marad kérdéses
A jelen cikk az érintett felhasználói jelentésekre, a nyomkövetési bejegyzésekre és a dokumentációnak tulajdonított sorokra támaszkodik. Nem áll rendelkezésre nyilvános, közvetlen megerősítés az OpenAI részéről arról, hogy ez a gyakorlat általános és hogyan alkalmazzák pontosan. Az is kérdéses, hogy milyen mértékű a jelenség, illetve milyen feltételek mellett térnek vissza a felhasználók a magasabb kapacitású modellre.
Összegzés
A bejelentések szerint az OpenAI és más nagy generatív AI laborok terhelés alatt időnként alacsonyabb kapacitású modellekre irányítják a prémium előfizetők kéréseit anélkül, hogy azt a felhasználónak egyértelműen jeleznék. A gyakorlat felveti a transzparencia, a szolgáltatási szintek és a prémium előfizetések értékének kérdéseit.



