Anthropic ma reggel tette közzé a Claude Sonnet 5 modellt. A cég fejlesztői dokumentációjára hivatkozó „what's new” anyag részletesen ír az újdonságokról, és azokat a technikai-szabályozási háttérinformációkat is tartalmazza, amelyek segítik megérteni, miért engedélyezték a kiadást.
Képességek és korlátozások
Anthropic szerint a Sonnet 5 teljesítménye „közel van” az Opus 4.8-hoz, de alacsonyabb ár mellett. A modell rendszerkártyája (system card) egyértelműsíti, hogy a Sonnet 5 kevésbé képes rosszindulatú kibertevékenységekre, mint a Mythos 5; emiatt a Sonnet 5-ön alkalmazott védőintézkedések hasonlók azokhoz, amelyeket az Opus 4.7 és Opus 4.8 esetén alkalmaztak (ezek a modellek Sonnet 5-nél erősebbek, de a Mythos 5-nél lényegesen gyengébbek).
API-változások és technikai paraméterek
- A korábbi sampling-paraméterek: temperature, top_p és top_k többé nem támogatottak.
- Kontextusablak: 1 000 000 (egymillió) token.
- Maximális kimeneti token: 128 000 token.
- A Sonnet 5 ugyanazokat az eszköz- és platformfunkciókat használja, mint a Claude Sonnet 4.6.
- Az "adaptive thinking" alapértelmezés szerint engedélyezve van; letiltásához a kérésekben meg kell adni: "thinking": {type: "disabled"}.
Árazás és az új tokenizáló hatása
A nyers árazás megegyezik a Sonnet 4.6-tal: $3/million input és $15/million input, és bevezető kedvezményként ez $2/$10-ig él 2026. augusztus 31-ig. Ugyanakkor a Sonnet 5 egy új tokenizálót használ: Anthropic szerint azonos bemeneti szöveg körülbelül 30%-kal több tokent eredményez, mint a Claude Sonnet 4.6 esetén. Ez gyakorlatilag ~30%-kal magasabb költséget jelent ugyanazon szöveg feldolgozásáért, ha az árazás tokenalapú.
Mérések: tokenizálási különbségek példákon
A szerző a "Claude Token Counter" eszközével tesztelte az új tokenizálót néhány nagyobb dokumentumon. Az eredmények (token-szám és a Sonnet 4.6-hoz viszonyított arány):
- Universal Declaration of Human Rights (angol): Sonnet 4.6 = 2,356 token; Sonnet 5 = 3,341 token (≈1.42×)
- Universal Declaration of Human Rights (spanyol): Sonnet 4.6 = 3,572 token; Sonnet 5 = 4,747 token (≈1.33×)
- Universal Declaration of Human Rights (kínai, egyszerűsített mandarinnal): Sonnet 4.6 = 3,334 token; Sonnet 5 = 3,360 token (≈1.01×)
- sqlite_utils/db.py (4,279 sor Python): Sonnet 4.6 = 44,014 token; Sonnet 5 = 56,113 token (≈1.27–1.28×)
Ezek alapján a Sonnet 5 tokenjei angol szöveg esetén körülbelül 1,4×-es, spanyolnál 1,33×-os, Python-kódban ~1,28×-os többletköltséget jelentenek, míg egyszerűsített mandarinnál gyakorlatilag nincs különbség.
Egyéb megjegyzések
A Sonnet 5 kiadása együtt jár néhány kényelmi változtatással az API-ban (például a sampling-paraméterek eltűnése), ugyanakkor a nagy, egymilliós kontextusablak és a 128 000 tokenes kimenet sok alkalmazás számára jelentős előrelépés lehet. Ugyanakkor a tokenizáló megnövelt token-száma miatt az effektív költség nagyobb lehet a korábbi Sonnet 4.6-hoz képest, még akkor is, ha a per-token árak átmenetileg nem változtak.
Az egyik tesztkép (egy pelikán) kapcsán a Sonnet 5 egyszerűen „libának” vélte az állatot — apró anekdota a modell viselkedéséről, amelyet a közösség megosztott.
Miért számít ez?
A Sonnet 5 kombinálja a nagyon nagy kontextusablakot és a magas kimeneti limitet a fejlesztői élményt befolyásoló API-változásokkal. Az új tokenizálás és annak költséghatása különösen fontos azoknak a vállalatoknak és fejlesztőknek, akik nagy mennyiségű szöveget vagy kódot dolgoznak fel, mert a látszólag azonos per-token árakat jelentősen befolyásolhatja a felhasználás tényleges költsége.
A Sonnet 5-ről és részleteiről további információ a fejlesztői dokumentációban található (a cikk a kiadott "what's new" anyagot és a rendszerkártyát használta forrásként).



