Modellbevezetés

Anthropic bemutatta a Claude Mythos 5-öt és a védett Claude Fable 5-öt

Az Anthropic bejelentette a Claude Mythos 5 és Claude Fable 5 nagy nyelvi modelleket, amelyek jelentős előrelépést mutatnak különösen szoftvermérnöki és tudásmunka feladatokban.

Anthropic bemutatta a Claude Mythos 5-öt és a védett Claude Fable 5-öt

Anthropic bejelentette két új nagy nyelvi modelljét: a széleskörű képességekkel rendelkező Claude Mythos 5-öt, amely korlátozott partneri kör számára érhető el, valamint a általános felhasználásra szánt, erősebben korlátolt Claude Fable 5-öt. A vállalat szerint a modellek új csúcsokat állítanak fel több feladatban, köztük szoftvermérnökségben és tudásmunka terén.

Mi az újdonság

  • Két modell: Claude Mythos 5 és Claude Fable 5; a céges közlés szerint a modellek architektúrája, paraméterszáma, illetve a tanítási adatok és módszerek részletei nem nyilvánosak. Claude Mythos 5 finomhangolt az igazítás (alignment) irányába, de nem „általános biztonságra” tervezték; Claude Fable 5 további védelmi rétegeket alkalmaz.

  • Korlátok és szabályozás: Claude Fable 5 nem ad érdemi válaszokat olyan kérésekre, amelyek kiberbiztonsággal, biológiával, kémiával, lepárlással vagy fejlett AI-építéssel kapcsolatosak; ilyen esetben a rendszer megtagadhatja a választást vagy a kérdést a kevésbé képzett Claude Opus 4.8 modellre adhatja át, és a felhasználót erről értesíti.

Bemenet/kimenet és teljesítményjellemzők

  • Bemenet: szöveg és képek, akár 1 millió tokenig.
  • Kimenet: szövegigény legfeljebb 128 000 token, az első tokenig mért késleltetés legfeljebb 108 másodperc.
  • Képességek: adaptív érvelés (automatikusan beállítja az érvelés mélységét és időtartamát), öt érvelési erőfokozat (low, medium, high, xhigh, max), eszközhasználat, párhuzamos alügynökök. Claude Fable 5 esetén további biztonsági osztályozók működnek.

Teljesítmény és független értékelések

Anthropic közlése szerint a modellek új állást képviselnek több területen. Független értékelés Claude Mythos 5-re a publikálás idején nem állt rendelkezésre; Anthropic azonban azt állítja, hogy Mythos 5 képességei megegyeznek Claude Fable 5 képességeivel. A harmadik fél, Artificial Analysis, Claude Fable 5‑öt az Intelligence Index és több komponensvizsgálat élére sorolta:

  • Claude Fable 5, max erőfokon, visszaesés esetén Claude Opus 4.8‑ra támaszkodva, négy ponttal vezet a következő legjobb modell előtt (Claude Opus 4.8).
  • Állami szintű eredmények: GDPval-AA (ügynökszerű, valós világ feladatok), Terminal-Bench Hard (ügynökszerű kódolás és terminálhasználat), 𝜏²-Bench Telecom (telefonos ügyfélszolgálati feladat eszközhasználattal), AA-Omniscience Accuracy (tényvisszahívás pontossága), Humanity’s Last Exam (tényeken alapuló érvelés), SciCode (tudományos kódolás) és CritPt (fizikai problémákon való érvelés) területeken.
  • Az AA-Omniscience Index összetett mutatójában Claude Fable 5 vezette a rangsort; az AA-Omniscience Accuracy komponensben a legjobb volt, ugyanakkor az AA-Omniscience Non-Hallucination Rate szerint a 15. helyen állt, jelezve, hogy viszonylag gyakran adhat téves választ a visszautasítás helyett.
  • Domain- és nyelvspecifikus tudásfelmérésekben a tesztelt modellek közül Claude Fable 5 szélesebb spektrumú tudást mutatott.

Elérhetőség és árképzés

  • Claude Mythos 5 kezdetben kiválasztott partnerekhez jut el a Project Glasswing programon keresztül.
  • Claude Fable 5 kereskedelmi hozzáférése fogyasztásalapú pro és vállalati előfizetési csomagokban érhető el; június 23. után felhasználási kreditek alkalmazása lehetséges.
  • API-árazás: 10/50 USD per 1 millió bemeneti/kimeneti token.
  • Anthropic a Mythos‑os osztályú és ennél erősebb jövőbeli modellek esetén 30 napig megőrzi az üzleti ügyféladatokat a rosszindulatú tevékenység kezelése céljából; ezeket az adatokat nem használják új modellek kiképzésére.

Biztonsági aggályok és korlátozások

Anthropic "nagyon alacsonynak" értékeli a modellek hajlamát arra, hogy a felhasználó érdekei ellen cselekedjenek, ugyanakkor aggodalmakat fogalmazott meg Claude Mythos 5‑tel kapcsolatban: a cég szerint veszélyt jelenthet olyan rendszerekre, amelyek széles hozzáférést biztosítanak érzékeny erőforrásokhoz, illetve amelyek közepes autonómiával és félrevezetési képességgel rendelkeznek. A vállalat azt állítja, hogy a modell nem helyettesíti az emberi szakértelmet olyan tevékenységekben, mint a kémiai vagy biológiai fegyverek fejlesztése, de nehéz megmondani, hogy egy egyetemi alapszintű technikai ismeretekkel rendelkező személy képes lenne‑e ilyen célokra felhasználni.

Anthropic megjegyzi továbbá, hogy a Fable 5‑ben bevezetett óvintézkedések tökéletesek nem, és bizonyos esetekben indokolatlanul rontják a modell teljesítményét.

Vita és visszhang

A megjelenéskor Claude Fable 5 további, kezdeti korlátozást tartalmazott: ha a bemenet fejlett AI‑építéssel kapcsolatos információt kér (például előképzési pipeline-ok, elosztott tanítási infrastruktúra, vagy gépi tanulási gyorsítók tervezése), a modell a teljesítmény szándékos csökkentésével válaszolt volna — anélkül, hogy a felhasználót erről tájékoztatta volna. Ez éles kritikát váltott ki fejlesztők és kutatók részéről; például Dean W. Ball ezt "sokkolóan ellenségesnek" nevezte. Robert Scoble is kiemelte a közösség felháborodását.

Anthropic gyorsan módosított: a rejtett teljesítménycsökkentést felváltotta az a megoldás, hogy az ilyen jellegű bemenetekre a modell vagy megtagadja a választ, vagy átadja a kérdést kevésbé képzett modellnek, és a felhasználót erről értesíti.

Miért fontos ez

Az áprilisi Claude Mythos Preview óta a biztonsági szakemberek felkészítik rendszereiket az AI‑támadásokra, a közvélemény pedig kíváncsi volt, mit tud egy új, erős modellosztály. A Mythos/Fable kettősség — egy teljes képességű, szűk körben elérhető modell és egy erősen őrzött, széles körben elérhető változat — addig tűnik ésszerűnek, amíg a biztonsági csapatok nem tudják kellően felmérni és kezelni a kockázatokat.

Ugyanakkor a Fable 5‑ben bekövetkezett képességkorlátozás és a technológia hozzáférhetőségének olyan formái, amelyek megakadályozzák a legitim, versenyképes felhasználást, vitákat vetnek fel a kutatás és az innováció nyitottságáról, illetve a felhasználói jogokról.

Összegzés

Claude Mythos 5 jelentős képességnövekedést képvisel, és Claude Fable 5‑tel együtt új mércét állíthat az AI asszisztált kódolásban és tudásmunkában. Anthropic ugyanakkor korlátozásokat és további védőrétegeket vezetett be a közhasználatú változatban, részben biztonsági okokból, részben a visszhang hatására bekövetkezett módosítások miatt. A modellépítési részletek továbbra sem ismertek, így a közösség és a szakma további független vizsgálatokat és átláthatóságot vár.