Anthropic pénteken bemutatta a Claude Opus 5 modellt, amely a cég szerint a csúcskategóriás Fable 5 intelligenciájának nagy részét adja meg, miközben költséghatékonyabb üzemeltetést kínál. A vállalat hangsúlyozza: a bejelentés azt jelzi, hogy az AI-verseny egyre inkább nemcsak a nyers képességekről, hanem a mindennapi használat gazdaságosságáról szól.
Árazás és elérhetőség
Opus 5 azonnal elérhető Anthropic összes platformján. Az árak megegyeznek az előd Opus 4.8 díjazásával: 5 dollár per millió input token és 25 dollár per millió output token. Opus 5 lesz az alapértelmezett modell a Claude Max prémium fogyasztói szinten, és a legerősebb modell a Claude Pro előfizetésben.
Pozícionálás: hatékonyság a középsávban
Anthropic nem állítja, hogy Opus 5 a legintelligensebb modellük — ezt továbbra is Fable 5 képviseli — hanem azt kommunikálja, hogy a vállalati használat szempontjából a gazdaságosság a legfontosabb: a közepes nehézségű, ismétlődő munkákban a költséghatékony, majdnem csúcsteljesítmény gyakran értékesebb, mint a drágább frontier‑modell. A cég szóvivője szerint a termékpaletta így tagolódik: Opus 5 a „napi használat” modellje, Fable 5 a leghosszabb, autonóm munkákhoz, Sonnet 5 a nagyszabású skálázáshoz, Haiku 4.5 pedig kisebb alügynökökhöz és azonnali válaszokhoz.
Benchmark‑eredmények és korlátok
Anthropic szerint Opus 5 több kódolási és tudásmunka értékelésben is új csúcsokat állít fel, például a Frontier-Bench és GDPval‑AA méréseken. A cég közlése szerint a Frontier-Bench v0.1 agentikus terminálkódolási benchmarkon Opus 5 43,3 százalékot ért el — ez több mint kétszerese az Opus 4.8 18,7 százalékának és megelőzi a Fable 5‑öt (33,7 százalék), miközben feladatköltségen is kedvezőbb. Az ARC‑AGI 3 értékelésen a cég szerint Opus 5 háromszor jobb eredményt ért el a következő legjobb modellnél. Az OSWorld 2.0 számítógép‑használati benchmarkon a cég állítása szerint a modell meghaladta Fable 5 teljesítményét, de alacsonyabb költségen (kb. egyharmadnyi költséggel).
A vállalat azonban őszinte korlátokat is megfogalmaz: Opus 5 bizonyos területeken elmarad a versenytárs Mythos 5‑től kiberbiztonság és biológiai kutatás terén, és egy agentikus kódolási benchmarkon egy OpenAI‑családba tartozó modell vezet. A cég szóvivője hozzátette, hogy az Opus 5 erőssége a határozott, konkrét kimenettel bíró eval‑feladatokban mutatkozik; ahol a feladat időben elnyúló, sok összekapcsolt lépést igényel órákon vagy napokon át, ott még mindig Fable 5‑re érdemes támaszkodni.
Token‑hatékonyság és ügyfélvisszajelzések
Az Opus 5 egyik központi üzenete, hogy nemcsak jól teljesít, hanem jól teljesít dollár/ token alapon. A modellhez „effort” beállítás tartozik, amellyel a felhasználók intelligencia és végrehajtási sebesség/ tokenfelhasználás között cserélhetnek. Korai ügyfelek konkrét példaival szolgáltak: a jogi AI‑cég Harvey szerint Opus 5 az Opus 4.8 maximális érvelési módjához hasonló teljesítményt ért el, miközben átlagosan 26%-kal kevesebb tokent generált. Richard Pham a Fundamental Research Labtól azt mondta, hogy nehéz pénzügyi modellezési feladatoknál a pontosság átlagosan kilenc százalékponttal javult, miközben körülbelül egyharmaddal kevesebb forduló és eszközhasználat és 60%‑kal kevesebb idő kellett. Wade Foster, a Zapier vezérigazgatója szerint Opus 5 elérte az AutomationBench listája élén a 100%-os eredményt egy teljes churn‑megelőző munkafolyamattal anélkül, hogy több tokent fogyasztott volna, mint korábbi Claude modellek. Scott Wu, a Cognition vezérigazgatója pedig arról számolt be, hogy a FrontierCode 1.1 benchmarkon Opus 5 Fable‑szintű teljesítményt közelít meg fele költséggel, különösen hibakeresésben és root‑cause elemzésben.
Önálló ellenőrzés és a rejtett automatizálási költségek csökkentése
Anthropic kiemeli, hogy Opus 5 képes önellenőrzésre: a modell iterál addig, amíg sikerre nem jut. Tesztesetekből a cég olyan példákat mutatott, ahol a modell saját számítógépes látás‑pipeline‑t írt egy rajzból geometria kinyeréséhez, javított egy nyílt forráskódú csomagkezelő valódi hibáját úgy, hogy egy közösségi javítás által figyelmen kívül hagyott szélső esetet is kezelte, vagy egy kereskedési cég számára egy ülésen épített piaci adathálózatot és hozzá teszthurkot a validációhoz. Stripe‑nál Cristian Rivera egy hétvégére „chief‑of‑staff” szerepet adott a modellnek a fejlesztői környezetek felett: a modell saját ellenőrzőt épített, kezelte a szervereket, és csak a döntési pontoknál vonta be a mérnököt. Ez kulcsfontosságú különbség: egy modellt, amely csak hihető kimenetet ad, és egy olyat, amely ellenőrzi az eredményét, emberi ellenőrzést spórol meg — az enterprise AI rejtett költségének nagy része ma az emberi felülvizsgálat.
Biztonság: képesség‑gátlás, osztályozók és visszaesési logika
A bevezetés része Anthropic egyre összetettebb biztonsági stratégiája: a cég tudatosan hagy ki bizonyos képességeket a tanításból. Automatikus viselkedési auditjuk szerint Opus 5 a leginkább „aligned” modelljük eddig, 2,3‑as mutatóval az összesen megfigyelt félrevezető viselkedés tekintetében — alacsonyabb eredménnyel, mint az Opus 4.8, Sonnet 5 vagy Fable 5. A képességoldalon Anthropic szándékosan kerülte, hogy Opus 5‑öt kiberfeladatokra képezzék, ahogy az Opus 4.8 esetén is tették. Ennek ellenére a modell a általános képességnövekedés miatt javult e területen, és most szinte utoléri Mythos 5‑öt sebezhetőségek felismerésében. Ugyanakkor gyenge marad a kihasználások kidolgozásában: az OSS‑Fuzz értékelés szerint Opus 5 a sebezhetőségek 79,4%-át azonosította (Mythos 5 körül 80%), de exploitokat csak négy kihívásban tudott kidolgozni, szemben Mythos 5 tizenhárom sikerével. Ez a szimmetria szándékosnak látszik, és a védelmi osztályozók is ennek megfelelően működnek.
Ha egy osztályozó belép, a Claude.ai, Claude Code és Claude Cowork kérései alapértelmezés szerint visszaesnek Opus 4.8‑ra. Anthropic szerint ez azért történik, mert a visszaesési modell alacsonyabb képességszintje kisebb kockázatot jelent. A felhasználót erről üzenet tájékoztatja.
Vállalati háttér és kereskedelmi tét
A bevezetés a vállalat jelentős kereskedelmi növekedésének és kötelezettségeinek közepén történik. Reuters februári közlése szerint Anthropic értékelése hozzávetőleg 380 milliárd dollár volt az utolsó finanszírozási körben. Contrary Research szerint a Claude termék 2025 végére körülbelül 40 százalékos részesedést tartott az enterprise nagy nyelvi modellek használati piacából, és a Claude Code önmagában mintegy 1 milliárd dollár évesített bevételt ért el. A cég belső céljai 2026‑ra állítólag 20‑26 milliárd dolláros bevételt céloztak, amiket nagymértékű infrastruktúra‑beruházások — például egy jelentett 30 milliárd dolláros Azure compute‑megállapodás, illetve Google Cloud és Nvidia együttműködések — finanszíroznak. Ez a kontextus indokolja a Opus 5 árazási stratégiáját: azonos listaáron jelentősen több képesség kínálata bővíti azon munkafolyamatok körét, amelyeknél az automatizálás gazdaságilag életképes, és így ismétlődő token‑bevételt hoz.
Jogi és szabályozási háttér, egyéb funkciók
A jogi és szabályozási környezet is bonyolultabbá vált: a hét folyamán egy amerikai bíró jóváhagyta Anthropic 1,5 milliárd dolláros szerzői jogi egyezségét könyvszerzőkkel, lezárva a korai képzési adatok körüli pereskedést. Emellett júniusban jelentések szerint az Egyesült Állam kormány lépéseket tett Anthropic legfejlettebb modelljeinek külföldi hozzáférésének korlátozására. Pénteken emellett elérhetővé vált egy Fast mód, amely hozzávetőleg 2,5‑szörös sebességgel fut, kétszeres alapáron; az API‑n automatikus visszaesési útvonalak, és közbeszélgetés közbeni eszközváltások, amelyek már nem érvénytelenítik a prompt cache‑t. Ahogy korábbi Opus modellek, Opus 5 esetén sincs általános hozzáférésnél adatmegőrzési kötelezettség, amit a szóvivő kiemelt a „hard zero data retention” követelményű ügyfelek számára. Fejlesztők claude-opus-5 néven érhetik el a modellt a Claude API‑n kezdve a bejelentés napjától.
Kérdések, amelyek eldöntik a sikerét
Két kérdés fogja eldönteni, hogy a fogadás megtérül-e: az, hogy Opus 5 hatékonysági állításai ellenállnak‑e a valós, nagy léptékű termelési munkaterheléseknek, és hogy az ügyfelek elfogadják‑e, hogy biztonsági osztályozók időnként eldöntik, melyik modell válaszoljon. A bejelentés mélyebb üzenete azonban világos: az iparág súlypontja elmozdult a legjobb napi teljesítmény felől arra, hogy mi a nagyon jó modell képes megtenni nap mint nap alacsonyabb költséggel. Anthropic arra számít, hogy a valódi üzleti lehetőség a frontier mögötti sávban van — és erre teszi fel az Opus 5‑tel a stratégiai fogadását.



