Anthropic pénteken bemutatta az Opus 5 modellt, a cég hosszú ideje tartó „nehézsúlyú” modellcsaládjának legújabb tagját. Az Opus 5 kisebb kapacitású, mint a Fable 5, ugyanakkor a bejelentés szerint olcsóbb és kevesebb korlátozással működik, ezért a legtöbb felhasználási esetben előnyösebb lehet.
Teljesítmény és benchmarkok
A cég közlése szerint az Opus 5 több, a bejelentésben szereplő benchmarkon jobb eredményt ért el, mint a Fable 5. Anthropic külön kiemelte, hogy az Opus 5 „sokkal erősebb abban, hogy ellenőrizze a munkáját és óvatos iterációkkal addig dolgozzon, amíg sikerrel nem jár”, és példaként említette, hogy az Opus 5 egy hiányos utasításra reagálva saját számítógépes látás-pipeline-t írt a benchmarkteszt részeként.
Kiadási ütem és modellcsalád
Az Opus 5 a korábbi Opus 4.8 megjelenése után mindössze két hónappal érkezik; az Opus 4.8 május 28-án vált elérhetővé. A Mythos 5, Fable 5 és Sonnet 5 mind júniusban indultak, így csupán a könnyebb Haiku modell vár még arra, hogy frissüljön a 5-ös sorozatra.
Adatkezelés és korlátozások
Fontos különbség, hogy az Opus 5 mentesül számos olyan korlátozás alól, amelyek a Fable megjelenése óta nehezítették a használatát. Az Opus 5, akárcsak elődje, nincs alávetve annak a 30 napos adatmegőrzési szabálynak, amely a Fable-t és a Mythos-t érinti; ez a rendelkezés korábban aggályokat váltott ki egyes adatvédelmi szempontból érzékeny felhasználók körében.
Ugyanakkor maradnak jelentős védőintézkedések, különösen a kiberbiztonsági feladatoknál, például exploit-generálás és behatolás-tesztelés esetén. Az Opus 5 védelmi szabályai például megakadályozzák, hogy a modellt szoftverbinarik vizsgálatára használják sebezhetőségek felderítése céljából, míg forráskód keresése sebezhetőségek után engedélyezett, mert az utóbbi feladat valószínűbb védelmi célokra használható.
Biztonsági osztályozók és automatikus visszaesés
Anthropic szerint az Opus 5 esetében az osztályozók (safety classifiers) hozzávetőlegesen 85%-kal ritkábban lépnek működésbe, mint a Fable 5 esetén, ami a kevésbé szigorú beavatkozást tükrözi a kisebb képességű modellnél. Emellett a vállalat egy új eszközt is bevezet: az Automatic Fallbacks nevű, bétaként elérhető funkcióval a felhasználók engedélyezhetik, hogy ha a biztonsági osztályozó megakadályoz egy kérést, akkor a rendszer automatikusan egy kevésbé erős modellhez irányítsa át a lekérést. Így az API-t használók a beállítás bekapcsolásával működő választ kapnak hibajelzés helyett.
Miért számít ez?
Az Opus 5 bejelentése azt mutatja, hogy Anthropic igyekszik egyensúlyt találni a teljesítmény, a költséghatékonyság és a biztonság között: kisebb, olcsóbb, de bizonyos tekintetben kevésbé korlátozott modell érkezik javított ellenőrzési képességekkel, miközben fenntartanak fontos védelmi mechanizmusokat kritikus területeken. Az Automatic Fallbacks pedig csökkentheti a felhasználói élmény megszakítását, amikor a biztonsági szabályok érvénybe lépnek.



