Modellbevezetés

Anthropic bemutatja a Claude Opus 4.7-et: fejlettebb kódolás, nagyobb felbontás és beépített kibervédelmi korlátok

Az Anthropic bemutatta és általánosan elérhetővé tette a Claude Opus 4.7 modellt 2026.

Anthropic bemutatja a Claude Opus 4.7-et: fejlettebb kódolás, nagyobb felbontás és beépített kibervédelmi korlátok

Anthropic 2026. április 16‑án tette általánosan elérhetővé legújabb modelljét, Claude Opus 4.7-et. A vállalat szerint az Opus 4.7 elsősorban a fejlett szoftvermérnöki feladatokban hoz érdemi előrelépést az Opus 4.6‑hoz képest, különösen a nehezebb, hosszú lefolyású, többlépcsős munkákban.

Mire jobb az Opus 4.7?

  • Kódolás és hosszú kontextusú munkák: Anthropic és korai tesztelői szerint az Opus 4.7 kevesebb felügyeletet igényel a legnehezebb kódolási feladatoknál, megbízhatóbban követi az utasításokat, képes köztes ellenőrzésekre és önellenőrzésre a visszajelzés előtt. A belső 93‑feladatos kódolási benchmarkon az Opus 4.7 13%-kal javította a feloldást az Opus 4.6‑hoz képest, több olyan feladatot megoldva, amelyet az Opus 4.6 és a Sonnet 4.6 nem tudott.

  • Multimodális látás: a modell nagyobb felbontású képeket képes feldolgozni: az elfogadott maximális hosszabb él 2 576 pixel (kb. 3,75 megapixel), ami több mint háromszorosa a korábbi Claude modelleknek. Ez részletes képelemzést és finom vizuális részleteket igénylő multimodális alkalmazásokat tesz lehetővé.

  • Kreativitás és szakmai minőség: Anthropic szerint az Opus 4.7 professzionális feladatoknál esztétikusabb, kreatívabb kimeneteket ad — például interfészek, prezentációk és dokumentumok terén.

Biztonság és kibervédelmi korlátok

Opus 4.7-et úgy vezetik be, hogy beépített védelmek automatikusan észleljék és blokkolják a tiltott vagy magas kockázatú kiberbiztonsági kéréseket. A bejelentés emlékeztet a korábbi Project Glasswingre: Anthropic korlátozott kiadást és fokozatos tesztelést ígért a Mythos Preview képességeinél kevésbé fejlett modelleken, hogy új kibervédelmi mechanizmusokat próbáljanak ki. A vállalat új Cyber Verification Programot is indít azoknak a biztonsági szakembereknek, akik legitim kibervédelmi kutatásokhoz (sebezhetőségek vizsgálata, penetrációs tesztek, red‑teaming) szeretnék használni az Opus 4.7‑et.

Hozzáférés, ár és integrációk

Claude Opus 4.7 azonnal elérhető minden Claude termékben és az API‑n keresztül, továbbá Amazon Bedrockon, Google Cloud Vertex AI‑n és Microsoft Foundry‑ban. Az ár változatlan maradt az Opus 4.6‑hoz képest: 5 USD per millió input token és 25 USD per millió output token. Fejlesztők a claude‑opus‑4‑7 modellnevet használhatják a Claude API‑ban.

Visszajelzések és mérési eredmények a korai tesztelésből

Anthropic számos partnerrel és ügyféllel végzett korai tesztelést, amelyekből kiemelt megállapítások:

  • Több vállalatnál és benchmarkon jobb teljesítmény, különösen aszinkron munkafolyamatok, automatizációk, CI/CD és hosszú futású feladatok esetén. Több cég szerint az Opus 4.7 jobb hibatűrést, kevesebb eszközhiba‑varianciát és megbízhatóbb végrehajtást nyújt.

  • Konkrét eredmények: a Finance Agent és más belső értékeléseken javulások; egy belső ügynök‑értékelésen 0,715‑ös top‑kötélt értéket ért el hat modulon; a General Finance modulon 0,813‑ra javult az Opus 4.6 0,767‑jéhez képest. CursorBenchen 70%‑ot ért el az Opus 4.7 az Opus 4.6 58%‑ához képest. Rakuten‑SWE‑Benchen háromszoros gyakorlatmegoldási arányt jelentettek az Opus 4.6‑hoz viszonyítva.

  • Több ügyfélszereplő (Replit, Notion Agent, Databricks, Vercel, stb.) tapasztalta, hogy az Opus 4.7 pontosabb, gyorsabb és gyakran hatékonyabb tokenhasználatú a konkrét, hosszú futású fejlesztési munkákban.

  • Példák: XBOW vizuális élességi benchmarkján 98,5%‑os eredményt mértek Opus 4.7‑tel szemben az Opus 4.6 54,5%-ával; Databricks OfficeQA Pro‑ban 21%‑kal kevesebb hiba forrásinformációval dolgozva az Opus 4.6‑hoz képest.

Használati javaslatok és migráció

Anthropic felhívja a figyelmet két fontos változásra az Opus 4.6‑ról való áttéréskor:

  1. Frissített tokenizáló: bizonyos bemenetek több tokenre bonthatók (körülbelül 1,0–1,35×), tartalomtól függően.
  2. Több „gondolkodás” magasabb effort szinteken: a modell magasabb effort beállításoknál több kimeneti tokent generálhat, mert többet dolgozik a feladatokon, különösen agentikus helyzeteknél.

A tokenhasználat szabályozható az effort paraméter, a task budgetek, vagy a tömörítésre ösztönző promptok révén. Anthropic saját tesztjeiben a nettó hatás kedvező volt több kódolási értékelésen, de javasolják, hogy a felhasználók mérjék a hatást saját forgalmukon. A vállalat migrációs útmutatót is közzétett.

Egyéb újdonságok

  • Új effort‑szint: xhigh (extra high) a high és a max közé, finomabb vezérlést adva a gondolkodási/latencia kompromisszumokra. Claude Code alapértelmezésben xhigh‑ra állítja az effortet Pro és Max felhasználók számára.

  • Task budgets publikus béta formában az API‑n, hogy fejlesztők irányíthassák a tokenfelhasználást hosszú futásoknál.

  • Claude Code‑ban új /ultrareview parancs dedikált felülvizsgálati munkamenetekhez, és Pro/Max felhasználóknak három ingyenes ultrareview jár kipróbálásra. Auto mode‑ot kiterjesztették Max felhasználókra.

Biztonság, igazodás és korlátok

Anthropic tesztjei szerint az Opus 4.7 biztonsági profilja összességében hasonló az Opus 4.6‑éhoz: alacsony arányt mutatnak káros viselkedésekre (pl. megtévesztés, sycophancy, visszaéléssel való együttműködés). Néhány területen (pl. őszinteség, prompt‑injekció elleni ellenállás) javulás látszik; más területeken (pl. túl részletes ártalomcsökkentő tanács kontrollált szerek esetén) a modell némileg gyengébb lehet. Anthropic összegezése szerint a modell „nagyjából jól igazított és megbízható, bár nem tökéletes”. A Mythos Preview továbbra is a legjobban igazított modellnek számít a vállalat belső értékelései alapján. Részletes biztonsági értékelést a Claude Opus 4.7 System Card tartalmaz.

Frissítés

A bejegyzés dokumentuma frissült: 2026. május 4‑én módosult a Document reasoning grafikon az OfficeQA Pro frissített Opus 4.7 eredményeinek tükrében.