Anthropic október 15-én, 2025-ben tette elérhetővé Claude Haiku 4.5-öt, egy kisebb modelljét, amely a vállalat szerint közel-frontier szintű kódolási teljesítményt nyújt, ugyanakkor jelentősen gyorsabb és gazdaságosabb elődjénél. A cég azt közölte, hogy a mostani modell hasonló kódolási képességeket ad, mint a öt hónappal korábbi Claude Sonnet 4, de nagyjából egyharmad költségen és több mint kétszeres sebességgel.
Mi változott és miért számít
Claude Haiku 4.5 célja, hogy a valós idejű, alacsony késleltetésű felhasználási esetekben — például csevegőasszisztensekben, ügyfélszolgálati ügynököknél vagy párprogramozásnál — jobb élményt adjon a fejlesztőknek és végfelhasználóknak. A modellről a cég azt állítja, hogy bizonyos feladatokban, például számítógép-használatban, túl is szárnyalja a Sonnet 4‑et, és javítja olyan alkalmazások teljesítményét, mint a Claude for Chrome vagy Claude Code.
A gyakorlatban a vállalati közlés szerint Haiku 4.5 a Sonnet 4.5 teljesítményének mintegy 90%-át éri el az Augment agentic coding értékelésben, miközben a Sonnetnél jelentősen gyorsabb és olcsóbb működést kínál. Egyes belső mérések szerint a modell 4–5× gyorsabban fut, mint Sonnet 4.5, és ennek megfelelően új felhasználási módokat tesz lehetővé.
Elérhetőség és árképzés
Claude Haiku 4.5 október 15-től minden felhasználó számára elérhető. Fejlesztők az API-n a claude-haiku-4-5 modellt hívhatják meg; a modell elérhető továbbá Amazon Bedrockon és Google Cloud Vertex AI-n, és beállítható cseremodellként Haiku 3.5 és Sonnet 4 helyett. Anthropic az új árstruktúrát így határozta meg: 1/5 USD per millió input, illetve output token.
Biztonság és osztályozás
A cég részletes biztonsági és alignációs vizsgálatokat futtatott le Haiku 4.5-tel. A közlemény szerint a modell alacsonyabb arányban mutatott aggályos viselkedéseket, és összességében statisztikailag szignifikánsan jobb alignációt ért el, mint a Sonnet 4.5 és az Opus 4.1 a cég automatikus értékelésében. A CBRN (vegyi, biológiai, radiológiai és nukleáris) fegyverek előállítására vonatkozó kockázatok korlátozottnak bizonyultak, ezért a modellre az Anthropic az AI Safety Level 2 (ASL-2) klasszifikációt alkalmazta, míg a Sonnet 4.5 és az Opus 4.1 szigorúbb ASL-3-at kapott.
A részletes indoklást és a teljes biztonsági értékelést a Claude Haiku 4.5 rendszerdokumentuma (system card) tartalmazza.
Benchmarket és módszertan
A közlemény felsorol több benchmarkot és a hozzájuk tartozó módszertant. Például:
- Augment agentic coding: Haiku 4.5 eléri Sonnet 4.5 teljesítményének 90%-át.
- SWE-bench Verified: a cég 73.3%-os értéket jelentett, átlagolva 50 próbán, 128K „thinking budget” mellett a teljes, 500 feladatos adathalmazon.
- AIME, Terminal-Bench, τ2-bench, OSWorld és MMMLU tesztekre vonatkozó részletes konfigurációkat és ismétléseket a cég leírta, beleértve a prompt-kiegészítéseket és a gondolkodási költségkeretet (például több benchmarknál 128K thinking budget szerepel).
Az összehasonlító adatok között szerepel, hogy Haiku 4.5 utasításkövetésben diavetőszöveg-generálásnál 65%-os pontosságot ért el egy prémium kategóriás modellel szemben, amely 44%-ot produkált, továbbá korai tesztek azt mutatják, hogy a GitHub Copilot‑hoz integrálva hasonló minőségű kódgenerálást ad Sonnet 4‑hez képest, de gyorsabban.
Milyen felhasználásokra ajánlják
Anthropic külön kiemeli az ügynök-orchestration (több alügynök párhuzamos munkavégzése) és a számítógépes feladatok gyors elvégzését, valamint a fejlesztői munkafolyamatokban és prototípuskészítésben rejlő előnyöket. A Sonnet 4.5-tel kombinálva a Sonnet felbonthat komplex problémákat több lépésre, és egyidejűleg több Haiku 4.5 példány végezheti el a részfeladatokat.
Hogyan jutok hozzá és hol találok műszaki részleteket
A modellt elérhetőnek jelentették a Claude Code-ban, a Claude alkalmazásokban, az API-n, Amazon Bedrockon és Google Cloud Vertex AI-n. A fejlesztők és érdeklődők számára a cég rendszerkártyájában (system card), a modelloldalon és a dokumentációban találhatók a részletes technikai leírások és a vizsgálati eredmények.



