Modellbevezetés

Claude Haiku 4.5: gyorsabb és olcsóbb közel-frontier kódoló modell az AI-alkalmazásokhoz

A Anthropic által 2025.

Claude Haiku 4.5: gyorsabb és olcsóbb közel-frontier kódoló modell az AI-alkalmazásokhoz

Anthropic október 15-én, 2025-ben tette elérhetővé Claude Haiku 4.5-öt, egy kisebb modelljét, amely a vállalat szerint közel-frontier szintű kódolási teljesítményt nyújt, ugyanakkor jelentősen gyorsabb és gazdaságosabb elődjénél. A cég azt közölte, hogy a mostani modell hasonló kódolási képességeket ad, mint a öt hónappal korábbi Claude Sonnet 4, de nagyjából egyharmad költségen és több mint kétszeres sebességgel.

Mi változott és miért számít

Claude Haiku 4.5 célja, hogy a valós idejű, alacsony késleltetésű felhasználási esetekben — például csevegőasszisztensekben, ügyfélszolgálati ügynököknél vagy párprogramozásnál — jobb élményt adjon a fejlesztőknek és végfelhasználóknak. A modellről a cég azt állítja, hogy bizonyos feladatokban, például számítógép-használatban, túl is szárnyalja a Sonnet 4‑et, és javítja olyan alkalmazások teljesítményét, mint a Claude for Chrome vagy Claude Code.

A gyakorlatban a vállalati közlés szerint Haiku 4.5 a Sonnet 4.5 teljesítményének mintegy 90%-át éri el az Augment agentic coding értékelésben, miközben a Sonnetnél jelentősen gyorsabb és olcsóbb működést kínál. Egyes belső mérések szerint a modell 4–5× gyorsabban fut, mint Sonnet 4.5, és ennek megfelelően új felhasználási módokat tesz lehetővé.

Elérhetőség és árképzés

Claude Haiku 4.5 október 15-től minden felhasználó számára elérhető. Fejlesztők az API-n a claude-haiku-4-5 modellt hívhatják meg; a modell elérhető továbbá Amazon Bedrockon és Google Cloud Vertex AI-n, és beállítható cseremodellként Haiku 3.5 és Sonnet 4 helyett. Anthropic az új árstruktúrát így határozta meg: 1/5 USD per millió input, illetve output token.

Biztonság és osztályozás

A cég részletes biztonsági és alignációs vizsgálatokat futtatott le Haiku 4.5-tel. A közlemény szerint a modell alacsonyabb arányban mutatott aggályos viselkedéseket, és összességében statisztikailag szignifikánsan jobb alignációt ért el, mint a Sonnet 4.5 és az Opus 4.1 a cég automatikus értékelésében. A CBRN (vegyi, biológiai, radiológiai és nukleáris) fegyverek előállítására vonatkozó kockázatok korlátozottnak bizonyultak, ezért a modellre az Anthropic az AI Safety Level 2 (ASL-2) klasszifikációt alkalmazta, míg a Sonnet 4.5 és az Opus 4.1 szigorúbb ASL-3-at kapott.

A részletes indoklást és a teljes biztonsági értékelést a Claude Haiku 4.5 rendszerdokumentuma (system card) tartalmazza.

Benchmarket és módszertan

A közlemény felsorol több benchmarkot és a hozzájuk tartozó módszertant. Például:

  • Augment agentic coding: Haiku 4.5 eléri Sonnet 4.5 teljesítményének 90%-át.
  • SWE-bench Verified: a cég 73.3%-os értéket jelentett, átlagolva 50 próbán, 128K „thinking budget” mellett a teljes, 500 feladatos adathalmazon.
  • AIME, Terminal-Bench, τ2-bench, OSWorld és MMMLU tesztekre vonatkozó részletes konfigurációkat és ismétléseket a cég leírta, beleértve a prompt-kiegészítéseket és a gondolkodási költségkeretet (például több benchmarknál 128K thinking budget szerepel).

Az összehasonlító adatok között szerepel, hogy Haiku 4.5 utasításkövetésben diavetőszöveg-generálásnál 65%-os pontosságot ért el egy prémium kategóriás modellel szemben, amely 44%-ot produkált, továbbá korai tesztek azt mutatják, hogy a GitHub Copilot‑hoz integrálva hasonló minőségű kódgenerálást ad Sonnet 4‑hez képest, de gyorsabban.

Milyen felhasználásokra ajánlják

Anthropic külön kiemeli az ügynök-orchestration (több alügynök párhuzamos munkavégzése) és a számítógépes feladatok gyors elvégzését, valamint a fejlesztői munkafolyamatokban és prototípuskészítésben rejlő előnyöket. A Sonnet 4.5-tel kombinálva a Sonnet felbonthat komplex problémákat több lépésre, és egyidejűleg több Haiku 4.5 példány végezheti el a részfeladatokat.

Hogyan jutok hozzá és hol találok műszaki részleteket

A modellt elérhetőnek jelentették a Claude Code-ban, a Claude alkalmazásokban, az API-n, Amazon Bedrockon és Google Cloud Vertex AI-n. A fejlesztők és érdeklődők számára a cég rendszerkártyájában (system card), a modelloldalon és a dokumentációban találhatók a részletes technikai leírások és a vizsgálati eredmények.