Modellbevezetés

Mesterséges intelligenciával generált szöveg

Anthropic bemutatja a Claude 2 nyelvi modellt: nagyobb kontextus, jobb teljesítmény és szélesebb hozzáférés

Az Anthropic bejelentette Claude 2 nevű nyelvi modelljét, amelyet 2023.

Anthropic bemutatja a Claude 2 nyelvi modellt: nagyobb kontextus, jobb teljesítmény és szélesebb hozzáférés

Anthropic 2023. július 11-én jelentette be új nyelvi modelljét, Claude 2-t, amelyet API-n keresztül és egy nyilvános béta chatfelületen, a claude.ai oldalon lehet elérni az Egyesült Államokban és az Egyesült Királyságban. A cég szerint a modell hosszabb válaszokra képes, nagyobb bemeneti kontextust kezel, és javult a teljesítménye több feladatkörben, beleértve a kódolást, matematikát és logikai feladatokat.

Főbb képességek és elérhetőség

  • Claude 2 API-hozzáférést kínál vállalatoknak, azonos árazással, mint a korábbi Claude 1.3. Emellett bárki az Egyesült Államokban és az Egyesült Királyságban létrehozhat fiókot és kipróbálhatja a béta chatélményt.
  • A modell bemeneti és kimeneti hosszát jelentősen növelték: egy promptba mostantól akár 100 000 token is beadható, így Claude 2 képes több száz oldalnyi technikai dokumentáció vagy egy teljes könyv feldolgozására. Egyetlen futtatásban több ezer token hosszú dokumentumok — például memók, levelek vagy rövidebb történetek — megírására is alkalmas.

Teljesítményadatok

Anthropic a következő teljesítménymutatókat közölte a korábbi verzióhoz viszonyítva:

  • Többválasztós Bar vizsga szakaszon Claude 2 76,5%-ot ért el szemben a Claude 1.3 73,0%-ával.
  • A GRE olvasás- és írásfeladatokban Claude 2 a pályázók felső, 90. percentilis feletti szintjén teljesít; mennyiségi érvényességben pedig a középső pályázóhoz hasonló eredményt mutat.
  • A Python kódolási vizsga, a Codex HumanEval esetében Claude 2 71,2%-ot ért el, szemben a Claude 1.3 korábbi 56,0%-ával.
  • A grade-school matematikai feladatokat tartalmazó GSM8k teszten Claude 2 88,0%-os eredményt produkált a korábbi 85,2%-kal szemben.

Anthropic jelezte, hogy a képességfejlesztések ütemezetten, iteratívan fognak megjelenni a következő hónapokban.

Biztonság és megbízhatóság

A cég hangsúlyozza, hogy folyamatos munkát végez a modell biztonságának javításán. Belső red‑teaming értékelésük szerint Claude 2 kétszer nagyobb arányban ad veszélytelen válaszokat a káros promptokra, mint a Claude 1.3. Ugyanakkor Anthropic figyelmeztet: nincs olyan modell, amely immunis lenne a "jailbreak"‑ekre, ezért több biztonsági technikát és kiterjedt red‑teaminget alkalmaztak a káros tartalmak csökkentésére. A vállalat felhívja a figyelmet, hogy az AI asszisztensek leginkább mindennapi feladatokban hasznosak — például információk összefoglalásában vagy rendszerezésében — és nem helyettesítik a szakmai egészségügyi vagy pszichológiai tanácsadást.

Vállalati partnerek és gyakorlati alkalmazások

Anthropic több ezer vállalattal dolgozik együtt a Claude API használatában. Két példát emeltek ki:

  • Jasper, egy generatív AI platform: Greg Larson, a Jasper VP of Engineeringje szerint Claude 2 jól teljesít különböző feladatokban, különösen hosszú, alacsony késleltetésű felhasználásoknál. Greg Larson idézett megjegyzése: „We are really happy to be among the first to offer Claude 2 to our customers, bringing enhanced semantics, up-to-date knowledge training, improved reasoning for complex prompts, and the ability to effortlessly remix existing content with a 3X larger context window.”

  • Sourcegraph és kódolási asszisztense, Cody: Sourcegraph arról számolt be, hogy Claude 2 jobb általános érvényesítési képességekkel és nagyobb kontextusablakkal (akár 100K token) pontosabb válaszokat tud adni a fejlesztők kérdéseire. Quinn Slack, a Sourcegraph vezérigazgatója és társalapítója ezt emelte ki a fejlesztői munkafolyamatok felgyorsulásával kapcsolatban.

Nyitottság a visszajelzésekre

Anthropic arra biztatja a felhasználókat és vállalatokat, hogy adjanak visszajelzést a béta chatélményről. A cég emlékeztet: a chatbéta nyitott, de a felhasználóknak tisztában kell lenniük azzal, hogy Claude — akárcsak más jelenlegi modellek — néha nem megfelelő válaszokat adhat. Anthropic kész kapcsolatot teremteni olyan vállalatokkal és területekkel, amelyek jelenleg még nem támogatott módon szeretnének Claude‑dal dolgozni.