Anthropic legújabb generatív nyelvi modelljeit 20 napra eltávolították az internetes hozzáférés alól, miután az Amazon — Anthropic partnere és befektetője — a cég Mythos és Fable nevű modelleivel kapcsolatban egy, úgynevezett „jailbreaking” problémát jelzett. A viták és vizsgálatok sorozata, beleértve magas szintű kormányzati beavatkozást és többszörös technikai egyeztetéseket, végül a modellek július 1-jei visszaállításával zárult.
Mi történt és miért számít?
Az ügy lényege az volt, hogy az Amazon egy jelentésben arra hívta fel a figyelmet: a Mythos és Fable modelleknél találtak egy potenciális gyengeséget, amely lehetővé teheti a védőkorlátok kijátszását (jailbreaking). Az Amazon aggályait az amerikai kormányhoz továbbították, ami széles körű exportellenőrzési intézkedések kilátásba helyezéséhez vezetett.
A probléma észlelését követően az amerikai hatóságok saját vizsgálatot is elindítottak, miután kiderült, hogy a kérdést kezelni kell. Ugyanakkor egyes kiberbiztonsági szakértők később nyílt levélben közölték a kormánnyal, hogy más vezető AI-modellek is hasonló jelenséget mutatnak.
Kormányzati szereplők és meghatározó események
- Június 12-én Howard Lutnick, az Egyesült Államok Kereskedelmi Minisztere, a Fehér Ház utasítására felhívta Anthropic vezérigazgatóját, Dario Amodeit. Lutnick világossá tette, hogy a problémát gyorsan rendezni kell, és jelezte, hogy Anthropic levelet kap majd széles körű exportkorlátozásokról.
- Amodei még aznap este visszahívta Lutnickot, miután megkapta a levelet, és belátta, hogy ez gyakorlatilag a modellek lekapcsolását jelenti — amire Lutnick szerint ez volt a cél.
- Az ügy miatt több kormányzati szervezet bevonásával háromhetes, intenzív egyeztetés indult az AI-biztonság kapcsán. Anthropic mérnökei Washington D.C.-be utaztak, hogy bemutassák, mi már megoldottnak vélt problémák finomhangolása folyamatban van.
Mely szervek vettek részt?
A vita technikai és politikai oldalát a következők vitték: a Kereskedelmi Minisztérium, a Center for AI Standards and Innovation, a Nemzetbiztonsági Ügynökség (NSA), a Nemzeti Kiberigazgató (Sean Cairncross), a Fehér Ház Tudomány- és Technológiapolitikai Hivatala, valamint a Pénzügyminisztérium informatikai vezetője, Sam Corcos. Emellett Andy Jassy (Amazon) értesítéséről érdemes megjegyezni, hogy a Pénzügyminiszter, Scott Bessent is korán hallott a problémáról, és szerepet vállalt a vállalat újbóli bevonásában és egy kiberbiztonsági elnöki rendelet előkészítésében.
Technikai egyeztetések és személyi feszültségek
A kormány és Anthropic között zajló technikai megbeszéléseken személyiségi és kommunikációs feszültségek is felszínre kerültek. Anthropic részéről Sarah Heck (policy chief) és Tom Brown (társalapító) fokozottan részt vettek az egyeztetésekben; Brown technikai szakértelme lehetővé tette, hogy részletesen, soronként tárgyalja a modellek viselkedését stresszhelyzetekben.
Egy forrás szerint soha nem történt meg, hogy Dario Amodei háttérbe vonult volna — ő maradt a fronton, de Brown szakmai jelenléte fontosnak bizonyult a kormányzati szakértőkkel folytatott részletes vitákban.
Visszaállítás és következmények
A kormányzati szervek fokozatos jóváhagyásai után a modelleket július 1-jén újra elérhetővé tették. A döntés lezárta a 20 napos lekapcsolást, de több forrás hangsúlyozta, hogy maradt munka az olyan szabályozási és jóváhagyási keretrendszerek kialakításán, amelyek átlátható folyamatokat, határidőket és bevonható szereplőket határoznak meg a jövőbeli modellek kiadása kapcsán.
Kérdéses továbbra is, mikor és hogyan lesznek ezek a modellek elérhetők az amerikai szövetséges országok számára — amelyeket a szakértők a kínai versenyképesség ellensúlyozásában kulcsfontosságúnak tartanak —, illetve hogy az OpenAI-tól a Google-ig terjedő többi labor hogyan kezeli saját friss modelljeinek kiadását. Az OpenAI legújabb, GPT-5.6 modellje jelenleg szünetel; a vállalat állítása szerint nem volt rálátása Anthropic és a Fehér Ház közötti egyeztetésekre, és saját modellje napi technikai megbeszéléseket igényel.
Összegzés
A 20 napos incidens rávilágított arra, hogy a kormányzati szereplők képesek gyorsan mozgósítani és széles körű technikai vizsgálatokat kezdeményezni, de a folyamat egyben feltárta a rossz kommunikációból és személyiségi konfliktusokból fakadó kockázatokat. A történet végkimenetele — a modellek visszaállítása — áthidalta a közvetlen válságot, ugyanakkor világossá tette, hogy szükség van egy átfogó, átlátható és több szereplőt bevonó jóváhagyási keretre az erősen fejlődő generatív mesterséges intelligencia rendszerek piacra lépéséhez.



