Anthropic bejelentette, hogy a kormányzati exportkorlátozásokat, amelyek miatt június 12-én korlátozták legújabb modelljeihez, a Claude Fable 5-höz és Claude Mythos 5-höz való hozzáférést, június 30-án feloldották. Ennek megfelelően a Fable 5-öt 2026. július 1-jétől ismét globálisan elérhetővé teszik a Claude Platformon, Claude.ai-n, Claude Code-on és Claude Coworkon.
Mikor és milyen korlátozásokat oldottak fel
- A két modellt Anthropic június 9-én adta ki; mindkettő azonos alapmodellre épül, de a Fable 5 erősebb korlátozásokat kapott a széles körű, biztonságos használat érdekében. A Mythos 5 kevesebb korlátozás mellett csak néhány megbízható Project Glasswing partner számára volt elérhető védelmi célú kiberbiztonsági használatra.
- A US kormány június 12-én exportkorlátozást alkalmazott mindkét modellre, amely megkövetelte, hogy a hozzáférést korlátozzák külföldi állampolgárok számára, legyenek akár az Egyesült Államokban, akár kívül. Mivel a rendelet azonnal hatályba lépett és valós idejű állampolgárság-ellenőrzésre nem volt megbízható módszer, Anthropic felfüggesztette a modellekhez való hozzáférést minden felhasználó számára.
- A kormány június 26-án engedélyezte a Mythos 5 korlátozott, amerikai szervezeteknek szóló visszaállítását. A teljes körű nemzetközi és belföldi bővítés a Glasswing program keretében továbbra is egyeztetés alatt áll.
- A Fable 5 újra elérhető lesz 2026. július 1-jétől minden felhasználó számára; Pro, Max, Team és kiválasztott Enterprise tervek esetén a Fable 5 július 7-ig a heti használati limit legfeljebb 50%-áig bele lesz számolva, majd ezt követően használati krediteken keresztül érhető el. Anthropic tervezi az AWS, Google Cloud és Microsoft Foundry szolgáltatásokon való újraengedélyezést is a lehető leghamarabb.
Milyen esemény vezetett a korlátozáshoz és hogyan javították a rendszert
Az exportkorlátozás a kormány tudomására jutott egy jelentés nyomán, amely szerint Amazon kutatók egy technikát mutattak be, amellyel megkerülhető volt Fable 5 egyes védelmi mechanizmusai: a prompt hozott elő olyan válaszokat, amelyek azonosítottak szoftverhibákat, és egy esetben a modell kódpéldát is adott a sebezhetőség kihasználására.
Anthropic és partnerei — köztük az Amazon — a következőket vizsgálták:
- Tesztelésük szerint több kevésbé fejlett modell (például Claude Opus 4.8, GPT-5.5 és Kimi K2.7) ugyanazokat a sérülékenységeket képes volt azonosítani, mint amilyenek a jelentésben szerepeltek.
- Az egyetlen sebezhetőség kihasználásának demonstrációját minden, általuk tesztelt modell elő tudta állítani, köztük Claude Haiku 4.5, Sonnet 4.6, Opus 4.6–4.8, GPT-5.4, GPT-5.5 és Kimi K2.7.
- A jelentett technika nem tárt fel Mythos-szintű egyedi offenzív képességet; a viselkedés egy határhelyzetet tükrözött Fable 5 védelmi szabályai számára: olyan feladatokra engedett rá, amelyeket a rendszer óvatosságból blokkolni szokott, de a konkrét eset rutin védelmi kiberbiztonsági munkához kapcsolódott.
Gyorsan intézkedtek: együtt a kormánnyal egy továbbfejlesztett biztonsági osztályozót (classifier) képezték, amely célzottan blokkolja a jelentésben leírt viselkedést. Az új osztályozó a jelentés szerinti technikát több mint 99%-ban blokkolja; ha egy kérés blokkolódik, a kérést értesítés mellett az Opus 4.8 modellhez irányítják.
A csereköltségként több ártalmatlan, rutinszerű kódolási és hibakeresési kérést is többször jelölhetnek meg, vagyis nőnek a hamis pozitívok. Anthropic tovább finomítja az osztályozókat, hogy jobban megkülönböztesse a jogos kéréseket a visszaélésektől.
A US Department of Commerce Center for AI Standards and Innovation (CAISI) tesztelte a korábbi és az új védelmi megoldásokat, és azt állapította meg, hogy ezek rendkívül erősek.
Az Anthropic által követett kiberbiztonsági védekezési elv
Anthropic szerint a Claude Mythos 5 hatékonyan talál és kihasznál szoftverhibákat, és olyan offenzív képességeket kínál, amelyek vonzóvá tehetik rosszindulatú szereplők számára. A Fable 5 ezzel szemben nem biztosít ilyen egyedi offenzív képességeket, mivel a bevezetéskor a cég eddigi legerősebb védelmi rétegével adták ki.
A védelmi megközelítés „mélységi védelem” (defense in depth): különböző mechanizmusok együttesen csökkentik a visszaélések esélyét. Az egyik kulcselem a kisebb, automatikus osztályozók alkalmazása, amelyek kommunikáció közben felismerik és blokkolják a potenciálisan káros kiberfeladatokra irányuló kéréseket vagy kimeneteket.
Tudatosan nagy biztonsági „sávot” (safety margin) építettek be: az osztályozók úgy vannak beállítva, hogy sok, valószínűleg ártalmatlan kérést is blokkoljanak, ha van egy kis kockázat arra, hogy ártalmas lehet. Fable 5-nél ezt a sávot minden korábbinál szélesebbre vették, vállalva a felhasználói frusztrációt a kockázatok csökkentése érdekében.
A jailbreak-ek (vagy „bypass”-ok) nagyrészt különböző súlyosságúak lehetnek: sok kisebb, néhány szűkebb hatókörű ártalmas, és elméletileg létezhet egy univerzális jailbreak is. Az Anthropic célja, hogy saját biztonsági kutatói és partnerei találják meg a súlyosabb jailbreak-eket és javítsák ki azokat, mielőtt rosszindulatú szereplők kihasználnák őket.
Iparági keretrendszer a jailbreak-ek értékelésére
Anthropic, az Amazon, a Microsoft, a Google és más Glasswing partnerek közösen dolgoznak egy javasolt, négy kritériumból álló súlyossági skálán, amely segítene egységesen értékelni a megtalált jailbreak-eket:
- Képességnövekedés (Capability gain): mennyivel haladja meg a jailbreak a meglévő eszközöket;
- A képességnövekedés szélessége (Breadth): hány különböző offenzív feladatra használható a technika;
- Fegyverkezés könnyűsége (Ease of weaponization): mennyi emberi szakértelmet és próbálkozást igényel a támadássá formálás;
- Felismerhetőség (Discoverability): mennyire könnyen hozzáférhető vagy ismert a technika.
A tervezet célja, hogy a súlyosság alapján kalibrálják a válaszlépéseket: a legsúlyosabb eseteknél azonnali, megelőző intézkedéseket kezdenek el bevezetni. Emellett egy 24/7-es csapatot hoznak létre a kulcsfontosságú jailbreak-bejelentési csatornák folyamatos figyelésére. Anthropic új HackerOne programot is indít, ahol kutatók benyújthatják Fable 5-beli potenciális kiber-jailbreakjeiket értékelésre.
Mélyebb együttműködés az amerikai kormánnyal
Anthropic az elmúlt tíz hétben szorosan együttműködött az Egyesült Államok kormányzati szerveivel a 2026. június 2-i "Promoting Advanced Artificial Intelligence Innovation and Security" végrehajtási rendelet tükrében. Az együttműködés kiterjedt többek között az Office of the National Cyber Director-re, az Office of Science and Technology Policy-re, a Department of the Treasury-re és a Department of Commerce-re (beleértve a CAISI-t), valamint érintett nemzetbiztonsági szervekre.
A vállalat az alábbi konkrét elköteleződéseket hirdeti meg:
- Előzetes hozzáférés és értékelés: a kormány kijelölt partnerei korai hozzáférést kaphatnak határvonalat előremozdító modellekhez és azok védelmi mechanizmusaihoz független tesztelés végett, Anthropic technikai munkatársainak bevonásával.
- Gyors információmegosztás: jelentős jailbreak-ek vagy visszaélési mintázatok esetén azonnali vizsgálat, triázs és az illetékes kormányzati partnerek értesítése; az új védelmek megosztása független tesztelésre.
- Közös kutatás: dedikált Anthropic csapatok és számítási kapacitás biztosítása kormányzati tesztelés és kutatás támogatására.
- Iparági minimum: közös, önkéntes biztonsági és értékelési szabványok kialakítása a frontier-modellek szolgáltatói számára.
Anthropic reményei szerint ezek az együttműködések és a javasolt iparági keretrendszer később szabályozási alapként is szolgálhatnak, amelyek átlátható folyamattal biztosítják a kibervédelmi szakértők és más érintettek hozzáférését a nagy képességű modellekhez.
Záró megjegyzés
Anthropic megköszöni a felhasználók türelmét a szolgáltatáskiesés alatt, és köszönetet mond a kutatóknak és ipari partnereknek, akik közreműködtek abban, hogy a Fable 5 és a Mythos 5 visszaállítható legyen. A cég folytatja a védelmi mechanizmusok finomhangolását és a kormányzati együttműködések kiterjesztését.



