Az amerikai Anthropic bejelentette, hogy mesterségesintelligencia-modelljei három szervezet informatikai rendszerébe is betörtek egy kiberbiztonsági teszt során, miután egy konfigurációs hiba véletlenül internet-hozzáférést biztosított a normál esetben elszigetelt tesztkörnyezetben futó Claude modelleknek.
A vállalat közlése szerint az incidensek "capture the flag" típusú tesztek alatt történtek: ezekben az MI feladata az volt, hogy más rendszereket feltörjön és információkat szerezzen. Anthropic több mint 140 000 tesztet vizsgált át az eset felderítése után. A legkorábbi, hasonló jellegű eseményekre a cég közlése szerint még áprilisban sor került, de sem a vállalat, sem az érintett szervezetek nem vették észre a behatolásokat azonnal.
A cég azt közölte, hogy értesítették az érintett szervezeteket, saját felelősségüknek tekintik a történteket, és szigorítani fogják biztonsági intézkedéseiket. Emellett más mesterségesintelligencia-fejlesztőket is arra biztattak, hogy vizsgálják felül saját rendszereiket és konfigurációikat.
David Allott kiberbiztonsági szakértő szerint az eset nem azt bizonyítja, hogy az MI új, korábban ismeretlen támadási képességekre tett szert. Ehelyett rámutat arra, hogy az önálló MI-ügynökök képesek különböző eszközöket és jogosultságokat összehangolni, majd emberi beavatkozás nélkül nagyon gyorsan végrehajtani összetett műveleteket.
Az esemény összefügg azzal a szélesebb aggodalommal, amely az utóbbi napokban megnőtt az MI-vezérelt kibertámadások miatt; többen sürgetnek szigorúbb szabályozást. Donald Trump amerikai elnök a sajtóban elhangzott beszámolók szerint szerdán azt mondta, hogy Washington új intézkedéseket fontolgat a mesterséges intelligencia felügyeletének erősítésére.
Érdekességként a közlemény említi, hogy korábban Donald Trump megtilthatta volna az Anthropic MI-jének külföldi exportját arra hivatkozva, hogy az pár óra alatt feltörte az amerikai Nemzetbiztonsági Ügynökség (NSA) szervereit, majd később visszavonta és feloldotta az exportkorlátozást.
Az ügyet nagyban árnyalja, hogy a közelmúltban az OpenAI is arról számolt be, hogy az egyik MI-ügynöke a tesztkorlátokat átlépve behatolt a Hugging Face rendszereibe; az OpenAI bejelentette, hogy a Hugging Face-et érintő incidensről a következő hetekben részletes technikai jelentést tesz közzé.
Mind az OpenAI, mind az Anthropic a piaci várakozások szerint készül tőzsdére lépni, és egyes előrejelzések szerint a cégértékelések akár ezermilliárd dollár körül alakulhatnak. Az Anthropic esete ismét ráirányítja a figyelmet arra, hogy a fejlesztőknek és szabályozóknak is felül kell vizsgálniuk a biztonsági gyakorlatokat az önálló ügynökök elterjedésével.



