Biztonság

Konfigurációs hiba miatt OpenAI- és Anthropic-modellek élő internethez fértek hozzá harmadik fél tesztelése során

A főszereplők az OpenAI, az Irregular nevű külső kiberbiztonsági tesztelő partner és az Anthropic, valamint érintettként a UK AI Safety Institute.

Konfigurációs hiba miatt OpenAI- és Anthropic-modellek élő internethez fértek hozzá harmadik fél tesztelése során

Harmadik fél által végzett kiberbiztonsági tesztek során OpenAI és Anthropic modellek élő internethez férhettek hozzá egy Irregular nevű tesztpartner által kialakított, rosszul konfigurált környezet miatt. Egyes esetekben a CTF‑szerű (Capture‑the‑Flag) gyakorlatokhoz használt fiktív célpont neve megegyezett egy valós domainnévvel, és a modell a publikus weboldalt használta fel a feladat megoldásához, mivel a tesztkörnyezet nem volt megfelelően elszigetelve.

Mi történt

Az Irregular nevű külső kiberbiztonsági tesztelő partner fogta össze és futtatta a Capture‑the‑Flag‑szerű értékeléseket, amelyeket a megrendelők elvárása szerint internetkapcsolattól független, izolált környezetben kellett volna végrehajtani. A gyakorlatok közben azonban egy tesztkörnyezet‑konfigurációs hiba miatt a modellek hozzáférést kaptak a nyilvános internethez. Egy konkrét vizsgálatban a fiktív célpont neve véletlenül azonos volt egy valós domainnévvel; mivel a környezet kapcsolódott az internethez, a modell felhasználta a valós weboldalt, azt gondolva, hogy az a szimuláció része.

A probléma mind az OpenAI által használt modelleket, mind az Anthropic Claude modelljét érintette: Anthropic beszámolója szerint az Irregular által hosztolt, hibásan konfigurált értékelési környezeten keresztül Claude is élő internethez jutott néhány teszt során. OpenAI ugyanígy jelezte az incidenseket saját közleményében, megemlítve több, harmadik fél által végzett értékelést, köztük a UK AI Safety Institute‑tal kapcsolatos korábbi esetet.

Miért számít ez

Ezek az események rávilágítanak arra, hogy a red‑team és más külső biztonsági tesztek során a környezetek helyes elszigetelése kritikus. Ha a modellek hozzáférnek a valós internethez tesztelés közben, valós rendszerekhez intézett kísérleti kérések vagy adatkinyerés történhet, ami váratlan vagy nem kívánt hatásokat eredményezhet. Különösen kockázatos, ha a szimuláció és a valós szolgáltatás között névütközés fordul elő.

Következmények és ajánlások

A nyilvánosságra hozott leírások szerint a hibát a konfigurációs beállítások felülvizsgálatával és a tesztkörnyezetek szigorúbb elszigetelésével lehetett volna megelőzni. A tapasztalatok alapján a következők javasolhatók:

  • Merevebb szabályok és ellenőrzések a külső tesztpartnereknél a hálózati hozzáférésre vonatkozóan.
  • Tesztadatok és fiktív domének előzetes ellenőrzése, hogy elkerüljék a valós domainnevekkel való ütközést.
  • Rendszeres audit és független ellenőrzés a tesztkörnyezetek konfigurációjára.

Következő lépések

A résztvevő szervezetek — köztük Irregular, OpenAI és Anthropic — dokumentálták az eseményeket, és intézkedéseket jeleztek a hasonló események megelőzésére. Az eset újra felhívja a figyelmet a harmadik féllel végzett biztonsági tesztelések speciális kockázataira, és arra, hogy a mesterséges intelligencia rendszerek tesztelési folyamataiban különös gondot kell fordítani az elszigetelésre és a környezeti konfigurációk ellenőrzésére.