Az OpenAI bemutatta a Private Safety Processing (PSP) előzetes verzióját, amely arra szolgál, hogy a felhasználói interakciók közötti mintázatokat azonosítva erősítse a biztonsági intézkedéseket anélkül, hogy az OpenAI munkatársai hozzáférnének a mögöttes tartalomhoz. A bejelentés hangsúlyozza, hogy a megoldás kompatibilis marad a Zero Data Retention (ZDR) elvvel.
Mi az a Zero Data Retention (ZDR)?
A Zero Data Retention ígérete szerint jogosult API-ügyfelek esetében az OpenAI nem őrzi meg a kérések feldolgozása után a promptokat vagy a modellválaszokat. A vállalat szerint az ügyfél-tartalom nem érhető el áttekintésre az OpenAI munkatársai számára, és vállalati ügyfelek adatait nem használják fel modellek betanítására, kivéve ha az ügyfél kifejezetten hozzájárul.
Miért van szükség szélesebb kontextusra a biztonságban?
Az OpenAI szerint a legsúlyosabb kockázatok gyakran nem láthatók egyetlen interakcióból. Veszélyes szándékok vagy visszaélések több egymást követő interakcióból válnak egyértelművé, például amikor rossz szereplők többször próbálkoznak a védelmi rendszerek feltérképezésével, fiókok között koordinálnak, vagy álcázzák a fenyegetéseket rutinszerű kutatásnak. Hasonlóan, egy agentikus feladat során a rendszer hosszabb ideig tartó tevékenysége során kialakuló eltolódások — például ha a rendszer tovább cselekszik, miután megkérték a leállásra — idővel kockázatot jelenthetnek.
Az ilyen, több interakcióra kiterjedő kontextus fontos az érdemi tevékenység és a visszaélés megkülönböztetéséhez, valamint annak biztosításához, hogy az AI-ügynökök a szándékolt hatáskörön belül maradjanak.
Hogyan működik a Private Safety Processing?
A Private Safety Processing kiterjeszti a ZDR-kompatibilis automatikus védelmi rendszerek képességeit úgy, hogy összefüggő interakciók során keres mintázatokat, ugyanakkor megakadályozza, hogy OpenAI-munkatársak hozzáférjenek az elzárt ügyfél-tartalomhoz. A megoldás mindkét tárolási modell mellett működik:
- ZDR telepítések esetén az ügyfél tartalma az ügyfél által felügyelt infrastruktúrán marad.
- Az OpenAI által biztosított tárolás választása esetén a tartalom titkosítva kerül, és a titkosítási kulcsokat az ügyfél kezeli; az OpenAI személyzete nem rendelkezik azok másolatával, így nem fér hozzá a nyers tartalomhoz.
Automatizált rendszerek azonosíthatnak potenciális visszaélést és egy szűkített biztonsági jelet szolgáltathatnak az OpenAI számára anélkül, hogy a promptokat vagy válaszokat hozzáférhetővé tennék. Amikor kockázatot jeleznek, az OpenAI csak a tevékenység típusát leíró, szigorúan meghatározott jelzést kap, amely alapján meg lehet vizsgálni, szükséges-e intézkedés.
Ügyfél-kezdeményezett vizsgálat és együttműködés
Az érintett ügyfelek a saját rendszereikben érhető információk alapján vizsgálhatják az riasztásokat és az esetleges intézkedéseket. Ha az ügyfél fellebbezni, tisztázni kívánja a jogos tevékenységet, vagy támogatni akarja egy visszaélés kivizsgálását, saját döntése alapján megoszthat releváns adatokat az OpenAI-val.
Tesztelés, ügyfélvisszajelzés és tervezett bevezetés
A Private Safety Processing jelenleg korai ügyfeleknél van tesztelés alatt. Az OpenAI azért osztotta meg előzetesen a megoldást, mert ügyfelei világosan jelezték: nagyobb kiszámíthatóságra van szükségük az adatvédelemre vonatkozóan, ahogy az AI-rendszerek képességei növekednek.
Az OpenAI azt közölte, hogy szeptemberben kezdi a Private Safety Processing bevezetését, és ugyanakkor műszaki fehér könyvet is megoszt. A vállalat ígéri, hogy az ügyfeleket folyamatosan tájékoztatja, részletezi, hogyan érinti ez a meglévő kötelezettségvállalásokat, és lehetőséget ad a tervezésre.
Jogszabályi kötelezettségek és kivételek
Az OpenAI megjegyzi, hogy más nagy modelleket kínáló szolgáltatókhoz hasonlóan jogi kötelezettsége van a feltételezett gyermekpornográf tartalom (CSAM) bejelentésére. Az ilyen célból képek, amelyek CSAM gyanúját vetik fel, továbbra is megőrzésre kerülnek manuális ellenőrzés és jelentés céljából, még a Zero Data Retention telepítések esetén is.
Ügyfélidézet
„Enterprise AI adoption depends solely on customer control of data, with no direct or derivative use beyond the chosen service. OpenAI’s no-training commitment and ZDR give Glean confidence to build with OpenAI. As models become more capable, OpenAI shows safety can advance without compromising the privacy and control that sustain enterprise trust.”
— Sunil Agrawal, Chief Information Security Officer, Glean
Összegzés
A Private Safety Processing célja, hogy lehetővé tegye a többinterakciós mintázatok automatikus felismerését anélkül, hogy az OpenAI személyzete hozzáférne az ügyfél-tartalomhoz, és így fenntartsa a ZDR ígéretét. A megközelítés technikai és működési részleteit az OpenAI ügyfelekkel és partnerekkel együtt alakítja tovább.



