Biztonság

Mesterséges intelligenciával generált szöveg

Külsős munkatársak is áttekintik ChatGPT-beszélgetéseket, adatvédelmi kockázatok merülnek fel

A hír főszereplője az OpenAI és a ChatGPT használata közben keletkező felhasználói üzenetek kezelése.

Külsős munkatársak is áttekintik ChatGPT-beszélgetéseket, adatvédelmi kockázatok merülnek fel

Leaked dokumentumok és egy névtelenséget kérő alvállalkozó elmondása szerint az OpenAI több száz külsős munkatársat alkalmaz, hogy átnézzenek felhasználói ChatGPT-promptokat és a chatbot válaszait. A 404 Media cikke szerint a szolgáltatók óránként hozzávetőleg 50 dollárt kapnak a munkáért, amely során kortól, témától függetlenül bárki üzenetei kerülhetnek ezek elé.

Hogyan zajlik az értékelés

Az alvállalkozók a 404 Mediának átadott oktatóanyagok alapján megtanulják, hogyan kell értelmezni egy promptot, javaslatot adni arra, hogyan kellene a chatbotnak válaszolnia, majd a valós választ több szempont alapján pontozni. A dokumentumok szerint a folyamat része, hogy a munkavállalók négy lehetséges ChatGPT-választ látnak, és kiválasztják, melyik tart a helyes irány felé, illetve melyik nem. A válaszokat 1-től 7-ig értékelik (1 a legrosszabb, 7 a legjobb), és minden döntést rövid indoklással kell alátámasztaniuk.

Az oktatóanyagokban szerepel, hogy az ideális válasz érti a felhasználó szándékát, segítőkész és pontos, természetes, megfelelő hangvételű, és kevésbé „talpnyaló” legyen, mint a korábbi verziók. A dokumentumokban példák is vannak: az egyik ellenőr például a pipaemodzsi (✅) használatát indokolatlannak tartotta egy válaszban.

Személyes és érzékeny adatok kockázata

Az OpenAI a 404 Media kérdéseire azt közölte, hogy az emberek számára átadott üzenetekből igyekeznek eltávolítani minden beazonosításra alkalmas információt, és az alvállalkozók nem látják közvetlenül a promptot küldő felhasználó nevét. Ugyanakkor a cég elismerte, hogy rendszerhibák előfordulhatnak, és időnként személyes adatok így is megjelenhetnek az ellenőrök előtt.

A cikk kiemeli, hogy még akkor is előfordulhat ilyen megosztás, ha a felhasználó kifejezetten kéri a chatbotot, hogy tartsa meg bizalmasnak az információt; tehát semmilyen felhasználói beírás esetében nincs teljes biztonsági garancia arra, hogy idegenek nem láthatják az adatokat.

Project Lily és a munkaszervezet

A dokumentumokban szereplő oktatási anyagokból nem derül ki egyértelműen, melyik modell fejlesztését szolgálja a munka; a folyamat azonban Project Lily kódnéven fut. Egy a 404 Mediának nyilatkozó ellenőr elmondta, hogy ő a Crossing Hurdles nevű munkaközvetítőn keresztül találta meg a hirdetést, de végső alvállalkozóként a Mercorral szerződött.

A forrás arról számolt be, hogy a munka gyakran monoton és ismétlődő, a vezetői iránymutatások pedig változékonyak, néha ellentmondásosak.

Adatkezelési beállítások és megtartási idő

Az OpenAI közlése szerint, ha egy felhasználó törli a beszélgetési előzményeit, a cég 30 napon belül törli azokat — kivétel, ha az üzeneteket korábban anonimizálták és alkalmasnak találták a modellek fejlesztésére. A felhasználók csak akkor akadályozhatják meg, hogy beszélgetéseiket a modell fejlesztésére használják, ha a beállításokban kikapcsolják ezt az opciót; ez azonban csak a módosítás után létrejövő csetekre érvényes. A beállítás alapértelmezés szerint be van kapcsolva az ingyenes, a Plus és a Pro előfizetések esetén, míg a céges és oktatási ügyfeleknél alapból ki van kapcsolva.

Ilyen gyakorlat más cégeknél

Az OpenAI nem az egyetlen olyan vállalat, amelynél emberek is átnézik MI-vel készített üzeneteket: a Google is bevallotta, hogy bizonyos üzeneteket a Gemini számára emberek ellenőriznek, és ezt jelzik a felhasználóknak. Az Anthropic szintén elismerte, hogy a Claude üzeneteit emberi felülvizsgálók nézik át, de náluk ez csak azoknál történik meg, akik külön engedélyezik ezt a beállításban.

Miért számít ez?

A gyakorlat rávilágít arra, hogy a korszerű nyelvi modellek fejlesztésében és minőségellenőrzésében az emberi munka továbbra is központi szerepet játszik, ugyanakkor adatvédelmi és etikai kérdéseket vet fel: a felhasználók sokszor nincsenek egyértelműen tájékoztatva arról, hogy ki és mikor férhet hozzá a beszélgetéseikhez, illetve hogy az adatok meddig maradhatnak a rendszerben. Az érintett vállalatok kommunikációja és beállításai ezért meghatározóak a felhasználói bizalom fenntartásához.

A cég válasza

Az OpenAI rövid válaszában hangsúlyozta, hogy céljuk eltávolítani a beazonosításra alkalmas információkat a felülvizsgálatra küldött szövegekből, de egyúttal elismerték a rendszerhibák lehetőségét. A vállalat részletesebb tájékoztatása a felhasználói értesítés gyakorlatairól a cikkben megadott források szerint nem teljes körű.