Eszközök

Mesterséges intelligenciával generált szöveg

OpenAI bemutatja szövegvízjelzéshez alapul szolgáló megközelítését az EU AI Act teljesítésére

Az OpenAI bejelentette textGrain nevű szövegvízjel-technológiáját és annak fokozatos bevezetését az EU AI Act követelményeinek teljesítése érdekében.

OpenAI bemutatja szövegvízjelzéshez alapul szolgáló megközelítését az EU AI Act teljesítésére

OpenAI részletesen ismertette azt a fokozatos megközelítést, amellyel a vállalat a szöveghez kapcsolódó tartalomproveniencia (content provenance) követelményeinek eleget kíván tenni az EU AI Act értelmében. A cég hangsúlyozza, hogy a szövegvízjelzés és detektálás még korai technológiák, amelyeknek jelentős korlátai vannak, ezért a bevezetés óvatos, átlátható lépésekben történik.

Mire kötelez az EU AI Act és mit tesz erre OpenAI?

Az EU AI Act előírja, hogy a generatív AI-szolgáltatók géppel olvasható módon tegyék felismerhetővé a generált szöveget. OpenAI ennek megfelelően olyan megoldást ismertetett, amely egy láthatatlan, statisztikai jelzést (vízjelet) ad a modell szóválasztásához; ezt a megközelítést textGrain néven jelölték meg.

Kulcslépések, amelyekről a cég tájékoztatott:

  • API-ügyfelek világszerte ma kezdve választhatnak: bizonyos modellek esetén bekapcsolható lesz a szövegvízjelzés. Az API-ban alapértelmezés szerint a vízjelzés kikapcsolt marad.
  • Az elkövetkező hetekben az Európai Unióban jogosult ChatGPT és Codex kimenetekbe láthatatlan vízjelet fognak beágyazni.
  • A vízjel-detektorhoz hozzáférési kérelmeket nyitnak meg; az első körben jóváhagyott kutatók és szakértő szervezetek férhetnek hozzá, hogy segítsék a technológia értékelését és fejlesztését.

Hogyan működik a textGrain és milyen korlátai vannak?

A textGrain egy olyan módszer, amely egy láthatatlan statisztikai mintát ültet a modell által választott szavak eloszlásába. A detektor ezt a mintát keresi, és döntést ad arról, hogy egy szakaszban van-e OpenAI-vízjel.

OpenAI közzétett egy technikai riportot a részletekről, amelyet a közeljövőben bővíteni fognak, és jelezték, hogy a technológiát később nyílt forrásként is elérhetővé tehetik.

A cég saját értékelései szerint a textGrain a tesztelt megközelítések között legalább vetélytársaival egy szinten teljesített, de a valós használatban a megbízhatóság nem garantált. Konkrét eredmények a vállalat bemutatása alapján:

  • Rövidebb vagy kevésbé rugalmas nyelvű szövegek nehezebben detektálhatók: célzott 1%-os hamis pozitív arány mellett a detektor nagyjából 80%-ban találta meg a vízjelet 200 tokenes szakaszoknál, míg 400 tokenes szakaszoknál körülbelül 95%-os volt az észlelés egyes témáknál (például pszichológia). Matematikai tartalom esetén, ahol kevesebb a szóválasztás szabadsága, az észlelés lényegesen alacsonyabb volt.
  • Szerkesztés gyengíti a vízjelet: 400 tokenes szakaszokon a szavak 10%-ának szinonimákkal való helyettesítése a detektálhatóságot nagyjából 92%-ról 66%-ra csökkentette; 25%-os helyettesítésnél az észlelés 17%-ra esett vissza.

Ezek a korlátok magyarázzák, miért korlátozzák először csak jóváhagyott kutatók és szakértők hozzáférését a detektorhoz: ők segíthetnek a megbízhatóság és a felelős használat feltérképezésében.

Mit nem jelent egy talált vagy nem talált vízjel?

OpenAI világosan felsorolta, hogy milyen következtetések nem vonhatók le kizárólag a vízjel-észlelés alapján:

  • A vízjel nem méri az emberi hozzájárulás mértékét: jelezheti, hogy egy OpenAI-rendszer generálta vagy feldolgozta a szöveg egy részét, de nem mutatja, mennyi emberi szerkesztés vagy kreativitás volt benne.
  • A vízjel nem állapítja meg a tulajdonjogot vagy a felelősséget, és nem dönt a törvényességről vagy a közzétételi kötelezettségről.
  • A vízjel nem azonosít felhasználót, szervezetet, fiókot, promptot vagy beszélgetést.
  • A vízjel nem igazolja az állítások helyességét vagy megbízhatóságát.
  • A mérési hiány nem bizonyítja az emberi szerzőséget: a szöveg lehet túl rövid, túl szerkesztett vagy lefordított ahhoz, hogy a detektor működjön; származhat más, nem támogatott modellből, vagy azelőtt készült, hogy bevezették volna a vízjelezést.

Részletek a bevezetésről és a többrétegű megközelítésről

  • EU-specifikus bevezetés: az elkövetkező hetekben az Európai Unióban jogosult ChatGPT és Codex felhasználóknál élesítik a text vízjelezést minden csomagban. Ezt a bevezetést nem terjesztik ki globálisan alapesetben az induláskor; a regionális megközelítés lehetővé teszi, hogy a valós világban szerzett visszajelzések alapján finomítsanak.
  • API opt-in: API-ügyfelek világszerte ma kezdve dönthetnek a bekapcsolásról bizonyos modellekre vonatkozóan. OpenAI felkészül arra is, hogy a felhőpartnerekkel együttműködve a következő hetekben ezek a lehetőségek a partnerek szolgáltatásain keresztül is elérhetők legyenek.
  • Detektor-hozzáférés: a kutatók és szakértő szervezetek ma kezdve kérvényezhetik az eszközhöz való hozzáférést; a kéréseket eseti alapon bírálják el, a hozzáférés alapvetően a technológia értékelését és fejlesztését szolgálja. A detektor visszajelzése annyit ad: talált-e OpenAI-vízjelet vagy sem, anélkül hogy felhasználókat, promptokat vagy beszélgetéseket azonosítana.

OpenAI hangsúlyozza, hogy a megközelítésüket folyamatosan felülvizsgálják, ahogy a technológia, a szabványok és a bizonyítékok fejlődnek.

Ezt a text-szintű megoldást a cég a már meglévő képi és hangbeli provenienciaeszközökkel kombinálja: támogatja a Content Credentials beágyazását a képeknél, C2PA-nek megfelel, beágyaz láthatatlan SynthID vízjeleket képekbe és hangfájlokba, és továbbra is elérhetővé teszi az openai.com/verify webes eszközt és a Content Provenance API-t. A több rétegű megközelítés célja, hogy a különböző technikák kiegészítsék egymást, például amikor a metaadatok eltűnnek, az invisibilis vízjelek megőrizhetnek egy jelet.

További kísérletek és célok

OpenAI tervezi folytatni a detektálás fejlesztését, tanulmányozni, hogyan érik túl a vízjelek a szerkesztést és a fordítást, és keresni módszereket az AI-segítség és az AI-szerzőség pontosabb megkülönböztetésére. A cég azt is jelezte, hogy a technológia nyílt forrásúvá tétele és a technikai jelentés bővítése része a jövőbeni lépéseknek. A részletes technikai információkért OpenAI a súgócikkre és a műszaki jelentésre hívja fel az érdeklődők figyelmét.

A bejelentés célja, hogy átláthatóságot növeljen a technológia jelenlegi határain belül, miközben figyelembe veszi a hibalehetőségeket és a felelős alkalmazás szükségességét.