Szabályozás

Mesterséges intelligenciával generált szöveg

Anthropic Claude szövegvízjelekkel és fájlmetadatokkal jelöli a mesterséges intelligencia által előállított tartalmat

Az Anthropic bejelentette, hogy új Claude modellek géppel olvasható „vízjeleket” és fájlmetaadat-aláírásokat helyeznek el a generált szövegekben és fájlokban, hogy megfeleljenek az Európai Unió átláthatósági követelményeinek.

Anthropic Claude szövegvízjelekkel és fájlmetadatokkal jelöli a mesterséges intelligencia által előállított tartalmat

Az Anthropic bejelentette, hogy új modelljei géppel olvasható jeleket helyeznek el a Claude nevű nyelvi modell által előállított szövegben és fájlokban, hogy megfeleljenek az Európai Unió átláthatóságra vonatkozó követelményeinek. A változtatás a vállalat közlése szerint vonatkozik minden olyan modellre, amelyet az EU-ban indítanak el 2024. augusztus 2. után, de az alkalmazás „mindenütt, ahol Claude elérhető, világszerte” történik.

Mit jelentenek a jelölések?

Az Anthropic kétféle megoldást alkalmaz: egyrészt a szövegbe „vízjelet” ágyaz, másrészt a generált médiafájlokhoz digitális aláírást csatol.

  • Szövegvízjelek: a cég szerint a Claude által generált szövegbe olyan mintázatokat illesztenek, amelyek emberi olvasás szempontjából észrevehetetlenek, de géppel felismerhetők.
  • Fájlmetaadatok: a képekhez, hangfájlokhoz vagy más médiatípusokhoz olyan digitális aláírás kerül, amely igazolja, hogy az adott elemet a Claude feldolgozta.

Miért fontos ez?

A jelölési megoldás célja megfelelni az EU által előírt átláthatósági követelményeknek, különösen az EU AI Act 50. cikke által meghatározott kötelezettségeknek, amelyek előírják, hogy az AI által létrehozott vagy módosított tartalmak esetén tájékoztatni kell a közönséget.

Ez különösen jelentős lehet kommunikációs csapatok számára: például ha egy vállalat a Claude-t használja ember által írt sajtóközlemények egyszerű javítására, fordítására vagy formázására, ezek a dokumentumok akkor is kaphatnak olyan AI-jelzést, amely utal az automatizált beavatkozásra.

Korlátok és figyelmeztetések

Az Anthropic kiemelte a jelölési technológia két fő korlátját:

  • Hamis pozitívok lehetősége: egy szöveg akkor is AI-eredetinek jelezhető, ha a Claude-t csupán lektorálásra, formázásra vagy fordításra használták emberi szerzőtől származó tartalom esetén.
  • Érzékelhetőség csökkenése: ha a generált szöveget erősen átírják, más forrásokkal keverik, vagy a szöveg túl rövid, a vízjelek felismerése nehezebbé válhat, és előfordulhat, hogy a jel már nem detektálható.

Szélesebb kontextus

Az Anthropic lépése hasonló irányvonalat tükröz, mint más nagy szereplők és platformok törekvései az AI-felismerhetőség növelésére. Az OpenAI is ismertette megfelelési terveit; jelenleg az ő vízjelezési erőfeszítéseik inkább képekre és hangra fókuszálnak, nem annyira a szövegre.

Digitális platformok is gyorsították az AI-azonosítás bevezetését: a LinkedIn tesztel egy „seems like AI slop” gombot, a Substack beépítette a Pangram AI-detekciós csomagját, és a Snap leállította az AI-generált videók fő hírfolyamban való promótálását.

Mi következik?

Az AI-szolgáltatóknak 2024. december 2-ig van idejük, hogy a korábbi (legacy) modelljeiket is összhangba hozzák az EU szabályaival. Ez azt jelenti, hogy a következő hónapokban tisztább képet kaphatunk arról, miként jelölik majd a legnagyobb iparági szereplők az AI által előállított vagy módosított tartalmakat.

Összességében az Anthropic bejelentése a szabályozói nyomással motivált elmozdulást jelzi az átláthatóbb AI-tartalom felé, miközben maga a technológia felismerhetőségi és alkalmazhatósági korlátokkal küzd.