Biztonság

Mesterséges intelligenciával generált szöveg

Anthropic: kínai MI-cégek titokban a Claude válaszait használták saját modellek fejlesztésére

Az amerikai Anthropic egy jelentésében azzal vádolja a kínai Moonshot, Deepseek és Xiaomi nevű vállalatokat, hogy a hozzájuk érkező felhasználói kéréseket titokban az Anthropic Claude nevű nyelvi modelljéhez továbbították.

Anthropic: kínai MI-cégek titokban a Claude válaszait használták saját modellek fejlesztésére

Az amerikai Anthropic egy új jelentésében azzal vádolja kínai mesterségesintelligencia-vállalatokat, hogy a hozzájuk érkező felhasználói kérdéseket titokban továbbították az Anthropic csetbotjához, a Claude nevű nyelvi modellhez, és annak válaszait felhasználva fejlesztették saját rendszereiket.

Kik szerepelnek a vádban?

A Bloomberg tudósítása szerint az Anthropic elsősorban a Moonshot nevű kínai cég ellen emelt vádat; a jelentés azt állítja, hogy a Moonshot a hozzá beérkező lekérdezéseket a felhasználók tudta nélkül átirányította a Claude-hoz, ahelyett hogy a saját modelljével válaszolt volna. Az Anthropic szerint a Deepseek és a Xiaomi is folytatott hasonló tevékenységet.

Hogyan működött az állítólagos módszer?

Az Anthropic szerint, mivel a cég nem engedélyezte a közvetlen hozzáférést a Claude-hoz Kínából, a Moonshot 5,4 ezer hamis fiókot használt, amelyek túlnyomó része a jelentés szerint Szingapúrból és Japánból indult. A vállalat azt állítja, hogy tíz nap alatt összesen 300 ezer lekérdezés érkezett tőlük a Claude-hoz.

A jelentés a „desztilláció” nevű technikát írja le: ilyenkor egy gyengébbnek tartott modell fejlesztői egy erősebb rivális modell által adott válaszokból próbálják kinyerni azokat a gondolatmeneteket és belső információkat, amelyek alapján a rivális modell a válaszát összeállítja. Az Anthropic szerint ők általában nem szolgáltatják a modellek belső gondolkodási folyamatát, hanem összefoglalt blokkokban válaszolnak — a támadók azonban állítólag találtak olyan módszert, amellyel a Claude-ot a belső lánca felfedésére késztették.

A jelentés szerint a támadók a csetbotot úgy jártatták körbe, hogy a feladatot fordításnak álcázták: a Claude-t arra kérték, hogy "fordítsa le" a korábbi munkamemóriáját pontos, kizárólag katakanából álló japán nyelvre, ami lehetővé tette a belső gondolatok kivonatolását.

Mekkora volt a kampányok skálája?

Az Anthropic összesen közel 200 millió desztillációs támadást észlelt, amelyeket öt különböző kampányba soroltak. A jelentés szerint a legtöbb lekérdezés valójában nem a Moonshottól, hanem az Alibaba nevű kínai óriásvállalattól érkezett: állításuk szerint 2026 májusa és júliusa között az Alibaba 151 millió kérdést intézett a Claude-hoz saját Qwen modellje fejlesztése céljából. Ebben a kampányban a jelentés szerint 3,5 különböző fiókról érkeztek a kérések, de mivel mindegyik ugyanazt a promptot használta a gondolatmenet kinyeréséhez, az Anthropic ezeket ugyanahhoz a kampányhoz kötötte.

Kockázatok és visszatartott esetek

A BBC szerint az Anthropic jelentése több olyan esetet is dokumentál, ahol a Claude-ot rosszindulatú célokra próbálták volna kihasználni. A vállalat úgy találta, hogy öt olyan esetet akadályoztak meg, amelyekben a modellt biológiai fegyverek fejlesztésére próbálták volna használni; hat esetben pedig hagyományos fegyverek — például rakéták, fegyveres drónok, bombák — és az ezeket vezérlő szoftver fejlesztése volt a cél. Emellett a jelentés szerint a Claude-ot egy Oroszországhoz kötődő kiberkémkedési kampány és egy iráni propagandaszervezet is felhasználta.

Nemzetközi reakciók

Az ügy amerikai-kínai feszültségbe illeszkedik: korábban amerikai kormányzati szervek is azzal vádolták a kínai MI-vállalatokat, hogy szisztematikusan alkalmazzák a desztillációt amerikai cégek adataira. A kínai kereskedelmi minisztérium visszautasította a vádakat, mondván, hogy nincsenek ténybeli vagy jogi alapjai, és azzal fenyegetőzött, hogy ellenintézkedéseket vezet be, ha az Egyesült Államok lépéseket tesz a kínai MI-vállalatok visszaszorítására.

Kontextus: belső aggodalmak az MI-kutatásban

A jelentés megjelenését megelőző két napon belül Jacob Coxon, az Anthropicot elhagyó MI-kutató nyilvánosan arról beszélt, hogy kollégái szerint a következő egy-két évben a fejlett MI-rendszerek képesek döntő hatást gyakorolni az emberiség sorsára. Coxon szerint a gyors MI-fejlődés felülírhatja a meglévő biztonsági intézkedéseket; állítása szerint több Anthropic- és OpenAI-kutató hasonlóan aggódik, és egyes kollégái 10 százalék feletti esélyt adnak annak, hogy az előrehaladott MI a következő évtizedben az emberiség kipusztulásához vezethet.

Összegzés

Az Anthropic jelentése szerint a desztillációs technikák alkalmazása és a rivális modellekből történő adatkinyerés jelentős mennyiségben, szervezett kampányok keretében zajlott. A vádak és a detektált esetek újabb jelét adják annak a globális versenynek és biztonsági aggálynak, amely a nagyméretű nyelvi modellek fejlesztésével és használatával kapcsolatosan fennáll.