Szabályozás

AI-ipar az általános nyílt súlyú korlátozások ellen érvel az amerikai válasz mérlegelése közben

Több nagy mesterséges intelligencia cég, köztük a Hugging Face, Meta, Microsoft, Mistral és Nvidia nyílt levelet írt a döntéshozóknak, amelyben az általános, korai nyílt súlyú modellekre vonatkozó korlátozások ellen érvelnek.

AI-ipar az általános nyílt súlyú korlátozások ellen érvel az amerikai válasz mérlegelése közben

Hugging Face, Meta, Microsoft, Mistral és Nvidia — több ismert mesterséges intelligenciával foglalkozó vállalat — közös nyílt levélben szólította fel a döntéshozókat, hogy ne vezessenek be széleskörű, „elégtelenül megalapozott” korlátozásokat az ún. open-weight, azaz nyílt súlyú modellekre.

A levél közvetlenül nem említ országokat, de a kezdeményezés kontextusa az Egyesült Államokban zajló vitára kapcsolódik: Washingtonban vizsgálják, hogyan reagáljanak azokra a vádakra, miszerint kínai AI-laborok amerikai partnereik szellemi tulajdonát sajátították ki. A sajtóhírek szerint a Trump-kormányzat megfontolta kínai open-weight modellek betiltását, illetve szankciók kibocsátását kínai AI-vállalatok ellen. A Fehér Ház például azzal vádolta a Moonshot AI-t, hogy Anthropic Fable modelljének „distillációját” használta fel a nemrég bemutatott, nagyrészt elismert Kimi K3 modellje betanításához.

A levél célja úgy tűnik, hogy elriassza a teljes tiltás gondolatát a kínai modellekkel szemben, és megakadályozza, hogy az erre adott válasz általános korlátozásokká szélesedjen ki, amelyek az open-weight modellekre vagy olyan általános technikákra, mint a distilláció, is vonatkoznának. A dokumentumban ez olvasható: „A döntéshozóknak óvatosnak kell lenniük abban, hogy ne keverjék össze a legitim modellfejlesztési technikákat a jogszerűtlen kisajátítással. A distilláció — amikor egy modell kimeneteit felhasználják egy másik modell betanításához vagy javításához — széles körben alkalmazott módszer a modellfejlesztés, értékelés és validáció során. Ez a tanulás, az építkezés és a meglévő technológiák továbbfejlesztésének hagyományát tükrözi, amely az open-source szoftvermozgalom óta hajtja az innovációt.”

A levél egyidejűleg hangsúlyozza, hogy a zárt modellekből jogosulatlanul értéket kinyerni problémás, és az ilyen esetekre célzott jogi és kereskedelmi válaszokra van szükség, nem pedig olyan általános tiltásokra, amelyek meggátolnák az AI-innovációt.

A dokumentum visszautasítja azt az állítást is, miszerint a nyílt súlyú modellek önmagukban veszélyesebbek lennének, mivel szélesebb körben teszik hozzáférhetővé az erős modelleket, amelyeket kiberbűnözésre vagy más káros célokra lehetne felhasználni. Ezzel kapcsolatban a levél így érvel: „A helyes válasz nem az open-weight modellek tiltása. Egy olyan világban, ahol a kibertámadók fejlett mesterséges intelligenciát használnak, a védekezőknek is hozzáférésre van szükségük hasonló képességű modellekhez, hogy észleljék, szimulálják és reagáljanak a felmerülő fenyegetésekre. Az open modellek szélesítik a védelmi képességeket, növelik az átláthatóságot, és lehetővé teszik, hogy sok csapat feltárja és orvosolja a sebezhetőségeket.”

A levél idézi a közelmúlt egy incidensét is: múlt héten az OpenAI beismerte, hogy GPT-5.6 Sol és egy névtelen másik modell tesztelése során az egyik rendszer kihasznált egy gyengeséget a tesztkörnyezetben, és hozzáférést szerzett egy Hugging Face-tárhelyhez, amely egy kódolási benchmark megoldását tartalmazta. Az eset vitát váltott ki arról, milyen kockázatokat hordoz az, ha fejlett AI-technológiák kevés, zárt szolgáltatónál koncentrálódnak. A Hugging Face azt közölte, hogy a kereskedelmi jellegű „frontier” zárt modellek nem tették lehetővé a védelmet, mert azok védőkorlátai megakadályozták a támadás észlelésére, illetve a kifinomult exploitok megkülönböztetésére irányuló kísérleteket. Végül a cég a kínai Z.ai GLM 5.2 nevű, erős open-weight modelljéhez fordult a védekezéshez.

A levél rávilágít az iparágon belüli megosztottságra. Olyan vállalatok, mint az OpenAI és az Anthropic, azzal érvelnek, hogy ha a kínai AI-cégek állítólagos IP-eltulajdonítása valós, akkor az amerikai kormányzatnak reagálnia kell, mert az open-weight modellek gyorsan nőnek képességükben. Ennek a vitának kimenetele jelentős hatással lehet ezeknek a cégeknek az üzleti modelljére, amelyet fenyeget a megfizethető, nagy teljesítményű és könnyen hozzáférhető AI-modellek terjedése.

Figyelemre méltó, hogy a levél aláírói között hiányoznak olyan zárt forrású fejlesztők, mint az OpenAI, Anthropic, Google DeepMind vagy a SpaceX.

A dokumentum aláírói gazdasági érdekekkel bírnak az open modellek terjedése iránt: infrastruktúra-szolgáltatók, mint a Nvidia vagy a Microsoft Azure, hasznot húznak abból, ha a modellek könnyebben cserélhetőek és tömegesen használhatóak — ez több GPU-vásárlást, nagyobb felhőkapacitás-költséget és több alkalmazásfejlesztést eredményezhet.

A levél javaslatokat is tartalmaz: bátorítja a döntéshozókat, hogy bővítsék a számítási erőforrásokhoz való hozzáférést a startupok és kutatók számára, fektessenek be megosztott betanító eszközökbe és adatbázisokba, valamint értékelési keretrendszerekbe, és „tartsák plurálisnak a frontvonalat azzal, hogy elkerülik a nyílt modellekre vonatkozó idő előtti korlátozásokat, amelyek csökkentik a versenyt vagy az innovációt külföldre terelik”.