Az AI-iparág szereplői, szakértők és vállalatok egyre sürgetőbben keresik a módját annak, hogyan lehet megbízhatóan ellenőrizni a fejlett mesterséges intelligenciákat. A Fehér Ház ugyanakkor eddig a magukra hagyottabb, iparági önszabályozást preferáló megközelítést alkalmazza, és a közeljövőben nem várható gyors szövetségi szabályozás.
Jelen állás
Az AI-vállalatok vezetői azon dolgoznak, hogyan teszteljék a fejlett modelleket, és hogyan alakítsanak ki közös biztonsági normákat — még a Kínával folytatott együttműködés lehetőségét is mérlegelve. A Fehér Ház hivatalos álláspontja szerint a legjobb megoldás az, ha az iparág maga talál módot a saját felügyeletére, ezért most verseny zajlik azért, hogy kiket neveznek ki harmadik félként működő értékelőknek, akik felülvizsgálhatják a modellek biztonsági kontrolljait.
Már léteznek mérőszámokkal és biztonsági vizsgálatokkal foglalkozó szervezetek, de néhány Fehér Ház-beli tisztviselő és AI-cégvezető túl szoros kapcsolatot lát ezek és a vezető AI-laborok között. Alternatívaként szóba kerülnek olyan vállalkozások és startupok, amelyek korábban is végeztek értékeléseket, valamint kevésbé hagyományos javaslatok is felmerültek.
Kinek van joga és kompetenciája ellenőrizni?
A Fehér Ház egyik tisztviselője szerint a cégek rendelkeznek a legnagyobb szakértelemmel az AI területén és ők értik a Fehér Ház önkéntes AI-keretrendszerének követelményeit. A tisztviselő megjegyezte: "Ezek az emberek nem 12 évesek." Hozzátette, hogy a legelőremutatóbb cégeknek konszenzusra kell jutniuk, mert egyelőre nincs közös álláspontjuk; ha a vállalatok veszélyesnek ítélik helyzetüket, jogukban áll és módjukban áll visszafogni modelljeik működését.
Konfliktusok és aggályok a független értékelőkkel kapcsolatban
Néhány harmadik félként említett értékelőt — köztük a METR-rel kapcsolatban álló egyéneket, akik vizsgálták az OpenAI–Hugging Face ügyet — kritika érte amiatt, hogy kapcsolataik vannak a hatékony altruizmus mozgalommal és a polgárőrként működő vállalatokkal.
A Hugging Face-ügy egyik vezető külső vizsgálójának házastársa Paul Christiano, aki ismert AI-biztonsági és technológiai szakember, és aki nemrég csatlakozott az OpenAI non-profit alapítványának igazgatótanácsához. Egyes beszámolatok szerint egy Anthropic alkalmazott is távozott a startuptól, hogy a METR-hez csatlakozzon. A METR azt közölte, hogy nem fogad el finanszírozást a „frontvonalbeli” laboroktól, és egy szóvivő szerint Christiano az eredeti vizsgálat befejezése után lépett az OpenAI igazgatótanácsába.
Az AI-vállalatok és biztonsági szakemberek rámutatnak, hogy a kutatói közösség kicsi és szorosan összefonódott, így a frontvonalbeli laborok munkatársai alkalmasak lehetnek a modellek képességeinek értékelésére, ugyanakkor ez a közelség kérdéseket vet fel a függetlenség tekintetében.
Hogyan alakultak ki a jelenlegi értékelési módszerek?
A jelenlegi AI-értékelési rendszerek egy része arra a célra fejlődött ki, hogy bemutassa az új modellek képességeit — például kódolási és matematikai benchmarkokon való teljesítményüket. Ezen túl számos cég, köztük a védelmi és technológiai szolgáltató Booz Allen is végez AI-rendszer-értékeléseket ügyfelek számára.
Booz Allen AI-vezetője, Eric Syphard szerint sok jelenlegi értékelés hiányosságokkal küzd, például nem méri azt, hogy a modellek milyen gyakran hoznak létre szoftverbiztonsági sebezhetőségeket, vagy mennyire ingadozó a válaszadási mintájuk a különböző promptokra. Syphard kritikája szerint sok értékelés csak a teljesítményre fókuszál, és nem veszi figyelembe a szélesebb biztonsági kockázatokat.
Felmerülő alternatívák és kezdeményezések
Elon Musk ezen a héten javasolta, hogy amerikai és kínai laborok vizsgálhatnák egymás modelljeit, bár sokan ezt kevéssé valószínűnek tartják a vezető szereplők közti éles verseny miatt. Felmerült olyan, kevésbé hagyományos ötlet is, hogy a legendás programozó John Carmack, a „kódolás istene”, közvetítő vagy értékelő szerepet vállaljon — ezt egy korábbi Trump-tanácsadó vetette fel.
OpenAI a héten nyilvánosságra hozott egy olyan incidensjelentési forgatókönyvet, miután hat új incidens vált ismertté. Az OpenAI javaslata, akárcsak a Fehér Ház AI-keretrendszere, önkéntes alapon működne, és bonyolultabb esetekben harmadik fél általi auditot javasol.
Kritikus hangok és a következő lépések
Henry Papadatos, a SaferAI ügyvezető igazgatója hangsúlyozta, hogy a nyilvános átláthatóság alapvető: bár a vállalatok jelenlegi lépései hasznosak, ezek kizárólag a cégjóindulaton alapulnak, ami szerinte nem elegendő.
Figyelemre méltó továbbá, hogy Scott Bessent pénzügyminiszter, aki a hétvégén tárgyalások vezetésével utazik Kínába, találkozója Kínai miniszterelnök-helyettes He Lifenggel teret adhat biztonsági beszélgetéseknek Pekingtől is. Ez a nemzetközi párbeszéd potenciálisan kiegészítheti az iparági önszabályozást, de a felek közötti versengés és az önkéntesség korlátai miatt a megoldás még távolinak tűnik.



