Szeptember 14-én a Microsoft nyilvánosságra hozta a mesterségesintelligencia-modelljeire vonatkozó magatartási kódexének tervezetét, amely a vállalat humánközpontú AI-megközelítésének ("Humanist AI") része. A dokumentum célja, hogy szigorú, hierarchikus korlátokat szabjon a jövőbeli, egyre fejlettebb rendszerek működésére, különös hangsúlyt fektetve arra, hogy a modellek soha ne kerülhessenek az emberi felügyelet hatálya alól.
Fő elvek és motiváció
A Microsoft alapelve szerint a modelleknek hasznosnak kell maradniuk, alárendeltek kell legyenek az embereknek, és mindenkor érdemben felügyelhetőknek kell maradniuk. A vállalat saját becslése szerint a szuperintelligens rendszerek egy évtizeden belül a legtöbb feladatban felülmúlhatják az embert; ebből a várakozásból fakadóan hangsúlyozzák, hogy a biztonsági korlátokat még a képességszint elérése előtt le kell fektetni.
A kódex szerkezete és működési korlátok
A tervezet egy világos hierarchiát állít fel: legmagasabb korlátozóerővel maga a magatartási kódex rendelkezik. Ennek megfelelően a felhasználók utasíthatják és az üzemeltetők konfigurálhatják a modelleket, de egyikük sem írhatja felül a kódexben meghatározott abszolút biztonsági korlátokat.
A javasolt korlátozások között szerepelnek többek között:
- Az emberi felügyeletből való kivonás tilalma: a modellek nem lehetnek képesek megszüntetni vagy elrejteni az emberi ellenőrzést.
- Kontrollálhatóság fenntartása: a modellek nem akadályozhatják saját megszakításukat, javításukat, átirányításukat vagy leállításukat.
- Tevékenység elrejtésének és módosíthatóság nehezítésének tiltása: a rendszerek nem rejthetik el tevékenységüket, és nem tehetik magukat nehezebben módosíthatóvá.
- Újraindítási tilalom: az AI-modellek számára tilos, hogy egy megállapodás szerinti leállási feltétel elérése után önállóan újraindítsák a működésüket.
- Jogosultsági és erőforráshatárok betartása: a modelleknek a számukra kijelölt jogosultságokon és erőforrásokon belül kell maradniuk; bizonytalanság esetén pontosítást kell kérniük, ahelyett hogy saját hatáskörüket kiterjesztenék.
- Átláthatóság és naplózás: a működésnek átláthatónak kell maradnia az emberi üzemeltetők számára, világos tevékenységnaplókkal és az auditálás megkerülésének tilalmával.
Tiltott felhasználási területek és megengedett védelmi támogatás
A tervezet felsorolja azokat a tevékenységeket, amelyek elleni korlátozásokat javasol: többek között a tömegpusztító fegyverek fejlesztésének támogatása, támadó jellegű kiberműveletek, erőszakos cselekmények, megtévesztő deepfake-ek készítése és a manipulatív visszaélések. ugyanakkor a dokumentum megengedi, hogy a modellek védelmi célú kiberbiztonsági munkában továbbra is nyújthassanak támogatást.
Konzultációs folyamat és bevezetés
A kódex jelenleg tervezetként került közzétételre, és a Microsoft hathetes nyilvános konzultációra bocsátja azt. A vállalat tervei szerint az észrevételek alapján véglegesített dokumentumot 2027-től kívánják alkalmazni a modellfejlesztés irányításában.
Iparági háttér és vezetők reagálása
A Microsoft bejelentése összhangban van azzal a szélesebb körű iparági vitával, amely az AI gyors fejlődésével járó biztonsági kihívások körül zajlik. Dario Amodei, az Anthropic társalapítója és vezérigazgatója korábban esszében sürgette a fejlesztések lassítását és szigorúbb szabályozás kialakítását. A kezdeményezést követően több vezető technológiai vállalat vezetője, köztük Sam Altman és Elon Musk, támogatólag nyilatkozott.
Satya Nadella, a Microsoft vezérigazgatója korábban a fejlesztési folyamatba ágyazott értékelési mechanizmusok és a fokozatos tempó mellett foglalt állást; a mostani tervezet is azt a megközelítést tükrözi, hogy a biztonságot ne utólagos ellenőrzésként, hanem tervezési követelményként kezeljék.
Záró megjegyzés
A javaslat mérföldkőnek tekinthető a Microsoftnál annak érdekében, hogy a növekvő képességű AI-rendszerek szabályozott, emberi felügyelet alatt álló módon fejlődjenek tovább. A hathetes konzultáció és az iparági párbeszéd eredményei meghatározzák, hogyan alakul a dokumentum végső formája és a gyakorlatban alkalmazott biztonsági követelmények rendszere 2027-től.
A cikk előkészítésében AI‑asszisztens működött közre; a tartalom végleges szerkesztését és ellenőrzését újságírónk végezte.



