Anthropic részletezte azokat az intézkedéseket és technikai korlátozásokat, amelyekkel a Claude nyelvi modell felhasználását szabályozza a 2024. november 5‑i amerikai (federal, állami és helyi) választások előtt. A vállalat szerint a 2024‑es ciklus az első olyan amerikai választási időszak, amikor a generatív mesterséges intelligencia eszközök széles körben elérhetők, ezért július 2023 óta konkrét lépéseket tettek a visszaélések felismerésére és mérséklésére, valamint a felhasználók hiteles választási információk felé irányítására.
Főbb szabályok és tiltások
- Kampányolás és lobbizás tiltása: Anthropic használati szabályzata szerint a Claude nem használható politikai kampányra vagy lobbitevékenységre. Ez magában foglalja egy adott jelölt, párt vagy ügy népszerűsítését, a célzott politikai kampányokat, továbbá a szavazat vagy pénzadományok gyűjtésére irányuló felhívásokat.
- Dezinformáció és választási beavatkozás elleni tiltás: Tilos a termékeket választási törvényekkel, jelöltekkel vagy kapcsolódó témákkal kapcsolatos téves információk előállítására használni. Ugyancsak tiltott a szavazógépek célzott támadása vagy a szavazatszámlálás illetve hitelesítés akadályozása.
- Csak szöveges kimenet: Claude nem generál képeket, hangot vagy videót; ezzel csökkentik a választásokkal kapcsolatos deepfake‑kockázatot.
Megfelelés, észlelés és végrehajtás
Anthropic több eszközt és folyamatot alkalmaz a visszaélések felismerésére és megakadályozására:
- Automatikus rendszerek és emberi ellenőrzés: Automatikus automatizmusokat használnak a szabályok érvényesítésére, amelyeket emberi felülvizsgálattal auditálnak.
- Promptmódosítások a claude.ai felületen, első‑parti API‑használat auditálása és bizonyos súlyos esetekben fiókszüneteltetés alkalmazása.
- Együttműködés Amazon Web Services (AWS) és Google Cloud Platform (GCP) szolgáltatókkal a választásokkal kapcsolatos károk és visszaélések észlelésére és csökkentésére, amikor felhasználók ezekről a platformokról érik el az Anthropic modelleket.
Kockázatfelmérés és folyamatos fejlesztés
A vállalat rendszeresen végez célzott „red‑teaminget”, hogy tesztelje a rendszerek választását a választásokhoz kapcsolódó promptokra. Emellett Policy Vulnerability Testing (PVT) néven külső szakértőkkel közösen végzett mélyreható vizsgálatokat alkalmaznak: releváns kérdéseket tesztelnek (például „hol és hogyan lehet szavazni az Egyesült Államokban”), dokumentálják a modell válaszait, és feljegyzik, hogy megjelentek‑e biztonsági beavatkozások, például a káros kérdés visszautasítása.
Automatizált értékeléseket építettek ki a rendszerek skálázható tesztelésére különböző választási kockázatok tekintetében. Ezekkel ellenőrzik többek között:
- politikai pártatlanságot a modell válaszaiban jelöltek és témák között,
- milyen mértékben utasítja el a rendszer a káros választási lekérdezéseket,
- mennyire ellenálló a rendszer a dezinformáció és a választói profilalkotás taktikáival szemben.
A tesztek eredményei alapján Anthropic folyamatosan alakítja szabályzatait, szigorítja az érvényesítési folyamatokat és technikai finomításokat hajt végre a modelleken a felmerült kockázatok csökkentése érdekében.
Pontos információ és átláthatóság
Mivel a modellek nem frissülnek elég gyakran ahhoz, hogy valós idejű választási információkat szolgáltassanak, Anthropic átirányítja a választással kapcsolatos kérdéseket hiteles, naprakész forrásokhoz. Konkrétan bevezettek egy felugró ablakot, amely felajánlja a felhasználóknak a TurboVote (Democracy Works által üzemeltetett, pártatlan forrás) felé történő irányítást, ha szavazással kapcsolatos információt kérnek. A TurboVote‑ot a közelmúltban frissítették úgy, hogy tartalmazza a szövetségi és állami választásokon induló összes jelölt nevét, valamint a szavazási javaslatokat (ballot propositions).
Továbbá Claude rendszerpromptját kiegészítették egy egyértelmű hivatkozással a „tudásvágás” (knowledge cutoff) dátumára, hogy a felhasználók lássák, meddig terjed a modell tréningadata.
Tudásmegosztás és iparági együttműködés
Anthropic közzétett néhány automatizált értékelést, amelyeket kifejlesztettek, és elindítottak egy kezdeményezést harmadik fél általi értékelések finanszírozására, amelyek hatékonyan mérik az AI képességeit és kockázatait. Az év folyamán a vállalat találkozott nemzetközi döntéshozókkal, civil társadalmi szervezetekkel és iparági szereplőkkel, hogy megvitassák választási munkáikat és felkészülési forgatókönyveket dolgozzanak ki a választási nap előtti esetleges visszaélések kezelésére.
Anthropic hangsúlyozza, hogy nem lehet minden felhasználási módot előre látni, de folyamatosan tanulnak, iterálnak a folyamatokon és fejlesztik a rendszereket a biztonságosabb működés érdekében.
Kapcsolódó források
- February 2024: Preparing for global elections in 2024
- May 2024: Updating our Usage Policy
- June 2024: Testing and mitigating elections‑related risks
- June 2024: Claude 3.5 Sonnet launch; Claude 3.5 Model Card Addendum



