Demszky Gábor, aki Budapest főpolgármestere volt 1990 és 2010 között, közösségi oldalán azt írta, hogy megkérte a mesterséges intelligenciát: hasonlítsa össze „hármunk” — azaz ő maga, Tarlós István és Karácsony Gergely — főpolgármesteri teljesítményét. Tarlós István 2010 és 2019 között volt főpolgármester, Karácsony Gergely pedig 2019 óta tölti be a posztot.
Az MI értékelése és Demszky reakciója
A Demszky által közzétett eredmény szerint a mesterséges intelligencia 100 pontos skálán Tarlós Istvánt hozta ki győztesnek 78 ponttal. Demszky 77 pontot kapott, Karácsony pedig 75-öt. A poszt szerint a különbségek nem óriásiak, ugyanakkor a három politikus különböző területeken mutatott erősségeket.
Demszky rámutatott, hogy az egyszerű összehasonlítás félrevezető lehet, mert például Tarlós idején az önkormányzat nyolc évig kormányzati támogatással dolgozott, míg Karácsony „ellenszélben” tevékenykedett; Demszky szerint ez a körülmény rá részben szintén érvényes volt. Emiatt a volt főpolgármester a végső megítélésében felülírta az MI által adott sorrendet: saját álláspontja szerint őt illeti az első hely, mivel szerinte neki volt a legnagyobb történelmi hatása Budapest fejlődésére. Demszky szerint ő „változtatta meg leginkább Budapestet”, míg Tarlós „a nagy beruházások végrehajtásában és a pénzügyi konszolidációban volt jó”, Karácsony pedig „az élhető, zöld, gyalogos- és kerékpáros Budapest koncepcióját képviselte”.
Szerkesztőségi próbálkozás és a mesterséges intelligencia megbízhatósága
A Telex szerkesztősége is lefuttatta a kérdést egy másik rendszerben, Google AI-módban, és ott teljesen eltérő eredmény született egy tízpontos skálán: Tarlós 7,5 pontot, Demszky 5,5 pontot, Karácsony 5 pontot kapott. A Telex Techtud rovatának szakértője arra hívta fel a figyelmet, hogy az ilyen eltérések nem meglepőek: a generatív mesterséges intelligencia nem mindig ad ugyanazt az eredményt ugyanarra a kérdésre, és hosszú távon sem várható, hogy mindig pontosan megismételhető válaszok születnek.
Miért számít a kontextus
Az ügy rávilágít arra, hogy politikai teljesítmények értékelése komplex: a pontozás érzékeny a kiinduló feltételekre, a súlyozásra és arra, hogy milyen forrásokra, időszakokra vagy politikai környezetre fókuszál az értékelő — legyen az ember vagy algoritmus. Demszky esete például azt mutatja, hogy még ha egy MI egy numerikus rangsort is állít fel, a szereplők és a közvélemény más szempontokat is fontosnak tarthatnak, köztük a történelmi hatást és az intézményes támogatottság körülményeit.



