Ahogy a nagy nyelvi modellek (LLM-ek) egyre könnyebben elérhetők, a rosszindulatú szereplők számára is egyszerűbbé vált, hogy spamet terjesszenek az interneten. Reddit szerint a platform válaszul olyan eszközöket fejlesztett, amelyek LLM-eket használnak a spam és a koordinált, mesterségesen gerjesztett felhajtás felismerésére és visszaszorítására — sok esetben éppen az LLM-ek által létrehozott tartalom ellen.
Mennyiség és hatékonyság
A Reddit közlése szerint a rendszer naponta körülbelül 23 millió spam-megjelenést blokkol, és naponta nagyjából 25 000 új spam posztot és kommentet fog el. A cég blogbejegyzése szerint az új, LLM-alapú megoldások képesek elcsípni az „erősen szubtilis, koordinált hamis viselkedési mintákat és a mesterséges felhajtást”, amelyeket a régebbi módszerek nem mindig észleltek.
A Reddit azt állítja, hogy ezek az intézkedések csökkentették a felhasználók spamnek való kitettségét: január–március között 20 százalékkal kevesebb spamnek voltak kitéve a felhasználók az előző három hónaphoz képest.
A platformok közös kihívása
A közösségi platformok évek óta dolgoznak automatizált spamszűrőkön, de az LLM-ek elterjedése újfajta, nagy volumenű és nehezen észlelhető rosszindulatú tartalmat hozott. Egyes szolgáltatók, például YouTube, Meta és Instagram lehetővé teszik az AI által generált tartalom közzétételét, amennyiben a szerzők ezt feltüntetik. A TikTok pedig ennél is tovább megy: a felhasználóknak lehetőséget ad arra, hogy beállítsák, mennyi AI-generált tartalmat szeretnének látni.
Ha a platformok egyre gyorsabban felismerik az AI-alkotta tartalmat, az azt is jelenti, hogy potenciálisan hamarabb jelölhetnek meg és távolíthatnak el jogsértő anyagokat, például gyűlöletbeszédet. Ugyanakkor szakértők folyamatosan hangsúlyozzák, hogy a mesterséges intelligenciára épülő moderáció akkor működik a legjobban, ha emberi moderátorokkal párosul: a legpontosabb és legbiztonságosabb eredmény érdekében az automatizálás és az emberi ellenőrzés együttműködésére van szükség.
Miért számít ez?
A Reddit lépése jól példázza, hogy a platformoknak — ha nem is mindig ideális megoldással — kénytelenek a rendelkezésre álló technológiával válaszolniuk az új veszélyekre. Az LLM-ek egyszerre szolgáltatnak eszközt a rosszindulatú szereplőknek és nyújtanak hatékonyabb védelmi lehetőségeket, így a küzdelem a spam és a manipuláció ellen folyamatos technológiai és szervezeti alkalmazkodást követel meg.



