Iparág

Reddit a nagy nyelvi modellekre támaszkodik a spam elleni védelemben

A főszereplő a Reddit közösségi platform és a nagy nyelvi modellek (Large Language Models), amelyeket a platform mostantól a spam elleni küzdelemben alkalmaz.

Reddit a nagy nyelvi modellekre támaszkodik a spam elleni védelemben

A Reddit bejelentette, hogy nagy nyelvi modellekre (large language models, LLM-ek) támaszkodik a platformon megjelenő spam és rosszindulatú tartalmak kiszűrésére — sok esetben olyan tartalmak ellen vetve be a gépet, amelyeket maga is gépek hoztak létre.

Mire terjed ki a védekezés?

  • A vállalat közlése szerint naponta mintegy 23 millió spam megtekintését blokkolják.
  • Ugyanakkor körülbelül 25 000 új spam bejegyzést és hozzászólást azonosítanak naponta.
  • A Reddit szerint az LLM-alapú eszközöknek köszönhetően a felhasználók spam-expozíciója 20 százalékkal csökkent januártól márciusig az előző negyedévhez képest.

Miért fontos ez?

A Reddit korábban gyakran a „utolsó emberi szoba az interneten” pozícióját hangoztatta: olyan hely, ahová a felhasználók akkor fordulnak, ha más források túlzottan mechanikus vagy mesterséges hatású tartalmat adnak. Azonban a generatív nyelvi modellek elterjedésével a platformokra is megérkezett a nagy mennyiségű, automatizált tartalom, amelyet a régebbi, szabályalapú szűrők nem mindig tudtak megbízhatóan kiszűrni.

A megoldásként alkalmazott LLM-ek éppen azokkal az algoritmusokkal vetik szembe a spameket, amelyek képesek gyorsan és nagy léptékben előállítani hamis vagy koordinált tartalmakat. Ennek gyakorlati következménye, hogy a „humán” identitású internet egyre inkább olyan gépeken fut, amelyekkel korábban szembehelyezkedett.

Következmények és korlátok

  • A számokból az látszik, hogy az automatizált védelem hatékonynak bizonyult a felhasználói élmény javításában (20 százalékos csökkenés).
  • Ugyanakkor a belső ellentmondás is nyilvánvaló: a platformnak most olyan technológiákra kell támaszkodnia, amelyek részben felelősek a probléma bővüléséért.
  • Nem közöltek részletes módszertant vagy a modellek pontos típusát, így nehéz megítélni a hosszabb távú hatékonyságot és a téves riasztások mértékét.

Összefoglalás

A Reddit lépése rávilágít arra a dinamikára, hogy ahol a generatív mesterséges intelligencia által előállított tartalom elterjed, ott a kézi vagy egyszerű szabályalapú moderáció nem skálázódik. A platformoknak egyre inkább fejlett, automatizált megoldásokhoz kell fordulniuk, hogy fenntarthassák a szolgáltatás használhatóságát és a közösség bizalmát.