Új mesterséges intelligencia rendszereket vet be a Meta azoknak a látszólag ártalmatlan hirdetéseknek a felismerésére, amelyek gyermekek szexuális kizsákmányolásához kapcsolódó illegális tartalmakhoz irányíthatják a felhasználókat. A vállalat egy külön MI-ügynököt is használ saját védelmi rendszereinek támadására, hogy még azelőtt megtalálja azok gyenge pontjait, hogy a visszaélők szélesebb körben kihasználnák őket.
A Meta október 7-én ismertette új gyermekvédelmi intézkedéseit. A vállalat szerint a visszaélők egy része olyan hirdetéseket próbál használni, amelyek önmagukban nem feltétlenül tartalmaznak tiltott anyagot, hanem burkolt módon más weboldalakra vagy platformokon kívüli illegális tartalomhoz vezetnek. A hagyományos tartalomelemzés ezért önmagában nem minden esetben elegendő: azt is meg kell érteni, mi a hirdetés célja és hová viszi a felhasználót.
Az új nagy nyelvi modell egyik feladata az úgynevezett „signposting” felismerése. A rendszer olyan látszólag ártalmatlan hirdetési tartalmakat keres, amelyek a Meta szerint valószínűsíthetően tiltott gyermek-kizsákmányoló anyagokhoz vagy más káros, platformon kívüli tevékenységhez irányítják az embereket. A vállalat már nemcsak magát a hirdetést elemzi, hanem a mögötte található céloldalt is, és szabálysértés esetén blokkolhatja a hivatkozott webhelyet, valamint felléphet az érintett fiókkal szemben.
A Meta emellett további mesterséges intelligencia alapú átvizsgálásokat indított olyan tartalmak keresésére, amelyeket a korábbi rendszerek nem ismertek fel. Egy másik újdonság a red-teaming MI-ügynök: ennek feladata szándékosan próbára tenni a vállalat saját védelmét és olyan megkerülési módszereket keresni, amelyeket rosszindulatú szereplők is kihasználhatnának. Emellett erősítik azok felismerését is, akik korábbi eltávolításuk után új fiókkal próbálnak visszatérni.
Olvasd el: Emberi parancs nélkül támadhat egy új mesterséges intelligencia alapú vírus

Eljuthatunk oda, hogy az online védelmi rendszereknek már nemcsak a káros tartalmat kell felismerniük, hanem egy rosszindulatú szereplő következő kerülőútját is előre kell jelezniük?
A probléma léptékéről a Meta saját moderációs adatai adnak képet. A vállalat szerint 2026 első hat hónapjában globálisan 33,2 millió, gyermekek szexuális kizsákmányolásához kapcsolódó tartalommal szemben intézkedett a Facebookon és az Instagramon, és ezek több mint 97 százalékát még felhasználói bejelentés előtt észlelték a rendszerei. Fontos azonban, hogy ez nem az újonnan bejelentett MI-eszközök eredményességi adata: a szám a Meta teljes első féléves gyermekvédelmi moderációjára vonatkozik.
A most bemutatott rendszerek tényleges hatékonyságáról a Meta egyelőre nem közölt függetlenül ellenőrzött felismerési arányt vagy összehasonlító tesztet. A 33,2 milliós adat is a vállalat saját jelentése, ezért abból nem lehet megállapítani, hogy az új LLM mennyivel javította a korábbi védelmet. Az ilyen rendszereknél ráadásul különösen fontos a téves pozitív találatok kezelése is, mert egy hibás automatikus következtetés ártalmatlan hirdetők vagy felhasználók fiókját is érintheti.
A fejlesztés technológiai szempontból mégis fontos irányváltást mutat. Az online biztonságban a mesterséges intelligencia korábban gyakran egy kép, videó vagy szöveg tartalmát próbálta osztályozni. A Meta új megközelítése már a kontextust, a céloldalt, a fiók viselkedését és a védelem kijátszására szolgáló taktikákat is együtt próbálja értelmezni. A védekező mesterséges intelligencia így egyre kevésbé egyszerű szűrőként, és egyre inkább folyamatosan alkalmazkodó biztonsági rendszerként működhet.
Olvasd el ezt is: Saját virtuális számítógépet kapott a Meta új generatív mesterséges intelligenciája
Források: Meta, TechCrunch
CS.SZ.


