Reddit wytacza ciężkie działa przeciwko spamowi. Nowe narzędzia oparte na LLM blokują 23 mln odsłon spamu dziennie. To ironiczna walka, bo AI zwalcza treści AI.
W skrócie:
- Reddit blokuje 23 miliony odsłon spamu każdego dnia, a jego nowe systemy AI codziennie wychwytują około 25 tysięcy niechcianych postów i komentarzy.
- Firma twierdzi, że dzięki nowym narzędziom LLM zmniejszyła ekspozycję użytkowników na spam o 20% w pierwszym kwartale roku w porównaniu do poprzednich trzech miesięcy.
- Nowe systemy wykorzystują duże modele językowe (LLM) do wykrywania subtelnych, skoordynowanych wzorców fałszywych zachowań, których starsze algorytmy nie były w stanie zauważyć.
Wielkie modele językowe (LLM) dały nam nieprawdopodobne możliwości, ale jednocześnie otworzyły puszkę Pandory. Generowanie spamu, dezinformacji i zwykłych internetowych śmieci stało się łatwiejsze niż kiedykolwiek. Jeśli spędziłeś w sieci choćby dziesięć minut w ciągu ostatniego roku, wiesz, o czym mowa. Boty i zalew niskiej jakości treści to problem, z którym walczą wszyscy. Reddit postanowił pójść na całość i do walki z AI zaprzągł… inne AI. I to z całkiem niezłym skutkiem.
Jak Reddit gasi pożar benzyną?
Paradoks całej sytuacji jest wręcz poetycki. Platforma, która tonie w treściach generowanych przez boty napędzane przez LLM, tworzy własne, zaawansowane LLM‑y, by ten zalew powstrzymać. To trochę ironiczne, ale w nowej rzeczywistości cyfrowej platformy nie mają innego wyjścia, jak tylko gasić ogień ogniem. Starsze, oparte na prostszych regułach systemy antyspamowe po prostu przestały zdawać egzamin. Nie radziły sobie z zalewem wyrafinowanych, pozornie autentycznych komunikatów, które potrafią produkować dzisiejsze modele AI.
Platformy społecznościowe od lat budują zautomatyzowane narzędzia do walki ze spamem, ale Reddit twierdzi, że jego nowe, zaktualizowane algorytmy wykazują znacznie wyższą skuteczność. Zamiast czekać na zgłoszenia od użytkowników, system proaktywnie skanuje platformę w poszukiwaniu anomalii, które umykały dotychczasowym filtrom. To już nie jest łatanie dziur – to budowa zupełnie nowego wału przeciwpowodziowego.
Czy liczby dowodzą skuteczności?
Reddit nie rzuca słów na wiatr i podpiera swoje deklaracje konkretnymi danymi. Firma poinformowała, że jej systemy blokują dziennie 23 miliony wyświetleń spamu i przechwytują około 25 tysięcy nowych, niechcianych postów i komentarzy. Co więcej, w oficjalnym wpisie na blogu firma chwali się, że od stycznia do marca udało jej się zmniejszyć ekspozycję użytkowników na spam o 20% w porównaniu z poprzednim kwartałem. To wymierny sukces, który pokazuje, że nowa strategia działa.
Jak to możliwe? Kluczem jest zdolność LLM do analizy kontekstowej. “Wykorzystujemy LLM‑y do wychwytywania wysoce subtelnych, skoordynowanych wzorców fałszywych zachowań i sztucznego szumu, które kiedyś umykały starszym systemom” – czytamy w komunikacie Reddita. To oznacza, że AI nie tylko patrzy na pojedyncze słowa kluczowe, ale analizuje całe sieci powiązań między kontami, styl wypowiedzi i czas publikacji. W ten sposób potrafi zidentyfikować zorganizowane kampanie, a nie tylko pojedyncze, niegroźne boty.
Jaka jest przyszłość moderacji treści?
Działania Reddita to część szerszego trendu. Inni giganci, tacy jak Meta, YouTube czy TikTok, również wdrażają polityki dotyczące treści generowanych przez AI, najczęściej wymagając od twórców ich oznaczania. TikTok idzie nawet o krok dalej, pozwalając użytkownikom decydować, ile treści stworzonych przez sztuczną inteligencję chcą widzieć na swojej osi czasu. Szybsze wykrywanie treści AI to nie tylko walka ze spamem – to także potencjalnie skuteczniejszy sposób na flagowanie mowy nienawiści i innych toksycznych materiałów.
Pomimo tego eksperci ds. moderacji niezmiennie przypominają, że technologia to nie wszystko. Najskuteczniejsze systemy to te, które łączą potęgę sztucznej inteligencji z niezastąpionym osądem człowieka. AI może przesiewać miliony postów na sekundę, ale to człowiek wciąż najlepiej rozumie niuanse, sarkazm i kulturowy kontekst. Bez tej synergii nawet najpotężniejszy algorytm pozostanie tylko tępym narzędziem. Reddit wykonał ważny krok, ale wojna o czysty internet dopiero się zaczyna.