Reddit usa IA para bloquear 23 milhões de spams por dia

O Reddit atualizou os sistemas de moderação, passando a utilizar LLMs (modelos de linguagem de larga escala) para identificar perfis de spam antes mesmo que cheguem às comunidades. Segundo a plataforma, os novos filtros retêm cerca de 23 milhões de publicações de spam por dia e remove, diariamente, mais milhões de interações falsas que inflam artificialmente a visibilidade de posts.
Em um relatório de transparência divulgado hoje (06/07), a plataforma explica que a ideia é agir mais cedo contra contas falsas, campanhas coordenadas e outras violações, como discurso de ódio, dependendo menos de denúncias ou remoções manuais após a circulação do conteúdo. Segundo a plataforma, as atualizações já reduziram em 20% a exposição dos usuários a spam.
Na publicação, o Reddit reforça que a moderação dos fóruns segue com participação de humanos, administradores e revisores, além de moderadores voluntários em cada comunidade.
Os usuários também têm parte na estrutura da plataforma, através dos sistemas de upvote e downvote, que reduzem a visibilidade de posts considerados ruins — ações que também estão na mira dos sistemas automatizados do fórum.

Parte da nova proteção começa no momento em que uma conta é criada. O sistema avalia sinais e padrões de comportamento para tentar identificar esses perfis antes que eles consigam publicar.
Quando uma conta já está ativa, os filtros buscam sinais de coordenação, automação e engajamento artificial. Isso inclui a promoção falsa de posts ou manipulação da posição de conteúdos (através do sistema de votos) dentro das comunidades.
Fonte: Tecnoblog
Entre para comentar.