Inteligência artificial, sem ruído.
Ferramentas e Apps3 min

Reddit usa LLMs para combater o spam gerado por… outros LLMs

A plataforma bloqueia 23 milhões de visualizações de spam por dia usando modelos de linguagem para detectar padrões sutis de comportamento falso que sistemas antigos não capturavam.

Reddit usa LLMs para combater o spam gerado por… outros LLMs

Combatendo fogo com fogo na era da IA

O Reddit revelou que está utilizando grandes modelos de linguagem (LLMs) para combater um problema que, em grande parte, foi criado por esses mesmos modelos: o spam e o conteúdo automatizado de baixa qualidade. A ironia não passou despercebida pela empresa, que admite que “na era da IA, as plataformas não têm escolha a não ser combater fogo com fogo”.

Segundo a plataforma, os novos sistemas bloqueiam 23 milhões de visualizações de spam por dia e capturam cerca de 25 mil novos posts e comentários de spam diariamente. A empresa afirma ter reduzido a exposição dos usuários a spam em 20% entre janeiro e março de 2026, comparado aos três meses anteriores.

Por que LLMs são necessários para detectar LLMs

As plataformas sociais vêm construindo ferramentas automatizadas de redução de spam há anos, mas o Reddit afirma que os sistemas baseados em LLMs estão capturando spam em uma taxa significativamente maior. A explicação está na sofisticação do spam moderno: com ferramentas de IA generativa amplamente acessíveis, atores mal-intencionados conseguem produzir conteúdo que imita cada vez melhor o comportamento humano.

“Nós utilizamos LLMs para capturar os padrões altamente sutis e coordenados de comportamento falso e hype artificial que os sistemas antigos não detectavam”, explicou o Reddit em seu blog oficial. Esses padrões incluem campanhas coordenadas de múltiplas contas, promoção artificial de produtos e disseminação de desinformação com aparência de conteúdo legítimo.

Moderação por IA ainda precisa de supervisão humana

O anúncio do Reddit se insere em um contexto mais amplo de moderação de conteúdo na era da IA. Plataformas como YouTube, Meta e Instagram já permitem que usuários publiquem conteúdo gerado por IA, desde que devidamente identificado. O TikTok foi além e passou a permitir que os próprios usuários ajustem quanto conteúdo gerado por IA desejam ver em seus feeds.

No entanto, especialistas em plataformas alertam que a moderação por IA deve ser combinada com supervisão humana para obter os resultados mais eficazes. Se por um lado os sistemas conseguem detectar conteúdo gerado por IA mais rapidamente — o que também permite sinalizar conteúdo nocivo como discurso de ódio com mais agilidade —, por outro, ainda há riscos de falsos positivos e da necessidade de julgamento contextual que apenas moderadores humanos podem oferecer.

O caso do Reddit ilustra uma tendência que deve se intensificar: à medida que a IA generativa se torna mais acessível, as plataformas precisarão investir em sistemas igualmente sofisticados para manter a qualidade das discussões — criando uma espécie de corrida armamentista silenciosa entre geração e detecção de conteúdo sintético.


Descubra mais sobre noticiAI

Assine para receber nossas notícias mais recentes por e-mail.

R
Sobre o autorRedação Noticiai

Equipe editorial dedicada a explicar inteligência artificial com clareza, independência e contexto.