Combatendo fogo com fogo na era da IA
O Reddit revelou que está utilizando grandes modelos de linguagem (LLMs) para combater um problema que, em grande parte, foi criado por esses mesmos modelos: o spam e o conteúdo automatizado de baixa qualidade. A ironia não passou despercebida pela empresa, que admite que “na era da IA, as plataformas não têm escolha a não ser combater fogo com fogo”.
Segundo a plataforma, os novos sistemas bloqueiam 23 milhões de visualizações de spam por dia e capturam cerca de 25 mil novos posts e comentários de spam diariamente. A empresa afirma ter reduzido a exposição dos usuários a spam em 20% entre janeiro e março de 2026, comparado aos três meses anteriores.
Por que LLMs são necessários para detectar LLMs
As plataformas sociais vêm construindo ferramentas automatizadas de redução de spam há anos, mas o Reddit afirma que os sistemas baseados em LLMs estão capturando spam em uma taxa significativamente maior. A explicação está na sofisticação do spam moderno: com ferramentas de IA generativa amplamente acessíveis, atores mal-intencionados conseguem produzir conteúdo que imita cada vez melhor o comportamento humano.
“Nós utilizamos LLMs para capturar os padrões altamente sutis e coordenados de comportamento falso e hype artificial que os sistemas antigos não detectavam”, explicou o Reddit em seu blog oficial. Esses padrões incluem campanhas coordenadas de múltiplas contas, promoção artificial de produtos e disseminação de desinformação com aparência de conteúdo legítimo.
Moderação por IA ainda precisa de supervisão humana
O anúncio do Reddit se insere em um contexto mais amplo de moderação de conteúdo na era da IA. Plataformas como YouTube, Meta e Instagram já permitem que usuários publiquem conteúdo gerado por IA, desde que devidamente identificado. O TikTok foi além e passou a permitir que os próprios usuários ajustem quanto conteúdo gerado por IA desejam ver em seus feeds.
No entanto, especialistas em plataformas alertam que a moderação por IA deve ser combinada com supervisão humana para obter os resultados mais eficazes. Se por um lado os sistemas conseguem detectar conteúdo gerado por IA mais rapidamente — o que também permite sinalizar conteúdo nocivo como discurso de ódio com mais agilidade —, por outro, ainda há riscos de falsos positivos e da necessidade de julgamento contextual que apenas moderadores humanos podem oferecer.
O caso do Reddit ilustra uma tendência que deve se intensificar: à medida que a IA generativa se torna mais acessível, as plataformas precisarão investir em sistemas igualmente sofisticados para manter a qualidade das discussões — criando uma espécie de corrida armamentista silenciosa entre geração e detecção de conteúdo sintético.
Descubra mais sobre noticiAI
Assine para receber nossas notícias mais recentes por e-mail.



