- 01Reddit utilise des LLM pour détecter 25 000 messages spam par jour, capturant des patterns subtils que les anciens systèmes manquaient.
- 02La plateforme rapporte une réduction de 20 % de l'exposition au spam entre janvier et mars comparée aux trois mois précédents.
- 03Les experts rappellent que la modération automatisée par IA doit s'accompagner d'une révision humaine pour être efficace.

Reddit déploie des modèles de langage pour identifier et bloquer le spam produit massivement par d'autres LLM, illustrant le paradoxe de la modération à l'ère de l'IA générative.
La plateforme affirme bloquer 23 millions de vues de spam par jour et détecter environ 25 000 nouveaux messages et commentaires spam quotidiennement. Selon un billet de blog Reddit, les outils basés sur les LLM capturent le spam à un taux supérieur aux systèmes antérieurs en identifiant « les schémas subtils et coordonnés de faux comportements et de faux engagements que les anciens systèmes laissaient passer ». Entre janvier et mars, Reddit rapporte une réduction de 20 % de l'exposition des utilisateurs au spam comparée aux trois mois précédents.
Cette approche reflète une réalité incontournable : face à l'accessibilité croissante des LLM puissants, les plateformes n'ont d'autre choix que de recourir à des outils similaires pour maintenir la qualité de leurs espaces. Les systèmes de modération automatisée existent depuis des années, mais la détection de patterns complexes et coordonnés requiert désormais une sophistication que seuls les LLM semblent offrir.
Le déploiement de ces outils soulève aussi des implications au-delà du spam. Une détection plus rapide du contenu généré par IA pourrait accélérer l'identification de contenus violatifs comme les discours de haine. Cependant, les experts en modération de plateforme soulignent que l'automatisation doit être associée à une modération humaine pour obtenir les résultats les plus efficaces. D'autres plateformes comme YouTube, Meta et Instagram permettent le contenu généré par IA sous condition de divulgation, tandis que TikTok offre aux utilisateurs un contrôle sur la quantité de contenu IA qu'ils souhaitent voir.
Articles liés

États-Unis : le gouvernement défend l'entraînement des LLM avec des données sous copyright
Comprendre les implications légales et stratégiques de la position américaine sur l'entraînement des IA avec du contenu protégé.

ChatGPT, Reddit et Roblox désignés plateformes en ligne très grandes dans l'UE
Comprendre les obligations légales imposées aux plateformes d'IA et de réseaux sociaux dans l'UE suite à leur croissance.

QueryStory lève 6 millions de dollars pour structurer les réponses des IA avec des récits vérifiés
Présentation d'une solution pour renforcer la confiance dans les outputs des modèles de langage.