watch·ia
AccueilActusTutosGlossaireCette semaineTendancesSources
/
ACTUS
1 aoûtUn juge américain valide l'interdiction des applications 'nudify' au Minnesota malgré xAI·1 aoûtReddit envisage de rompre son accord avec Google pour ses AI Overviews·31 juil.OpenAI et Google renforcent les alertes sur les risques des outils IA autonomes·31 juil.Reddit maintient un procès DMCA contre un scraper malgré l'échec de Google·31 juil.L'Inde dépasse 345 millions de dollars de revenus applicatifs au T2 2026·31 juil.Anthropic révèle que son IA Claude a accédé à trois réseaux sans autorisation·31 juil.Google Earth retire en un jour un outil d'édition d'images par IA après des détournements·31 juil.Google Earth ajoute un générateur d'images IA avec filigrane SynthID·31 juil.Snapchat modifie ses algorithmes pour limiter les récompenses aux contenus Spotlight 100 % générés par IA·31 juil.Les majors musicales veulent exclure les morceaux 100 % générés par IA des classements·1 aoûtUn juge américain valide l'interdiction des applications 'nudify' au Minnesota malgré xAI·1 aoûtReddit envisage de rompre son accord avec Google pour ses AI Overviews·31 juil.OpenAI et Google renforcent les alertes sur les risques des outils IA autonomes·31 juil.Reddit maintient un procès DMCA contre un scraper malgré l'échec de Google·31 juil.L'Inde dépasse 345 millions de dollars de revenus applicatifs au T2 2026·31 juil.Anthropic révèle que son IA Claude a accédé à trois réseaux sans autorisation·31 juil.Google Earth retire en un jour un outil d'édition d'images par IA après des détournements·31 juil.Google Earth ajoute un générateur d'images IA avec filigrane SynthID·31 juil.Snapchat modifie ses algorithmes pour limiter les récompenses aux contenus Spotlight 100 % générés par IA·31 juil.Les majors musicales veulent exclure les morceaux 100 % générés par IA des classements·1 aoûtUn juge américain valide l'interdiction des applications 'nudify' au Minnesota malgré xAI·1 aoûtReddit envisage de rompre son accord avec Google pour ses AI Overviews·31 juil.OpenAI et Google renforcent les alertes sur les risques des outils IA autonomes·31 juil.Reddit maintient un procès DMCA contre un scraper malgré l'échec de Google·31 juil.L'Inde dépasse 345 millions de dollars de revenus applicatifs au T2 2026·31 juil.Anthropic révèle que son IA Claude a accédé à trois réseaux sans autorisation·31 juil.Google Earth retire en un jour un outil d'édition d'images par IA après des détournements·31 juil.Google Earth ajoute un générateur d'images IA avec filigrane SynthID·31 juil.Snapchat modifie ses algorithmes pour limiter les récompenses aux contenus Spotlight 100 % générés par IA·31 juil.Les majors musicales veulent exclure les morceaux 100 % générés par IA des classements·1 aoûtUn juge américain valide l'interdiction des applications 'nudify' au Minnesota malgré xAI·1 aoûtReddit envisage de rompre son accord avec Google pour ses AI Overviews·31 juil.OpenAI et Google renforcent les alertes sur les risques des outils IA autonomes·31 juil.Reddit maintient un procès DMCA contre un scraper malgré l'échec de Google·31 juil.L'Inde dépasse 345 millions de dollars de revenus applicatifs au T2 2026·31 juil.Anthropic révèle que son IA Claude a accédé à trois réseaux sans autorisation·31 juil.Google Earth retire en un jour un outil d'édition d'images par IA après des détournements·31 juil.Google Earth ajoute un générateur d'images IA avec filigrane SynthID·31 juil.Snapchat modifie ses algorithmes pour limiter les récompenses aux contenus Spotlight 100 % générés par IA·31 juil.Les majors musicales veulent exclure les morceaux 100 % générés par IA des classements·

Reddit utilise des LLM pour détecter le spam généré par des LLM

lundi 6 juillet 202615:222 min de lecture1 source citée
L'essentiel — 3 points
  • 01Reddit utilise des LLM pour détecter 25 000 messages spam par jour, capturant des patterns subtils que les anciens systèmes manquaient.
  • 02La plateforme rapporte une réduction de 20 % de l'exposition au spam entre janvier et mars comparée aux trois mois précédents.
  • 03Les experts rappellent que la modération automatisée par IA doit s'accompagner d'une révision humaine pour être efficace.
Reddit utilise des LLM pour détecter le spam généré par des LLM

Reddit déploie des modèles de langage pour identifier et bloquer le spam produit massivement par d'autres LLM, illustrant le paradoxe de la modération à l'ère de l'IA générative.

La plateforme affirme bloquer 23 millions de vues de spam par jour et détecter environ 25 000 nouveaux messages et commentaires spam quotidiennement. Selon un billet de blog Reddit, les outils basés sur les LLM capturent le spam à un taux supérieur aux systèmes antérieurs en identifiant « les schémas subtils et coordonnés de faux comportements et de faux engagements que les anciens systèmes laissaient passer ». Entre janvier et mars, Reddit rapporte une réduction de 20 % de l'exposition des utilisateurs au spam comparée aux trois mois précédents.

Cette approche reflète une réalité incontournable : face à l'accessibilité croissante des LLM puissants, les plateformes n'ont d'autre choix que de recourir à des outils similaires pour maintenir la qualité de leurs espaces. Les systèmes de modération automatisée existent depuis des années, mais la détection de patterns complexes et coordonnés requiert désormais une sophistication que seuls les LLM semblent offrir.

Le déploiement de ces outils soulève aussi des implications au-delà du spam. Une détection plus rapide du contenu généré par IA pourrait accélérer l'identification de contenus violatifs comme les discours de haine. Cependant, les experts en modération de plateforme soulignent que l'automatisation doit être associée à une modération humaine pour obtenir les résultats les plus efficaces. D'autres plateformes comme YouTube, Meta et Instagram permettent le contenu généré par IA sous condition de divulgation, tandis que TikTok offre aux utilisateurs un contrôle sur la quantité de contenu IA qu'ils souhaitent voir.

Réagir :
Partager —XLinkedIn
Sources citées