NapseflowNapseflow
Numérique

Reddit utilise l’IA pour se protéger du spam généré par IA

Next.ink · mis à jour 7 juil.

Reddit affirme que ses outils de modération automatisés, sous-tendus par des grands modèles de langage, parviennent à endiguer une part significative des contenus promotionnels et du spam généré par IA. Reddit et l’IA, c’est un peu je t’aime moi non plus.

Reddit contre le spam IA

Reddit utilise désormais des outils d'intelligence artificielle (IA) pour lutter contre le spam généré par d'autres IA. Ces systèmes automatisés, basés sur des grands modèles de langage (LLM), analysent les publications et commentaires dès leur création pour détecter les comportements suspects. L'entreprise explique que ces outils permettent de bloquer des comptes ou des contenus avant même qu'ils ne soient visibles par les utilisateurs. Cette stratégie s'inscrit dans un contexte où les tactiques des acteurs malveillants ont évolué avec l'essor de l'IA générative, rendant les méthodes traditionnelles de modération moins efficaces. Reddit qualifie ce phénomène de « nouveau front dans une guerre ancienne », soulignant que la lutte contre le spam et les contenus indésirables est un enjeu récurrent pour la plateforme.

Chiffres clés de l'efficacité

Selon Reddit, ses outils automatisés bloquent l'équivalent de 23 millions d'affichages de spam par jour, soit une suppression proactive avant toute visualisation par les internautes. La plateforme supprime également 25 000 posts ou commentaires par jour et a révoqué 2 millions de votes jugés non authentiques sur les trois derniers mois. Pour les contenus violents ou haineux, les systèmes automatisés interviennent en moins de cinq secondes, réduisant de 40 % l'exposition des utilisateurs et diminuant de plus de 40 % le nombre de faux positifs (contenus incorrectement identifiés comme problématiques). Ces résultats illustrent l'efficacité croissante des outils d'IA dans la modération, bien que certains utilisateurs signalent des erreurs via le canal r/reddithelp.

Modération humaine et automatisée

Reddit combine modération automatisée et humaine pour maintenir la qualité de ses contenus. Entre juillet et décembre 2025, sur 2,2 milliards de nouveaux posts et commentaires, 154 millions ont fait l'objet d'une modération a posteriori (après publication). Parmi ces actions, 52,7 % ont été réalisées par des modérateurs bénévoles, 44,7 % par les équipes internes de Reddit, et 2,5 % (soit 3,9 millions) par des outils automatisés. La plateforme insiste sur le fait que ces systèmes ne remplacent pas les bénévoles, mais complètent leur travail, notamment pour détecter des schémas de spam plus subtils ou coordonnés que les humains pourraient manquer. Cette approche vise à préserver les principes fondateurs de Reddit, où la visibilité des contenus dépend des votes des utilisateurs.

Enjeux économiques et réglementaires

Reddit souligne que sa santé financière dépend de sa capacité à attirer les annonceurs, ce qui passe par une lutte efficace contre les contenus problématiques ou illégaux. En Europe, la plateforme se prépare à être désignée comme une VLOP (Very Large Online Platform) par la Commission européenne, un statut qui implique des obligations supplémentaires en matière de modération et de transparence. En février 2025, Reddit a déclaré avoir dépassé le seuil de 45 millions d'utilisateurs mensuels en Europe, un critère qui déclenche cette qualification. Si elle est confirmée, cette désignation soumettra Reddit à des règles strictes, comme celles du règlement sur les services numériques (DSA), renforçant ainsi la pression pour une modération toujours plus performante.

Ce que ça pourrait changer

Malgré leurs avancées, les outils de modération automatisée de Reddit ne sont pas infaillibles. Certains utilisateurs ont signalé des erreurs de modération sur le canal *r/reddithelp*, où les décisions automatisées sont parfois contestées. Par ailleurs, Reddit reconnaît que les contenus à faible valeur ajoutée, publiés par des humains avec l'aide de l'IA (comme des posts LinkedIn génériques), posent un défi particulier. Ces contenus, bien que légitimes, peuvent encombrer les communautés et réduire l'expérience utilisateur. La plateforme mise sur sa communauté de modérateurs bénévoles pour traiter ces cas, tout en continuant à améliorer ses algorithmes pour distinguer les contenus utiles des contenus indésirables.

Sujets complémentaires