Reddit a mis à jour ses défenses automatisées avec des modèles de langage pour lutter contre le spam et les contenus haineux. Une réponse IA qui combat aussi le feu par le feu.
Reddit est devenu une cible privilégiée pour une nouvelle forme de marketing appelée Generative Engine Optimisation. De faux avis et des publications promotionnelles sont semés sur la plateforme. Leur objectif est que les grands modèles de langage les reprennent ensuite comme des recommandations authentiques.Reddit utilise l'IA pour se défendre
La plateforme a investi dans des outils automatisés qui intègrent désormais des modèles de langage pour une détection plus fine. Selon Reddit, ces systèmes permettent de capter les schémas subtils et coordonnés de comportements frauduleux et de surenchère artificielle que les anciennes méthodes manquaient.
La technologie analyse les signaux dès la création d'un compte pour bloquer les acteurs malveillants avant même qu'ils ne publient. Les résultats obtenus sont jugés significatifs.
Reddit bloque 23 millions de vues de spam par jour et révoque près de 2 millions de votes inauthentiques quotidiennement. Entre janvier et mars 2026, l'exposition des utilisateurs au spam a chuté de 20 % par rapport au trimestre précédent.
Une lutte au-delà du spam marketing
Reddit utilise ces outils avancés pour combattre les contenus dangereux comme la haine, le harcèlement ou les menaces violentes. L'entreprise a récemment étendu les systèmes automatisés à tout le contenu textuel en anglais, ce qui a permis d'accélérer les interventions.
Le temps moyen entre la détection et la suppression d'un contenu haineux ou violent est désormais inférieur à cinq secondes. Cette efficacité a permis de réduire de plus de 40 % l'exposition des utilisateurs à ces contenus potentiellement nuisibles, tout en diminuant les faux positifs.
L'automatisation ne suffit pasReddit insiste sur une approche à plusieurs niveaux, combinant technologie et intervention humaine. La modération de la plateforme repose sur les équipes de sécurité internes de Reddit, les modérateurs de communauté et les utilisateurs eux-mêmes.
Les équipes internes utilisent les outils automatisés et procèdent à des révisions humaines à grande échelle. Ensuite, les modérateurs bénévoles des communautés, qui ont réalisé plus de la moitié des suppressions au second semestre 2025, jouent un rôle important.
Le système de vote par les utilisateurs aide enfin à réduire rapidement la visibilité des contenus de faible qualité ou manipulateurs.
merci à GNT
