Reddit a commencé à déployer une modération pilotée par l'IA qui permet aux nouveaux comptes de publier sans avoir préalablement accumulé un score de karma élevé. Les premiers essais dans une poignée de communautés ont montré une augmentation de 22 % des publications de nouveaux venus, tandis que les niveaux globaux d'abus sont restés stables.

Pourquoi ce changement est important

Jusqu'à présent, de nombreux subreddits exigeaient un seuil minimum de karma ou d'ancienneté du compte avant que les utilisateurs ne puissent contribuer. Ces règles permettent d'écarter le spam et le harcèlement, mais elles bloquent également les premiers contributeurs légitimes, en particulier dans les sujets de niche ou à croissance rapide. En remplaçant une barrière basée sur la réputation par un « score de confiance » généré par l'IA, Reddit espère réduire les frictions et élargir la participation.

La technologie derrière cette initiative

Les ingénieurs de Reddit ont conçu des modèles d'apprentissage automatique qui analysent chaque publication et commentaire en temps réel. Le système s'appuie sur des millions de décisions de modération passées, ce qui lui donne une perspective plus large que les filtres basés sur des règles qui triaient le contenu auparavant. Ses capacités incluent :

  • L'analyse du langage qui signale les schémas de discours toxiques.
  • La reconnaissance d'images et de vidéos qui détecte les abus visuels.
  • Des ensembles de règles dynamiques qui s'adaptent aux variations du volume de trafic dans chaque communauté.

Ce que cela signifie pour les nouveaux utilisateurs

  1. Moins d'efforts pour accumuler du karma – Les utilisateurs peuvent partager des idées sans avoir à accumuler des votes positifs au préalable.
  2. Les scores de confiance remplacent la vérification de l'ancienneté – L'IA évalue la qualité des soumissions au lieu de l'âge du compte.
  3. Des points de vue plus diversifiés – Les personnes qui se sentaient exclues par des barrières à l'entrée élevées peuvent désormais participer aux discussions.

Premiers résultats

Dans des subreddits tels que r/technology, le projet pilote a enregistré une augmentation de 22 % de l'activité des nouveaux contributeurs. Fait crucial, la proportion de spam ou de harcèlement signalé n'a pas augmenté, ce qui suggère que l'IA maintient un bon rapport signal/bruit tout en ouvrant la voie aux nouveaux venus.

Le filet de sécurité humain

Reddit reconnaît que l'IA n'est pas infaillible. Un mécanisme de recours permet aux utilisateurs de contester les décisions de suppression, et des modérateurs humains examinent ces recours. Ces examens alimentent ensuite les données d'entraînement, affinant ainsi le modèle au fil du temps.

À surveiller prochainement

  • Le passage à l'échelle du modèle – L'IA maintiendra-t-elle sa précision lors de son déploiement sur les centaines de milliers de subreddits de la plateforme ?
  • La charge de travail des modérateurs – Les retours de la communauté pourraient influencer la manière dont le système est ajusté.