Reddit is begonnen met het uitrollen van AI-gestuurde moderatie, waardoor nieuwe accounts kunnen posten zonder eerst een hoge karma-score te behalen. Vroege proeven in een handvol communities lieten een stijging van 22% in berichten van nieuwkomers zien, terwijl het algemene niveau van misbruik gelijk bleef.
Waarom deze verschuiving belangrijk is
Tot nu toe vereisten veel subreddits een minimum aan karma of een bepaalde accountleeftijd voordat gebruikers konden bijdragen. Die regels houden spam en intimidatie buiten de deur, maar ze blokkeren ook legitieme nieuwe posters, vooral in niche- of snelgroeiende onderwerpen. Door een op reputatie gebaseerde drempel te vervangen door een door AI gegenereerde "trust score", hoopt Reddit de drempel te verlagen en de deelname te vergroten.
De technologie achter deze stap
Reddit-engineers hebben machine learning-modellen gebouwd die elk bericht en elke reactie in realtime scannen. Het systeem put uit miljoenen eerdere moderatiebeslissingen, waardoor het een breder perspectief heeft dan de op regels gebaseerde filters die voorheen de inhoud controleerden. De mogelijkheden omvatten:
- Taalanalyse die giftige spraakpatronen markeert.
- Beeld- en videorecognitie die visueel misbruik opspoort.
- Dynamische regelsets die zich aanpassen aan wisselende verkeersvolumes in elke community.
Wat dit betekent voor nieuwe gebruikers
- Minder 'grinden' voor karma – Gebruikers kunnen ideeën delen zonder eerst upvotes te verzamelen.
- Trust scores vervangen leeftijdscontroles – De AI evalueert de kwaliteit van de inzending in plaats van de accountleeftijd.
- Meer diverse standpunten – Mensen die zich uitgesloten voelden door hoge toelatingsdrempels, kunnen nu deelnemen aan discussies.
Vroege resultaten
In subreddits zoals r/technology zag het pilotproject een stijging van 22% in de activiteit van nieuwe posters. Cruciaal is dat het aandeel gemarkeerde spam of intimidatie niet steeg, wat suggereert dat de AI de signaal-ruisverhouding onder controle houdt terwijl er ruimte wordt geboden aan nieuwkomers.
Het menselijke vangnet
Reddit erkent dat AI niet onfeilbaar is. Een bezwaarprocedure stelt gebruikers in staat om beslissingen over verwijdering aan te vechten, en menselijke moderators beoordelen die bezwaren. Die beoordelingen worden teruggekoppeld naar de trainingsdata, waardoor het model in de loop van de tijd wordt aangescherpt.
Waar we op moeten letten
- Opschalen van het model – Zal de AI zijn nauwkeurigheid behouden naarmate deze wordt uitgerold naar de honderdduizenden subreddits van het platform?
- Werkdruk van moderators – Feedback van de community kan invloed hebben op hoe het systeem wordt aangepast.
