Reddit은 높은 카르마(karma) 점수를 먼저 쌓지 않아도 신규 계정이 게시물을 올릴 수 있도록 하는 AI 기반 중재(moderation) 기능을 도입하기 시작했습니다. 일부 커뮤니티에서 진행된 초기 테스트 결과, 전체적인 악용 수준은 일정하게 유지되면서도 신규 사용자의 게시물은 22% 증가한 것으로 나타났습니다.
이러한 변화가 중요한 이유
지금까지 많은 서브레딧(subreddit)은 사용자가 기여하기 전에 최소 카르마 점수나 계정 생성 기간이라는 문턱을 요구했습니다. 이러한 규칙은 스팸과 괴롭힘을 방지하지만, 특히 니치(niche)하거나 빠르게 성장하는 주제의 경우 정당한 첫 게시물 작성자들까지 차단하는 결과를 초래했습니다. Reddit은 평판 기반의 진입 장벽을 AI가 생성한 '신뢰 점수(trust score)'로 교체함으로써, 참여 과정의 마찰을 줄이고 참여 폭을 넓히고자 합니다.
이번 조치의 배후에 있는 기술
Reddit 엔지니어들은 모든 게시물과 댓글을 실시간으로 스캔하는 머신러닝 모델을 구축했습니다. 이 시스템은 수백만 건의 과거 중재 결정을 학습하여, 기존의 규칙 기반 필터보다 더 넓은 관점을 제공합니다. 주요 기능은 다음과 같습니다:
- 언어 분석이 유해한 언어 패턴을 감지합니다.
- 이미지 및 비디오 인식이 시각적 악용 사례를 찾아냅니다.
- 동적 규칙 세트가 각 커뮤니티의 변화하는 트래픽 양에 맞춰 적응합니다.
신규 사용자에게 미치는 영향
- 카르마를 쌓기 위한 수고 감소 – 사용자는 먼저 추천(upvotes)을 많이 받지 않아도 아이디어를 공유할 수 있습니다.
- 계정 생성 기간 대신 신뢰 점수 적용 – AI가 계정 생성 기간 대신 제출물의 품질을 평가합니다.
- 더욱 다양한 관점 – 높은 진입 장벽 때문에 소외감을 느꼈던 사람들도 이제 토론에 참여할 수 있습니다.
초기 결과
r/technology와 같은 서브레딧의 파일럿 테스트에서는 신규 게시자 활동이 22% 증가했습니다. 결정적으로, 신고된 스팸이나 괴롭힘의 비율은 상승하지 않았으며, 이는 AI가 신규 사용자에게 기회를 열어주면서도 신호 대 잡음비(signal-to-noise ratio)를 적절히 유지하고 있음을 시사합니다.
인간 안전망
Reddit은 AI가 완벽하지 않다는 점을 인정합니다. 이의 신청 메커니즘을 통해 사용자는 삭제 결정에 불복할 수 있으며, 인간 중재자가 이러한 이의 신청을 검토합니다. 이러한 검토 결과는 다시 학습 데이터로 피드백되어 시간이 지남에 따라 모델을 더욱 정교하게 만듭니다.
향후 주목할 점
- 모델의 확장성 – AI가 플랫폼 내 수십만 개의 서브레딧으로 확대 적용될 때도 정확도를 유지할 수 있을까요?
- 중재자의 업무량 – 커뮤니티의 피드백이 시스템 조정 방식에 영향을 미칠 수 있습니다.
