Reddit đã bắt đầu triển khai hệ thống kiểm duyệt dựa trên AI, cho phép các tài khoản mới đăng bài mà không cần phải tích lũy điểm karma cao trước đó. Các thử nghiệm ban đầu tại một số cộng đồng cho thấy lượng bài đăng từ người mới tăng 22%, trong khi mức độ lạm dụng tổng thể vẫn giữ ở mức ổn định.

Tại sao sự thay đổi này lại quan trọng

Cho đến nay, nhiều subreddit yêu cầu ngưỡng karma hoặc tuổi tài khoản tối thiểu trước khi người dùng có thể đóng góp. Những quy định đó giúp ngăn chặn spam và quấy rối, nhưng chúng cũng chặn cả những người đăng bài lần đầu một cách hợp lệ, đặc biệt là trong các chủ đề ngách hoặc đang phát triển nhanh. Bằng cách thay thế rào cản dựa trên danh tiếng bằng một "điểm tin cậy" (trust score) do AI tạo ra, Reddit hy vọng sẽ giảm bớt sự khó khăn và mở rộng sự tham gia.

Công nghệ đằng sau bước đi này

Các kỹ sư của Reddit đã xây dựng các mô hình học máy có khả năng quét mọi bài đăng và bình luận trong thời gian thực. Hệ thống này khai thác từ hàng triệu quyết định kiểm duyệt trong quá khứ, mang lại cái nhìn rộng hơn so với các bộ lọc dựa trên quy tắc vốn được dùng để sàng lọc nội dung trước đây. Các khả năng của nó bao gồm:

  • Phân tích ngôn ngữ giúp gắn cờ các kiểu ngôn từ độc hại.
  • Nhận dạng hình ảnh và video giúp phát hiện các hành vi lạm dụng về mặt hình ảnh.
  • Các bộ quy tắc động có khả năng thích ứng với sự thay đổi về lưu lượng truy cập trong mỗi cộng đồng.

Điều này có ý nghĩa gì đối với người dùng mới

  1. Ít phải "cày" karma hơn – Người dùng có thể chia sẻ ý tưởng mà không cần phải tích lũy lượt upvote trước.
  2. Điểm tin cậy thay thế việc kiểm tra tuổi tài khoản – AI đánh giá chất lượng bài đăng thay vì dựa vào tuổi của tài khoản.
  3. Nhiều quan điểm đa dạng hơn – Những người từng cảm thấy bị gạt ra ngoài do rào cản gia nhập cao giờ đây có thể tham gia thảo luận.

Kết quả ban đầu

Tại các subreddit như r/technology, chương trình thí điểm đã ghi nhận mức tăng 22% hoạt động của những người đăng bài mới. Quan trọng là tỷ lệ spam hoặc quấy rối bị gắn cờ không hề tăng lên, cho thấy AI vẫn kiểm soát tốt tỷ lệ tín hiệu trên nhiễu (signal-to-noise ratio) trong khi vẫn mở rộng cơ hội cho những người mới.

Lưới an toàn từ con người

Reddit thừa nhận rằng AI không phải là không thể sai lầm. Một cơ chế kháng cáo cho phép người dùng phản đối các quyết định gỡ bỏ, và các kiểm duyệt viên là con người sẽ xem xét những kháng cáo đó. Những đánh giá này sẽ được đưa ngược lại vào dữ liệu huấn luyện, giúp mô hình trở nên sắc bén hơn theo thời gian.

Những điều cần theo dõi tiếp theo

  • Mở rộng quy mô mô hình – Liệu AI có duy trì được độ chính xác khi được triển khai trên hàng trăm nghìn subreddit của nền tảng?
  • Khối lượng công việc của kiểm duyệt viên – Phản hồi từ cộng đồng có thể ảnh hưởng đến cách hệ thống được điều chỉnh.