Dự thảo quy định “Chat Control” của Liên minh Châu Âu sẽ mở rộng việc kiểm duyệt nội dung bắt buộc đối với bất kỳ dịch vụ nào thực hiện giao tiếp giữa cá nhân với nhau – hiện bao gồm cả các giao diện trò chuyện AI. Nếu được thông qua, các nhà cung cấp AI hội thoại có thể bị buộc phải quét mọi câu lệnh (prompt) của người dùng để tìm kiếm tài liệu bất hợp pháp, biến các câu hỏi riêng tư về sức khỏe, pháp luật hoặc kinh doanh thành các điểm dữ liệu mà các cơ quan chức năng sẽ tự động kiểm tra.
Tại sao luật này hiện đang vươn tới AI
Ban đầu, EU nhằm mục đích hạn chế nội dung bất hợp pháp, đặc biệt là tài liệu lạm dụng tình dục trẻ em, trong các ứng dụng nhắn tin riêng tư. Tuy nhiên, cách diễn đạt của luật không chỉ dừng lại ở SMS hay các nền tảng nhắn tin. Nó định nghĩa “giao tiếp giữa cá nhân” đủ rộng để bao hàm bất kỳ công cụ nào mà hai hoặc nhiều người trao đổi tin nhắn, và các nhà quản lý đã diễn giải định nghĩa đó bao gồm cả các cửa sổ trò chuyện AI.
Các đánh giá kỹ thuật từ một số quốc gia thành viên lưu ý rằng các cuộc hội thoại AI thường chứa nhiều chi tiết nhạy cảm hơn so với các văn bản thông thường – người dùng thường xuyên tiết lộ lịch sử y tế, chiến lược pháp lý hoặc các kế hoạch kinh doanh độc quyền để nhận lời khuyên từ một mô hình. Chính các bộ lọc tự động dùng để quét tin nhắn giữa các điện thoại có thể được tái sử dụng để phân tích các câu lệnh AI, và các quan chức lo ngại rằng những kẻ xấu có thể lợi dụng các mô hình tạo sinh để sản xuất nội dung bất hợp pháp ở quy mô lớn.
Những gì đang diễn ra với dữ liệu AI
Ngay cả khi không có luật mới, các công ty AI lớn đã thu thập và lưu giữ dữ liệu đầu vào của người dùng. OpenAI lưu trữ các cuộc hội thoại theo mặc định và sử dụng chúng để cải thiện các mô hình của mình, đồng thời chia sẻ dữ liệu với các đối tác và với các cơ quan thực thi pháp luật khi có yêu cầu. Google tích hợp nhật ký trò chuyện AI vào cùng một hồ sơ chứa lịch sử tìm kiếm và dữ liệu vị trí của người dùng, tạo ra một bức tranh chi tiết hơn về hành vi cá nhân. Anthropic, mặc dù được quảng bá là tập trung nhiều hơn vào quyền riêng tư, vẫn lưu giữ các câu lệnh của người dùng và tuân thủ các lệnh pháp lý về việc tiết lộ thông tin.
Nếu “Chat Control” mở rộng sang AI, trải nghiệm người dùng có thể thay đổi đáng kể:
- Mọi câu lệnh sẽ được chạy qua các trình quét tự động trước khi mô hình xử lý nó.
- Hệ thống có thể đối chiếu các cuộc trò chuyện AI với lịch sử nhắn tin hiện có của người dùng, xây dựng một cái nhìn tổng thể về các hoạt động liên lạc của họ.
- Một số chủ đề nhất định – ví dụ, hướng dẫn tổng hợp hóa chất hoặc các chiến thuật pháp lý chi tiết – có thể bị gắn cờ trong thời gian thực và báo cáo cho các cơ quan chức năng.
Những rủi ro đối với nhà phát triển và người dùng
Các nhà phát triển sẽ phải đối mặt với một lớp tuân thủ mới có thể làm tăng chi phí vận hành và làm chậm quá trình cập nhật mô hình. Họ sẽ cần tích hợp hoặc mua bản quyền các công cụ quét, duy trì nhật ký kiểm tra (audit trails) và đối mặt với rủi ro bị phạt nếu bỏ lỡ các phát hiện vi phạm. Các công ty nhỏ hơn, đặc biệt là những công ty cung cấp các mô hình mã nguồn mở, có thể thấy gánh nặng này là quá lớn và có thể bị buộc phải rời khỏi thị trường.
Người dùng đứng trước nguy cơ mất đi quyền riêng tư mà nhiều người vốn coi là thiết yếu. Dữ liệu câu lệnh có thể tiết lộ những suy nghĩ thầm kín, các mối quan tâm về sức khỏe cá nhân hoặc các ý tưởng kinh doanh bảo mật. Một khi thông tin đó nằm trong một kho lưu trữ trung tâm, nó sẽ trở nên dễ bị lạm dụng, rò rỉ vô ý hoặc bị giám sát rộng rãi. Việc bảo vệ dữ liệu đó – thông qua thời gian quản lý các cài đặt hoặc mua thêm các công cụ bảo mật – sẽ chuyển từ nhà cung cấp sang cá nhân người dùng.
Lập luận phản bác từ các nhà quản lý
Các nhà hoạch định chính sách lập luận rằng cùng một công nghệ được sử dụng để bảo vệ trẻ em trực tuyến có thể được áp dụng cho AI mà không xâm phạm các mục đích sử dụng hợp pháp. Họ chỉ ra rằng tội phạm đã và đang sử dụng các mô hình tạo sinh để soạn thảo nội dung bất hợp pháp, và một khung quét thống nhất sẽ lấp đầy lỗ hổng này. Họ nói rằng mục tiêu của mình không phải là giám sát mọi cuộc hội thoại mà là để bắt được một số ít những trường hợp vi phạm pháp luật.
Các bước thực tế để giữ kín các câu lệnh của bạn
Ngay cả khi luật được thông qua, người dùng có thể giảm thiểu rủi ro bằng cách tránh xa các dịch vụ AI dựa trên đám mây đối với các vấn đề nhạy cảm. Một hệ sinh thái ngày càng phát triển của các mô hình chạy cục bộ giúp việc này trở nên khả thi trên các phần cứng dành cho người tiêu dùng:
- Chạy mô hình trên máy tính của riêng bạn. Llama 3.2 và Mistral có thể hoạt động trên các PC chơi game tiêu chuẩn. Các công cụ như Ollama giúp tự động hóa việc cài đặt và quản lý tài nguyên, trong khi Open WebUI cung cấp một giao diện người dùng (front-end) sạch sẽ để tương tác.
- Từ chối thu thập dữ liệu huấn luyện. Hầu hết các nền tảng đều cung cấp một cài đặt để ngăn các câu lệnh của bạn được sử dụng để cải thiện mô hình. Hãy bật tính năng này ở bất cứ đâu có sẵn.
- Xóa các cuộc hội thoại cũ. Thường xuyên xóa lịch sử trò chuyện để hạn chế dữ liệu được lưu giữ.
- Tránh sử dụng AI đám mây cho các chủ đề bảo mật. Hãy dành riêng các mô hình chạy tại chỗ (on-premise) cho các truy vấn y tế, tư vấn pháp lý hoặc bất kỳ cuộc thảo luận quan trọng nào trong kinh doanh.
Các mô hình cục bộ có thể không sánh được với sự đa dạng của GPT-4, nhưng chúng có thể xử lý các tác vụ viết lách hàng ngày, hỗ trợ lập trình và nghiên cứu. Ưu điểm then chốt là các câu lệnh không bao giờ rời khỏi thiết bị của bạn, giúp loại bỏ rủi ro bị quét tự động.
Những gì cần theo dõi tiếp theo
Quy trình lập pháp của EU sẽ diễn ra trong những tháng tới, với các ủy ban đang xem xét phạm vi của "giao tiếp giữa cá nhân với cá nhân". Các nhóm ngành công nghiệp hiện đang vận động hành lang để được miễn trừ hoặc có các định nghĩa rõ ràng hơn nhằm loại trừ các dịch vụ chat AI. Hãy theo dõi các tuyên bố từ các nhà cung cấp AI lớn – họ có thể triển khai các kiểm soát quyền riêng tư mới hoặc thậm chí thách thức quy định này tại tòa án.
Nếu quy định được thông qua như dự thảo, bài toán về quyền riêng tư cho người dùng AI sẽ thay đổi đáng kể. Cho đến lúc đó, hãy coi mọi câu lệnh như thể có bên thứ ba có thể đọc được và áp dụng các giải pháp ưu tiên cục bộ (local-first) bất cứ khi nào có thể. Các câu hỏi của bạn là riêng tư; việc bảo vệ chúng nên là một ưu tiên, chứ không phải là một ý nghĩ nảy ra sau cùng.
