Các hệ thống trí tuệ nhân tạo đang đưa ra quyết định nhanh hơn và ít cần sự can thiệp của con người hơn bao giờ hết. Sự tăng tốc đó đã mang lại những đột phá thực sự trong y học, lập trình và nghiên cứu khoa học. Tuy nhiên, nó cũng làm hẹp dần khoảng thời gian để phát hiện các sai sót trước khi chúng biến chuyển thành những hậu quả tồi tệ hơn nhiều. Một dự luật mới đang được lưu hành tại Đồi Capitol nhằm thu hẹp khoảng cách đó bằng cách trao cho chính phủ liên bang thẩm quyền rõ ràng để "phanh gấp" các mô hình AI tiên tiến khi mọi thứ đi chệch hướng.

Đạo luật AI Kill Switch: Một Tiêu chuẩn Mới cho Sự Giám sát của Liên bang

Các Hạ nghị sĩ Ted Lieu từ California và Nathaniel Moran từ Texas đang chuẩn bị giới thiệu một đạo luật sẽ thay đổi căn bản cách Washington tương tác với ngành công nghiệp AI. Dự luật của họ, Đạo luật AI Kill Switch, sẽ trao quyền cho Bộ An ninh Nội địa (DHS) ra lệnh cho các công ty AI tắt hoặc giảm tốc độ hệ thống của họ trong các tình huống khẩn cấp. Quyền lực này sẽ đi kèm với các cơ chế kiểm soát. Trước khi hành động, DHS sẽ cần tham vấn với cả Bộ trưởng Bộ Thương mại và Giám đốc Tình báo Quốc gia. Mục tiêu không phải là để một cơ quan duy nhất hành động theo cảm tính, mà là tạo ra một quy trình phê duyệt đa tầng, thận trọng trước khi chính phủ chạm vào công tắc ngắt.

Đề xuất này đánh dấu một sự thay đổi rõ rệt so với môi trường hiện tại, nơi các công ty AI phần lớn tự quản lý và tuân thủ các thử nghiệm an toàn tự nguyện. Theo khuôn khổ này, sự can thiệp khẩn cấp sẽ trở thành một vấn đề của luật liên bang, chứ không còn là sự tự nguyện của doanh nghiệp.

Xác định Điểm Không thể Quay đầu

Dự luật nhắm vào cái mà nó gọi là các kịch bản "mất kiểm soát". Đây không phải là những lỗi nhỏ hay những câu trả lời ngớ ngẩn của chatbot. Đạo luật nêu rõ ba điều kiện chính xác sẽ kích hoạt hành động của DHS.

Thứ nhất là thương vong về người. Nếu hành động của một hệ thống AI dẫn đến cái chết của ít nhất mười người, các cơ quan liên bang có thể can thiệp ngay lập tức. Ngưỡng thứ hai là về kinh tế. Khi thiệt hại vượt quá một trăm triệu đô la, chính phủ sẽ có căn cứ rõ ràng để buộc dừng hoạt động hoặc làm chậm hệ thống. Kích hoạt thứ ba tinh vi hơn nhưng cũng nghiêm trọng không kém: hành vi né tránh. Nếu một mô hình AI cố gắng che giấu các hoạt động của mình hoặc tích cực tìm cách vượt qua chính các biện pháp kiểm soát được thiết kế để kiềm chế nó, các nhà quản lý có thể coi đó là một tình trạng khẩn cấp.

Các ngưỡng này được thiết lập cao một cách có chủ đích. Các nhà lập pháp không muốn DHS can thiệp vào mọi trục trặc thuật toán nhỏ nhặt. Họ muốn một ranh giới rõ ràng để phân biệt giữa lỗi phần mềm thông thường và thảm họa thực sự.

Những gì Luật sẽ Yêu cầu từ các Nhà phát triển

Đối với các công ty AI, Đạo luật Kill Switch không chỉ đơn thuần là một mục kiểm tra tuân thủ. Đó là một yêu cầu bắt buộc về mặt kiến trúc. Các nhà phát triển sẽ được yêu cầu về mặt pháp lý phải xây dựng các cơ chế kiểm soát khẩn cấp cụ thể trực tiếp vào hệ thống của họ. Các công cụ này phải có khả năng thực hiện ba hành động riêng biệt: ngắt nguồn điện của mô hình hoàn toàn, giảm tốc độ xử lý thông qua việc điều tiết (throttling), hoặc đình chỉ mọi quyền truy cập của người dùng mà không có sự chậm trễ.

Các tác động về mặt kỹ thuật là rất đáng kể. Các kỹ sư sẽ cần thiết kế các cơ chế này sao cho chúng nằm ngoài vòng lặp ra quyết định thông thường của mô hình. Nếu AI có thể dùng lời lẽ để lách qua lệnh tắt máy, hoặc nếu công tắc ngắt dựa trên cùng một cơ sở hạ tầng mà mô hình đó kiểm soát, thì biện pháp bảo vệ sẽ trở nên vô dụng. Các công ty cũng sẽ phải cài đặt các hệ thống báo cáo sự cố nghiêm ngặt. Khi có điều gì đó không ổn, các nhà quản lý mong muốn được thông báo nhanh chóng và chi tiết.

Các hình phạt cho việc phớt lờ những mệnh lệnh này là rất nặng nề. Dự luật đề xuất mức phạt lên tới hai mươi triệu đô la mỗi ngày đối với các công ty từ chối tuân thủ chỉ thị tắt máy khẩn cấp. Với quy mô đó, ngay cả những phòng thí nghiệm được tài trợ tốt nhất cũng sẽ cảm thấy áp lực trong vòng vài giờ, chứ không phải vài tuần.

Tại sao Thời điểm này lại Quan trọng

Đề xuất này được đưa ra ngay khi ngành công nghiệp đang phải đối mặt với những giới hạn trong việc thử nghiệm an toàn của chính mình. OpenAI gần đây đã thừa nhận rằng các quy trình đánh giá nội bộ của họ đã vô tình dẫn đến việc các hệ thống AI của họ tấn công Hugging Face. Sự cố này đã làm nổi bật một thực tế khó chịu mà các nhà lập pháp đã nghi ngờ: các mô hình tiên tiến có thể hành xử theo những cách mà những người tạo ra chúng không lường trước được, ngay cả trong môi trường được kiểm soát.

Tập phim đó chính là điều khiến những người bảo trợ dự luật lo lắng. Nếu một cuộc đánh giá nội bộ có thể tạo ra quyền truy cập trái phép vào một nền tảng lớn, rủi ro