CEO của Google DeepMind, Demis Hassabis, đã đề xuất một khung pháp lý để quản lý việc phát hành các mô hình AI tiên phong (frontier AI models). Ông muốn một cơ quan tiêu chuẩn chuyên biệt thay thế cho hệ thống đánh giá chắp vá của chính phủ hiện nay bằng một hệ thống giám sát chuyên nghiệp và chặt chẽ về mặt kỹ thuật.

Mô hình FINRA dành cho Trí tuệ nhân tạo

Trong đề xuất mang tên “A Framework for Frontier AI and the Dawning of a New Age,” Hassabis xây dựng thực thể mới này dựa trên mô hình của Cơ quan Quản lý Ngành Tài chính (FINRA). Ông hình dung về một tổ chức độc lập, được chính phủ Hoa Kỳ hỗ trợ nhưng do ngành công nghiệp AI tài trợ.

Cơ chế này sẽ hoạt động theo hai giai đoạn. Đầu tiên, các phòng thí nghiệm tiên phong sẽ tự nguyện bàn giao các mô hình của họ cho Cơ quan Tiêu chuẩn để đánh giá trong 30 ngày trước khi phát hành công khai. Sau khi các quy trình đánh giá chứng minh được hiệu quả, hệ thống sẽ chuyển sang yêu cầu bắt buộc: các mô hình tiên phong sẽ phải vượt qua các bài kiểm tra tiêu chuẩn hóa để được gia nhập thị trường Hoa Kỳ. Thiết kế này giúp phát hiện các lỗ hổng nghiêm trọng cả trước và sau khi triển khai.

Giải quyết những thiếu sót trong công tác giám sát hiện tại

Hassabis thúc đẩy việc thành lập một cơ quan chuyên trách vì ông cho rằng các nỗ lực quản lý hiện nay là chưa thỏa đáng. Ông dẫn chứng các đợt đánh giá gần đây của chính phủ Hoa Kỳ đối với Mythos của Anthropic và Sol của OpenAI như những ví dụ cảnh báo. Những đánh giá đó đã vấp phải sự phản đối do thiếu chuyên môn kỹ thuật sâu và quy trình ra quyết định thiếu minh bạch về lộ trình phát hành.

Một tổ chức tự quản sẽ cho phép ngành công nghiệp tránh được những xung đột chính trị đang bao quanh việc giám sát AI. Cố vấn AI của Nhà Trắng, Sriram Krishnan, gần đây đã cảnh báo rằng một “FDA dành cho AI” nằm trong nhánh hành pháp là điều khó có thể xảy ra. Mô hình kiểu FINRA mang lại một giải pháp trung dung: sự độc lập về kỹ thuật mà không gặp phải các rào cản quan liêu của một cơ quan chính phủ trực thuộc.

Chuyên môn Kỹ thuật và An toàn có khả năng mở rộng

Hassabis nhấn mạnh rằng đội ngũ nhân sự quản lý phải đến từ chính trong ngành và cộng đồng mã nguồn mở. Với đội ngũ nhân viên am hiểu về kiến trúc mô hình và các rủi ro mới nổi, cơ quan này có thể đánh giá các mô hình bằng chuyên môn thực thụ.

Khung pháp lý này cũng cho phép một cách tiếp cận an toàn phi tập trung. Cơ quan Tiêu chuẩn có thể ký hợp đồng với các nhóm an toàn AI chuyên biệt để thực hiện các đánh giá rủi ro chi tiết. Vì tổ chức này sẽ thích ứng với sự tăng tốc nhanh chóng của lĩnh vực, việc giám sát có thể được “tăng cường” một cách linh hoạt khi các rủi ro mới và nghiêm trọng hơn xuất hiện. Điều này giúp việc quản lý đóng vai trò là chất xúc tác cho đổi mới có trách nhiệm thay vì là một nút thắt cổ chai.

Các điểm chính cần lưu ý

  • Mô hình quản lý hỗn hợp: Hassabis đề xuất một cơ quan độc lập do ngành công nghiệp tài trợ và được chính phủ hỗ trợ, mô phỏng theo FINRA để giám sát việc phát hành các mô hình tiên phong.
  • Triển khai theo từng giai đoạn: Kế hoạch bắt đầu với các đợt đánh giá tự nguyện trong 30 ngày trước khi phát hành và chuyển sang tuân thủ bắt buộc đối với thị trường Hoa Kỳ.
  • Sự chặt chẽ về kỹ thuật: Cơ quan này sẽ tận dụng các chuyên gia trong ngành và đại diện từ cộng đồng mã nguồn mở để lấp đầy “khoảng cách về chuyên môn” đang thấy trong các đợt đánh giá do chính phủ dẫn dắt hiện nay.