Trưởng bộ phận đạo đức của OpenAI đã rời đi sau chưa đầy một năm, một động thái được tờ Financial Times đưa tin đã làm dấy lên những nghi ngờ về các quy trình kiểm tra an toàn nội bộ của phòng thí nghiệm này. Sự ra đi này có ý nghĩa quan trọng vì vai trò này được kỳ vọng sẽ đóng vai trò là "phanh hãm" nội bộ của công ty đối với các đợt triển khai rủi ro, và việc vị trí này đột ngột trống chỗ cho thấy chiếc phanh đó có thể đang bị thiếu hụt.
Một mô hình rời đi hàng loạt
Sự từ chức này không phải là một sự việc đơn lẻ. Trong hai năm qua, OpenAI đã chứng kiến một chuỗi các nhân viên tập trung vào mảng an toàn rời bỏ công ty. Vào năm 2024, một vài thành viên của đội ngũ Superalignment đã rời đi. Trước đó, các thành viên hội đồng quản trị đã bị bãi nhiệm trong một cuộc tranh giành quyền quản trị vào năm 2023. Chủ đề lặp đi lặp lại vẫn là một: các nhà nghiên cứu gia nhập để bảo vệ công nghệ, gặp phải xung đột, và sau đó rời đi.
Vai trò này vốn được kỳ vọng làm gì
Trưởng bộ phận đạo đức giám sát các quyết định triển khai, các thực hành xử lý dữ liệu và việc kiểm duyệt nội bộ đối với các khả năng có tiềm ẩn nguy cơ gây hại. Khi người nắm giữ vị trí đó rời đi nhanh chóng, nó đặt ra câu hỏi liệu quyền hạn thực sự có tồn tại hay không.
Các lý do khả thi cho sự biến động nhân sự này
- Quyền hạn hạn chế trong việc ngăn chặn các đợt phát hành – Nếu vai trò này không thể buộc một đội ngũ sản phẩm phải dừng việc ra mắt, thì vị trí này chỉ mang tính biểu tượng thay vì có chức năng thực tế.
- Áp lực ưu tiên tốc độ hơn sự an toàn – Sự cạnh tranh với các gã khổng lồ AI khác tạo ra một môi trường nơi việc bàn giao tính năng nhanh chóng được coi trọng, thường là đánh đổi bằng việc đánh giá rủi ro kỹ lưỡng.
- Các ưu tiên thương mại lấn át công việc an toàn – Ban lãnh đạo có thể ưu tiên các dự án tạo ra doanh thu, khiến các đội ngũ an toàn bị thiếu nhân sự và quá tải.
- Kiệt sức do xung đột liên tục – Những va chạm lặp đi lặp lại giữa những người ủng hộ an toàn và các kỹ sư sản phẩm có thể làm bào mòn ngay cả những nhà nghiên cứu tận tâm nhất.
Những yếu tố này phản ánh một sự căng thẳng rộng lớn hơn trong ngành: các phòng thí nghiệm khen thưởng những người tung ra các tính năng mới, trong khi những người cảnh báo nguy hiểm đôi khi bị coi là những vật cản.
Quan điểm ngược lại: các biện pháp bảo vệ nội bộ có thể vẫn tồn tại
OpenAI chưa công khai chi tiết về quyền hạn của trưởng bộ phận đạo đức, và công ty cũng chưa đưa ra tuyên bố nào về việc từ chức. Có khả năng các cơ chế nội bộ khác—chẳng hạn như các đợt đánh giá an toàn liên chức năng hoặc các hội đồng cố vấn bên ngoài—vẫn đang tiếp tục hoạt động. Tuy nhiên, nếu không có bằng chứng cụ thể về hiệu quả của chúng, sự trống chỗ này vẫn để lại một khoảng trống đáng kể.
Tại sao sự ra đi này lại quan trọng hơn cả phạm vi OpenAI
Nếu một phòng thí nghiệm AI vì lợi nhuận không thể giữ chân một trưởng bộ phận đạo đức trong hơn một năm, thì mô hình đưa các chuyên gia an toàn vào bên trong các doanh nghiệp thương mại có vẻ rất mong manh. Anthropic, được thành lập với lời hứa về một AI an toàn hơn, cũng báo cáo những áp lực tương tự, và ngay cả các công ty lớn hơn với nguồn lực dồi dào cũng đã ghi nhận sự xung đột giữa các đơn vị đạo đức và các nhóm sản phẩm.
Điều gì có thể thay đổi cục diện này
- Các kiểm toán viên độc lập có tầm ảnh hưởng về mặt pháp lý – Các cơ quan bên ngoài có thể thực thi việc tuân thủ, thay vì chỉ dựa vào thiện chí nội bộ.
- Các đánh giá an toàn được pháp luật quy định – Các quy tắc yêu cầu phải có phân tích rủi ro được lập thành văn bản trước khi bất kỳ mô hình mới nào được phát hành.
- Các biện pháp bảo vệ người tố giác mạnh mẽ hơn – Các cơ chế bảo vệ cho phép nhân viên nêu lên các mối quan ngại mà không sợ bị trả đũa.
- Công khai các cảnh báo an toàn – Sự minh bạch cho phép các chuyên gia bên ngoài và công chúng thấy được những rủi ro nào đã được xác định.
- Tài trợ cho nghiên cứu an toàn tách biệt khỏi các động cơ lợi nhuận – Các khoản tài trợ hoặc nguồn vốn công giúp giữ cho công việc an toàn không bị ảnh hưởng bởi thời hạn ra mắt sản phẩm.
Những điều cần theo dõi tiếp theo
Khi một nhà lãnh đạo đạo đức không thể trụ lại quá một năm, cấu trúc nền tảng sẽ bị đặt dấu hỏi. Cho đến khi sự cân bằng quyền lực giữa tham vọng sản phẩm và trách nhiệm an toàn được định hình lại, chu kỳ mất mát nhân tài có khả năng sẽ lặp lại. Những tháng tới sẽ cho thấy liệu OpenAI—và cộng đồng AI rộng lớn hơn—có thể phá vỡ mô hình đó hay không.
