Model Context Protocol (MCP) đã được loại bỏ các ID phiên (session ID) tích hợp sẵn, và NVIDIA đang dẫn đầu một liên minh mở nhằm tăng cường tính bảo mật cho các tác nhân AI (AI agents). Những thay đổi này cho phép các trang trại máy chủ có thể đặt sau các bộ cân bằng tải HTTP thông thường và cung cấp cho các đội ngũ bảo mật một bộ công cụ dùng chung để chạy các mô hình tại chỗ (on-premises), một sự chuyển dịch có thể vẽ lại bản đồ hạ tầng và quản trị tác nhân.

MCP không lưu trạng thái giúp loại bỏ các trạng thái ẩn

Thiết kế ban đầu của MCP đã tích hợp một mã định danh phiên vào mỗi yêu cầu, buộc các máy chủ phải theo dõi tiến trình của từng máy khách. Đặc tả mới đẩy các tác vụ chạy lâu vào các phần mở rộng rõ ràng—chẳng hạn như mô-đun "Tasks"—để giao thức cốt lõi không còn mang theo bất kỳ trạng thái ẩn nào.

Các nhà phát triển sẽ cảm nhận được tác động ngay lập tức: các máy chủ giờ đây có thể được nhân bản đằng sau các proxy ngược HTTP tiêu chuẩn, và việc mở rộng quy mô chỉ đơn giản là thêm các phiên bản giống hệt nhau. Sự đánh đổi là một thay đổi gây phá vỡ tính tương thích (breaking change) cho bất kỳ ai đang sử dụng API cũ; mã nguồn hiện tại phải được tái cấu trúc để xử lý siêu dữ liệu tác vụ bên ngoài luồng yêu cầu cốt lõi.

Liên minh bảo mật AI do NVIDIA dẫn đầu mở ra cánh cửa cho việc kiểm tra cục bộ

NVIDIA, Microsoft, IBM và một số công ty khác đã công bố một nhóm mở nhằm chia sẻ các công cụ cho phép các tổ chức bảo mật các tác nhân AI. Liên minh hứa hẹn khả năng chạy các mô hình cục bộ, giúp các đội ngũ bảo mật có quyền truy cập trực tiếp vào dữ liệu mà mô hình xử lý. Điều này đặc biệt quan trọng khi các API được lưu trữ từ chối tiết lộ dữ liệu tải (payload) để phân tích pháp chứng, hoặc khi các quy định yêu cầu thông tin nhạy cảm không bao giờ được rời khỏi tường lửa của doanh nghiệp.

Hiệp hội này sẽ tập hợp các thư viện phát hiện, khung thử nghiệm (sandboxing frameworks) và nhật ký kiểm tra (audit logs). Các bên tham gia có thể đóng góp những cải tiến mà không cần chờ đợi lộ trình của một nhà cung cấp duy nhất, từ đó có khả năng đẩy nhanh sự sẵn có của các ngăn xếp tác nhân (agent stacks) đã được tăng cường bảo mật.

Địa chính trị chứng kiến AI trở thành một điểm nóng mới

Một diễn biến riêng biệt nhấn mạnh tốc độ AI đang trở thành một đòn bẩy ngoại giao. Trung Quốc đã cáo buộc Hoa Kỳ về "chủ nghĩa bá quyền AI" sau khi các báo cáo xuất hiện về khả năng hạn chế thương mại nhắm vào các mô hình tiên tiến. Tranh chấp tập trung vào Kimi K3 của Moonshot AI, một mô hình ngôn ngữ lớn mà các quan chức Hoa Kỳ cáo buộc là được chưng cất (distilled) từ kết quả đầu ra của các mô hình Mỹ. Moonshot phủ nhận mọi việc sử dụng dữ liệu nước ngoài và khẳng định kiến trúc này là hoàn toàn nguyên bản. Chưa có bằng chứng công khai nào xuất hiện để xác minh tuyên bố của cả hai bên, khiến cáo buộc này nằm trong phạm vi phô trương chính trị hơn là một sự vi phạm đã được chứng minh.

Các rủi ro là rất lớn: nếu các chính phủ bắt đầu coi các mô hình AI là tài sản chiến lược, các biện pháp kiểm soát xuất khẩu và chế độ cấp phép có thể làm hạn chế dòng chảy tự do của nghiên cứu, gây khó khăn cho các hoạt động hợp tác vốn đã thúc đẩy sự tiến bộ nhanh chóng trong vài năm qua.

GitHub thắt chặt quản trị Copilot cho doanh nghiệp

GitHub đã thêm một chính sách dành riêng cho doanh nghiệp cho trình lập trình cặp AI Copilot của mình. Giờ đây, các quản trị viên có thể bật hoặc tắt ứng dụng Copilot cho toàn bộ tổ chức chỉ với một cài đặt duy nhất, thay vì phải quản lý quyền cho từng máy khách riêng lẻ. Thay đổi này giúp đơn giản hóa việc triển khai cho các công ty muốn có một máy khách tác nhân thống nhất trong khi vẫn giữ các công cụ AI khác dưới sự kiểm soát chặt chẽ hơn.

Thử nghiệm phòng thủ mạng đa tác nhân của Microsoft

"Project Perception" của Microsoft đang thử nghiệm một hệ thống tác nhân gồm ba nhóm để phục vụ an ninh mạng. Các tác nhân đỏ (red agents) mô phỏng các cuộc tấn công, các tác nhân xanh dương (blue agents) phản ứng bằng các hành động phòng thủ, và các tác nhân xanh lá (green agents) đánh giá kết quả. Bằng cách thoát khỏi một mô hình nguyên khối duy nhất, dự án tạo ra một vòng lặp phản hồi liên tục, nơi các biện pháp phòng thủ liên tục được thăm dò và tinh chỉnh. Cách tiếp cận này có thể trở thành khuôn mẫu cho các công ty khác đang muốn tích hợp thử nghiệm đối kháng vào các hoạt động bảo mật của họ.

Tại sao sự chuyển dịch này lại quan trọng đối với các nhà vận hành

Xu hướng này rất rõ ràng: các hệ thống tác nhân đang trở thành hạ tầng cốt lõi. Các giao thức không lưu trạng thái giúp việc kiểm tra các luồng yêu cầu và khôi phục sau các lỗi trở nên dễ dàng hơn mà không cần phải truy tìm dữ liệu phiên ẩn. Việc thực thi cục bộ và các công cụ bảo mật dùng chung mang lại cho các tổ chức sự minh bạch cần thiết để đáp ứng các yêu cầu tuân thủ. Trong khi đó, cuộc kéo co địa chính trị báo hiệu rằng việc kiểm soát nguồn gốc mô hình có thể sớm trở thành một tiền tuyến quản lý.

Rào cản tiếp theo không chỉ là xây dựng các tác nhân thông minh hơn; mà là xây dựng các tác nhân có trạng thái, quyền hạn và các chế độ lỗi có thể được kiểm tra, kiểm toán và quản trị với sự nghiêm ngặt tương tự như bất kỳ thành phần hạ tầng quan trọng nào khác.