Kimi K3 có phải là sản phẩm của quá trình chưng cất (distillation)? Các chuyên gia bác bỏ các cáo buộc
Căng thẳng địa chính trị xoay quanh trí tuệ nhân tạo đã lên đến đỉnh điểm khi các quan chức Hoa Kỳ cáo buộc các công ty Trung Quốc thực hiện gián điệp công nghiệp. Trong khi các cáo buộc cho rằng Moonshot AI đã sử dụng Fable của Anthropic để huấn luyện mô hình Kimi K3, các nhà nghiên cứu AI hàng đầu lập luận rằng thực tế kỹ thuật của việc phát triển mô hình ngôn ngữ lớn (LLM) cho thấy một câu chuyện phức tạp hơn nhiều.
Các cáo buộc về chưng cất mô hình và đánh cắp sở hữu trí tuệ (IP)
Cố vấn khoa học Nhà Trắng Michael Kratsios đã đưa ra những cáo buộc nghiêm trọng chống lại Moonshot, công ty đứng sau Kimi K3—hiện là LLM open-weight lớn nhất hiện có. Kratsios cáo buộc Moonshot đã thực hiện "chưng cất công nghiệp quy mô lớn và bí mật" để đánh cắp công nghệ độc quyền của Hoa Kỳ. Cáo buộc này được Bộ trưởng Tài chính Scott Bessent ủng hộ, người lưu ý rằng các "dấu chìm" (watermarks) của các LLM Hoa Kỳ đã xuất hiện trong các mô hình của Trung Quốc.
Chưng cất (distillation) là một quá trình trong đó một mô hình nhỏ hơn được huấn luyện bằng cách truy vấn một mô hình "tiên phong" (frontier) lớn hơn để trích xuất khả năng lập luận và kiến thức của nó. Quá trình này thường bao gồm tinh chỉnh có giám sát (SFT), trong đó các câu lệnh (prompts) và phản hồi của một mô hình mục tiêu được sử dụng để huấn luyện mô hình mới, đôi khi khiến mô hình mới tiếp nhận "phong thái" hoặc các đặc điểm hội thoại cụ thể của mô hình gốc.
Tại sao các chuyên gia nghi ngờ lý thuyết chưng cất
Bất chấp sức nặng chính trị của những tuyên bố này, cộng đồng nghiên cứu AI vẫn tỏ ra hoài nghi. Braden Hancock, một nhà nghiên cứu tại Viện Laude và là đồng sáng lập Snorkel AI, chỉ ra một vấn đề đáng kể về mốc thời gian: Fable của Anthropic chỉ mới được công khai từ ngày 1 tháng 7. "Bạn không thể chưng cất nhiều dữ liệu đến thế, huấn luyện một mô hình và phát hành nó chỉ trong hai tuần," Hancock lưu ý.
Hơn nữa, Nathan Lambert từ Viện AI Allen lập luận rằng việc chưng cất thông qua SFT đang trở nên kém hiệu quả hơn khi các mô hình tiến dần đến mức độ tiên phong. Để đạt được mức độ hiệu suất như thấy ở Kimi K3, một mô hình có khả năng sẽ cần các đợt huấn luyện học tăng cường (RL) khổng lồ. Quá trình này đòi hỏi hàng chục triệu tác nhân (agents) để chấm điểm các phản hồi—một nhiệm vụ sẽ cực kỳ tốn kém và chậm chạp nếu được thực hiện thông qua API của đối thủ cạnh tranh.
Vai trò của phần cứng và chuyên môn kỹ thuật
Cuộc tranh cãi không chỉ giới hạn ở phần mềm. Kratsios cũng cáo buộc Moonshot đã lách các biện pháp kiểm soát xuất khẩu để tiếp cận phần cứng Nvidia tiên tiến, đề cập cụ thể đến các chip Grace Blackwell 300 và các máy chủ trang bị GB300. Mặc dù các chip này bị cấm xuất khẩu sang Trung Quốc, các chuyên gia như Sam Bresnick từ Đại học Georgetown cho rằng thị trường đen và các chuỗi cung ứng toàn cầu phức tạp khiến việc giám sát các dòng chảy phần cứng này trở nên cực kỳ khó khăn.
Tuy nhiên, nhiều nhà nghiên cứu lập luận rằng việc tập trung vào chưng cất làm giảm đi tính chính danh về mặt kỹ thuật của các đội ngũ AI Trung Quốc. Với những người sáng lập đến từ các tổ chức danh tiếng như Đại học Carnegie Mellon, các chuyên gia cho rằng Moonshot có khả năng thực hiện các nghiên cứu nguyên bản thay vì chỉ "ăn theo".
Hệ lụy đối với cuộc đua AI toàn cầu
Cuộc tranh chấp này làm nổi bật khoảng cách ngày càng lớn giữa các câu chuyện chính trị và thực tế kỹ thuật. Khi ngành công nghiệp tiến tới việc học tăng cường tinh vi và yêu cầu tính toán khổng lồ, cuộc tranh luận về việc liệu các công ty đang "đánh cắp" trí tuệ hay chỉ đơn giản là tiến bộ thông qua kỹ thuật vượt trội sẽ tiếp tục định hình chính sách thương mại quốc tế và các quy định về AI.
Các điểm chính cần lưu ý
- Sự hoài nghi về mặt kỹ thuật: Các chuyên gia lập luận rằng việc phát hành nhanh chóng Kimi K3 khiến việc xây dựng nó chỉ thông qua chưng cất Fable của Anthropic là điều không khả thi về mặt toán học.
- Vượt xa khỏi tinh chỉnh: Mặc dù việc chưng cất thông qua tinh chỉnh có giám sát là có tồn tại, nhưng để đạt được hiệu suất cấp độ tiên phong có khả năng đòi hỏi học tăng cường tiên tiến mà không thể dễ dàng "sao chép".
- Mối lo ngại về phần cứng: Các cáo buộc về việc tiếp cận bất hợp pháp các chip Nvidia Blackwell bị cấm đã thêm một lớp phức tạp địa chính trị vào cuộc tranh luận về sự tiến bộ của AI Trung Quốc.
