Chưng cất mô hình AI là gì và vì sao gây bão?
Chưng cất mô hình AI là kỹ thuật huấn luyện một mô hình nhỏ hơn (học sinh) bằng cách dùng đầu ra của một mô hình lớn, mạnh hơn (giáo viên), nhằm sao chép phần lớn hành vi của mô hình gốc với chi phí tính toán thấp hơn và hiệu quả vận hành cao hơn trong những tác vụ cụ thể. Đó là công cụ hợp pháp, quen thuộc trong phòng thí nghiệm, nhưng đang trở thành tâm điểm tranh cãi khi bị cáo buộc dùng để sao chép công nghệ AI độc quyền mà không có sự cho phép của chủ sở hữu.
Điểm bùng phát mới nhất: trong một cảnh báo chung, NSA, FBI và CISA đã nêu đích danh DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun và Z.AI là những công ty AI Trung Quốc bị cáo buộc tiến hành “knowledge distillation” ở “quy mô công nghiệp” ít nhất từ cuối năm 2024. Theo phía Washington, các công ty này đã khai thác hàng tỉ điểm dữ liệu thông qua hàng triệu tương tác với các phiên bản Claude, GPT, Gemini và Grok để huấn luyện hệ thống riêng. Dù phía Trung Quốc gọi cáo buộc là vô căn cứ, tranh cãi đã phơi bày một vấn đề cốt lõi: ranh giới mỏng manh giữa đổi mới kỹ thuật và sao chép công nghệ AI.

Kỹ thuật hợp pháp: chưng cất được ủy quyền và lợi ích kinh tế
Về mặt học thuật, chưng cất mô hình AI là trụ cột của kỹ thuật nén mô hình. Một nhà phát triển gửi hàng loạt câu lệnh tới mô hình “giáo viên” lớn hơn và dùng phản hồi thu được để huấn luyện mô hình “học sinh” nhỏ hơn nhằm sao chép nhiều khả năng của giáo viên. Kiến thức không chuyển trực tiếp; mô hình mới học cách bắt chước hành vi thông qua mẫu phản hồi. Khi được dùng trên chính mô hình của mình, hoặc để tạo ra hệ thống không cạnh tranh trực tiếp, đây là chưng cất được ủy quyền – hoàn toàn hợp pháp và được cộng đồng nghiên cứu khuyến khích.
Lợi ích là rõ ràng: mô hình chưng cất thường không đầy đủ năng lực như mô hình gốc nhưng chạy nhanh hơn, yêu cầu ít tài nguyên hơn và có thể tối ưu cho nhiệm vụ cụ thể. Trong bối cảnh các hãng AI Mỹ đã chi khối lượng đầu tư khổng lồ cho hạ tầng và trung tâm dữ liệu để xây chatbot tiên tiến, chưng cất giúp họ giảm chi phí vận hành, đóng gói mô hình thành phiên bản nhẹ cho thiết bị biên hoặc cho khách hàng doanh nghiệp. Vấn đề nảy sinh khi cùng kỹ thuật này được dùng để sao chép công nghệ AI của đối thủ với chi phí thấp mà không cần trả giá cho quá trình nghiên cứu – huấn luyện ban đầu.
Khi chưng cất biến thành sao chép công nghệ AI
Các cơ quan an ninh Mỹ cho rằng ranh giới đã bị vượt qua: thay vì chỉ chưng cất mô hình tự phát triển, các doanh nghiệp bị cáo buộc đã dùng hàng triệu truy vấn tới Claude, GPT, Gemini và Grok để trích xuất đầu ra, rồi huấn luyện mô hình riêng – tức distillation AI Trung Quốc dựa trên mô hình Mỹ. Anthropic từng báo cáo ba nhà phát triển AI hàng đầu ở Trung Quốc đã thực hiện hơn 16 triệu lượt trao đổi bằng các tài khoản gian lận để trích xuất kết quả từ mô hình của họ. Trong một trường hợp khác, nỗ lực chưng cất bị cáo buộc liên quan tới 28,8 triệu lượt trao đổi qua gần 25.000 tài khoản.
Theo cáo buộc, các thực thể này phân tán yêu cầu qua nhiều API, nhà cung cấp đám mây và nền tảng trung gian để che giấu danh tính, thậm chí dùng mạng máy chủ proxy để vượt hạn chế địa lý và né cơ chế bảo vệ. Đây không còn là thí nghiệm học thuật mà là chiến lược sao chép công nghệ AI ở quy mô công nghiệp: giảm thời gian phát triển, cắt mạnh chi phí huấn luyện, nhưng vẫn cải thiện năng lực lập luận, lập trình và phân tích dữ liệu của mô hình. Về bản chất, đây là chưng cất mô hình AI bị lạm dụng – dùng đầu ra bị ràng buộc điều khoản dịch vụ để xây mô hình cạnh tranh trực tiếp, chạm tới vùng xám của bảo vệ sở hữu trí tuệ AI.
Rủi ro kinh tế, an ninh và cuộc đua AI Mỹ Trung
Các hãng AI Mỹ phụ thuộc mô hình độc quyền: họ giữ trọng số kín, bán quyền truy cập thay vì mở trọng số như một số phòng thí nghiệm Trung Quốc. Nếu đối thủ có thể sao chép khả năng của mô hình này bằng chưng cất trái phép rồi cung cấp với giá thấp hoặc miễn phí, doanh thu bị xói mòn nghiêm trọng. Các quan chức Mỹ ước tính chưng cất trái phép khiến doanh nghiệp Mỹ mất hàng tỉ đô la thu nhập mỗi năm. Trong một câu nói thể hiện mức độ lo ngại, tuyên bố chính thức nhấn mạnh rằng việc khai thác trái phép đầu ra của đối thủ có thể vi phạm điều khoản sử dụng và xâm phạm quyền sở hữu trí tuệ.
Rủi ro an ninh cũng nổi lên. Các công ty Mỹ cảnh báo đối thủ nước ngoài có thể dùng chưng cất để tạo mô hình đã gỡ bỏ guardrails, mở đường cho việc tạo mầm bệnh chết người hoặc tấn công máy tính tự động quy mô lớn. Không ngạc nhiên khi Nhà Trắng tuyên bố sẽ phối hợp cùng ngành để tìm cách kiềm chế chưng cất trái phép và buộc tác nhân xấu chịu trách nhiệm, trong khi một số nghị sĩ kêu gọi áp đặt trừng phạt lên các thực thể Trung Quốc bị cho là chưng cất ở quy mô công nghiệp. Phía Trung Quốc phản bác và cáo buộc ngược rằng Mỹ muốn độc quyền ngành AI, biến cuộc đua AI Mỹ Trung thành cuộc chiến định nghĩa lại thế nào là “sao chép công nghệ AI” hợp pháp.
Ranh giới pháp lý mong manh và hướng đi tiếp theo
Cái khó của cả hai phía là: chứng minh triệt để rằng một mô hình mới được xây bằng chưng cất trái phép gần như bất khả thi với bằng chứng hiện tại. Ngay cả các vụ việc Anthropic công bố cũng chủ yếu dựa trên dấu vết địa chỉ IP, siêu dữ liệu và hình mẫu truy vấn, tức bằng chứng tình huống. Trong khi đó, về mặt khoa học, chưng cất mô hình AI không để lại “dấu vân tay” rõ ràng; mô hình học sinh có thể khác đáng kể trong kiến trúc nhưng vẫn thể hiện hành vi gần giống mô hình tham chiếu.
Điều này đặt ra bài toán chính trị – pháp lý: nếu các hãng Mỹ siết chặt quyền truy cập để bảo vệ sở hữu trí tuệ AI, họ có nguy cơ làm chậm cả tốc độ đổi mới toàn cầu. Ngược lại, nếu bỏ qua distillation AI Trung Quốc và các nỗ lực chưng cất tương tự, họ chấp nhận rủi ro bị bào mòn lợi thế cạnh tranh. Trong ngắn hạn, các công ty Mỹ đã bắt đầu chia sẻ thông tin về “các cuộc tấn công chưng cất” và chặn tài khoản đáng ngờ, còn chính phủ Mỹ tìm cách xây bộ khung quy định mới. Về lâu dài, nếu không có một ngôn ngữ chung về chưng cất mô hình AI – đâu là hợp pháp, đâu là sao chép trái phép – cuộc đua AI Mỹ Trung sẽ tiếp tục bị kéo bởi nghi ngờ và trả đũa, thay vì tập trung vào cạnh tranh bằng chất lượng công nghệ.






