Vụ Anthropic – Claude: khi sở hữu trí tuệ AI thành chiến trường mới
Vụ Anthropic cáo buộc bảy công ty AI Trung Quốc đánh cắp dữ liệu AI thông qua chưng cất trái phép đầu ra của mô hình Claude là một tranh chấp sở hữu trí tuệ, trong đó dữ liệu suy luận và năng lực nội tại của mô hình được coi như tài sản cốt lõi bị rút ruột để huấn luyện các hệ thống cạnh tranh, làm lộ rõ khoảng trống pháp lý và chuẩn đạo đức trong cuộc đua trí tuệ nhân tạo toàn cầu.
Trọng tâm của câu chuyện không chỉ là vài chiến dịch kỹ thuật mờ ám, mà là câu hỏi: đâu là ranh giới giữa "học hỏi" và đánh cắp sở hữu trí tuệ Claude. Anthropic công bố một báo cáo tình báo an ninh mạng dài hơn 30.000 từ, trong đó cáo buộc bảy công ty AI Trung Quốc – gồm Alibaba, Moonshot AI, DeepSeek, Zhipu, Xiaomi, SenseTime và MiniMax – đã chưng cất dữ liệu trái phép từ hệ thống Claude để huấn luyện mô hình riêng. Theo báo cáo mới, các phòng thí nghiệm AI đã phát triển những phương pháp ngày càng tinh vi để vượt qua biện pháp bảo vệ và thu thập năng lực từ Claude. Từ đây, cuộc tranh luận về bảo vệ mô hình AI, luật chơi và minh bạch bùng lên dữ dội.

Chiến dịch chưng cất dữ liệu quy mô công nghiệp: từ Alibaba tới Moonshot AI, DeepSeek
Cốt lõi cáo buộc là việc các công ty AI Trung Quốc triển khai chiến dịch chưng cất mô hình trên quy mô công nghiệp: dùng đầu ra của Claude làm dữ liệu huấn luyện để mô hình của họ hấp thụ năng lực suy luận, lập trình và phân tích dữ liệu. Về lý thuyết, chưng cất mô hình là kỹ thuật hợp lệ, nhưng Anthropic cho rằng ở đây nó đã bị đẩy thành "chiêu trò rút ruột chất xám" khi mục tiêu là trích xuất năng lực cốt lõi mà không trả phí bản quyền.
Anthropic cho biết đã ghi nhận gần 200 triệu lượt trao đổi liên quan đến năm chiến dịch chưng cất mô hình, một con số phơi bày mức độ khốc liệt của cuộc chạy đua AI, nơi các công ty sẵn sàng đi đường tắt để thu hẹp khoảng cách công nghệ. Chiến dịch lớn nhất được quy cho Alibaba với hơn 151 triệu lượt trao đổi chỉ trong giai đoạn từ tháng 5 đến tháng 7 năm 2026, có thời điểm đạt gần 3 triệu lượt mỗi ngày qua khoảng 3.500 tài khoản gian lận. Moonshot AI và DeepSeek cũng bị cáo buộc chuyển tiếp yêu cầu của người dùng sang Claude, biến mô hình Mỹ thành "động cơ" thầm lặng đứng sau sản phẩm của họ.
Thủ thuật technic: API lậu, danh tính giả và khai thác chuỗi suy luận
Báo cáo cho thấy những người vận hành không chỉ đánh cắp dữ liệu AI mà còn xây dựng cả một kiến trúc gian lận để vượt qua cơ chế bảo vệ mô hình AI của Anthropic. Họ lập tài khoản bằng thông tin giả, dùng thẻ tín dụng đánh cắp và khóa API lậu, rồi thiết lập mạng máy chủ trung gian để che giấu nguồn truy cập, qua mặt hệ thống phòng thủ. Về mặt kỹ thuật, đây là các chiến dịch tấn công có chủ đích chứ không phải vài thí nghiệm vô tình.
Claude được thiết kế không hiển thị chuỗi suy luận nội bộ mà chỉ cung cấp phần tóm tắt quá trình suy nghĩ. Dù vậy, các chiến dịch này bị cáo buộc đã tìm cách đánh lừa mô hình để buộc lộ dấu vết suy luận chi tiết hơn, thậm chí có thủ thuật yêu cầu Claude dịch toàn bộ nội dung suy luận sang tiếng Nhật để moi trọn logic xử lý rồi thu gom tự động thành dữ liệu huấn luyện. Anthropic xem việc tự động thu thập đầu ra quy mô lớn và cố tình vượt qua cơ chế bảo vệ của Claude là hành vi không được phép. Nói cách khác, đây là sự khai thác có tính hệ thống nhằm chiếm đoạt sở hữu trí tuệ Claude chứ không phải "sử dụng fair use".
Từ 16 lên 200 triệu lượt: vì sao vụ việc bùng nổ ngay lúc này?
Vụ phanh phui lần này không phải phát pháo đầu tiên. Anthropic từng công khai vấn đề chưng cất mô hình vào tháng 2, khi mới ghi nhận khoảng 16 triệu lượt tương tác bất thường. Chỉ nửa năm sau, tổng số lượt tương tác mờ ám gắn với bảy công ty AI Trung Quốc đã phình to lên gần 200 triệu, tức quy mô tăng gấp 10 lần. Đây là một "quote" rõ ràng: "Thống kê từ Anthropic cho thấy tổng số lượt tương tác mờ ám liên quan đến 7 doanh nghiệp này lên tới gần 200 triệu".
Thời điểm công bố cũng mang màu sắc địa chính trị. Trước khi báo cáo ra mắt vài ngày, các cơ quan tình báo Mỹ ra tuyên bố chung nhắm vào doanh nghiệp công nghệ nước ngoài, trong khi Bộ Thương mại Trung Quốc phản bác và bác bỏ mọi chỉ trích. Dù nguồn tin không nhắc tới phản ứng cụ thể của các công ty bị nêu tên, bối cảnh cho thấy căng thẳng công nghệ giữa hai bờ Thái Bình Dương tiếp tục leo thang. Vụ việc vì vậy không chỉ là mâu thuẫn hợp đồng API, mà là một mảnh ghép trong cuộc cạnh tranh công nghệ toàn cầu, nơi mỗi bên đều muốn kiểm soát đầu ra và sở hữu trí tuệ của mô hình AI như tài sản chiến lược.
Luật chơi mới cho sở hữu trí tuệ AI: minh bạch hay hỗn loạn?
Nhìn rộng hơn, bê bối này cho thấy luật chơi quanh sở hữu trí tuệ Claude và nói chung là tài sản trí tuệ AI vẫn mơ hồ. Claude được đánh giá cao về khả năng lập trình và suy luận, những năng lực có thể trở thành nguồn dữ liệu giá trị để huấn luyện các mô hình AI khác. Khi công ty AI Trung Quốc bị cáo buộc chưng cất dữ liệu trái phép để cải thiện mô hình của họ, câu hỏi mở ra là: liệu trích xuất năng lực từ mô hình thương mại mà không trả tiền có khác gì sao chép phần mềm nguồn đóng?
Báo cáo mới cũng cho thấy việc kiểm soát cách đầu ra của các mô hình AI tiên tiến được sử dụng đang trở thành một phần của cuộc cạnh tranh giữa các phòng thí nghiệm. Nếu không có khung pháp lý rõ ràng, hai thái cực đều nguy hiểm: thả nổi thì đánh cắp dữ liệu AI sẽ trở thành "bình thường", còn siết chặt quá mức sẽ bóp nghẹt nghiên cứu và chuẩn mở. Cuối cùng, ngành AI buộc phải đối diện với lựa chọn: hoặc xây dựng chuẩn minh bạch cho bảo vệ mô hình AI và chưng cất dữ liệu, hoặc chấp nhận một tương lai nơi những chiến dịch rút ruột chất xám quy mô công nghiệp trở thành công cụ cạnh tranh mặc định.






