Khám phá sở thích, cùng nhau

Deal thật, đánh giá chân thực và câu chuyện mua sắm từ những người cùng sở thích với bạn — mỗi ngày trên Sammfy.

Khám phá sở thích, cùng nhauDeal thật, đánh giá chân thực và câu chuyện mua sắm từ những người cùng sở thích với bạn — mỗi ngày trên Sammfy.

Claude AI bị lạm dụng: Lừa đảo tự động và rủi ro xâm phạm mô hình

Claude AI bị lạm dụng: Lừa đảo tự động và rủi ro xâm phạm mô hình
Sở thích|Năng suất hỗ trợ bởi AI

Claude AI bị lạm dụng: vấn đề không còn là giả thuyết

Claude AI bị lạm dụng là tình trạng hệ thống của Anthropic bị các bên thứ ba khai thác đầu ra để huấn luyện mô hình cạnh tranh và tổ chức lừa đảo AI tự động ở quy mô lớn, qua đó làm suy yếu biện pháp bảo vệ, xâm phạm dữ liệu và đẩy người dùng vào rủi ro bảo mật lẫn niềm tin dài hạn. Khi một nền tảng được đánh giá cao về khả năng lập trình, phân tích dữ liệu và suy luận logic lại trở thành nguồn tài nguyên cho đối thủ, câu chuyện không còn là cạnh tranh công nghệ mà là an ninh số. Các phòng thí nghiệm AI đã phát triển những cách ngày càng tinh vi để vượt qua lớp bảo vệ và trích xuất năng lực từ các mô hình Claude, cho thấy “Claude bị xâm phạm” không chỉ là cảnh báo mang tính lý thuyết.

Khai thác Claude để đánh cắp mô hình: cuộc đua súng giữa các hãng AI

Ở tầng kỹ thuật, rủi ro AI Anthropic nổi bật nhất là việc Claude bị dùng làm “máy chưng cất” năng lực cho mô hình khác. Anthropic cho biết họ ghi nhận gần 200 triệu lượt trao đổi liên quan đến 5 chiến dịch chưng cất mô hình – con số cho thấy đây là hoạt động có chủ đích và kéo dài, không phải vài script thử nghiệm rời rạc. Những chiến dịch này cố tình tìm cách đánh lừa Claude để mô hình tiết lộ chuỗi suy luận chi tiết hơn thay vì chỉ tóm tắt, biến kỹ năng lập trình, phân tích và lý luận thành dữ liệu huấn luyện miễn phí cho bên khác. Chiến dịch lớn nhất được cho là gắn với Alibaba, với 151 triệu truy vấn từ tháng 5 đến tháng 7, có lúc gần 3 triệu lượt mỗi ngày và phân tán qua khoảng 3.500 tài khoản. Bị nhắm tới còn có Moonshot AI và DeepSeek, trong đó một chiến dịch được cho là chuyển thẳng yêu cầu từ quân đội Trung Quốc sang Claude, bao gồm phân tích camera giám sát về hành vi bất thường. Khi kiểm soát cách dùng đầu ra trở thành một phần của cạnh tranh giữa các phòng thí nghiệm AI, người dùng phải thừa nhận rằng Claude AI lạm dụng đang diễn ra ngay ở tầng hạ tầng chứ không chỉ ở các app bên ngoài.

“Người yêu ảo” và lừa đảo AI tự động: quy mô mới đáng sợ hơn thủ đoạn cũ

Nếu việc chưng cất mô hình là mối đe dọa ở tầng kỹ thuật, thì mạng lưới ứng dụng hẹn hò dùng Claude cho thấy mặt tối ở tầng người dùng. Một studio Trung Quốc đã tận dụng Claude để xây dựng hơn 20 ứng dụng hẹn hò, phía sau là hơn 4.700 nhân vật AI được thiết kế khiến người dùng tin rằng họ đang nói chuyện với người thật. Trong khoảng hai tuần tháng 4, các nhân vật này trò chuyện với ít nhất 25.000 người dùng, 75% tài khoản ghép đôi thực chất là AI và riêng Claude tạo ra khoảng 2,36 triệu tin nhắn. Đây là lừa đảo AI tự động đúng nghĩa: AI tạo nhân vật, duy trì hội thoại, xử lý hình ảnh và đánh giá độ hấp dẫn ảnh. Các “người yêu ảo” được lập trình để không bao giờ thừa nhận mình là AI, né video call hoặc gửi ảnh nhưng vẫn giữ tương tác để buộc nạn nhân nạp tiền. Hệ thống hình thành dây chuyền hoàn chỉnh: AI tạo “người yêu”, AI trò chuyện, con người xuất hiện để xác nhận danh tính, rồi người dùng phải nạp tiền để tiếp tục. Điều đáng lo không nằm ở một chatbot giả làm người yêu; 4.700 chatbot, hơn 20 ứng dụng và 2,36 triệu tin nhắn trong hai tuần mới cho thấy AI đưa một hình thức lừa đảo cũ lên quy mô hoàn toàn khác.

Claude AI bị lạm dụng: Lừa đảo tự động và rủi ro xâm phạm mô hình

Ứng dụng lừa đảo, kiểm duyệt bị qua mặt và niềm tin người dùng sụt giảm

Mạng lưới ứng dụng hẹn hò nói trên không chỉ nhắm tới người dùng, mà còn tìm cách qua mặt kho ứng dụng. Tài liệu dành cho nhà phát triển mô tả một chế độ giao diện ẩn, chỉ kích hoạt khi app đang bị kiểm duyệt trên các chợ ứng dụng và tự tắt sau khi phát hành. Các phiên bản còn dùng tên lớp mã khác nhau để tránh hệ thống so sánh phát hiện app nhân bản, cùng trình duyệt nội bộ có thể bật tắt hoặc ẩn chức năng thanh toán bên thứ ba tùy lúc bị kiểm tra. Anthropic cho biết họ đã cấm các tài khoản liên quan, chuyển bằng chứng kèm danh tính nhà phát hành cho Apple và Google, đồng thời chia sẻ thông tin với các nhà cung cấp AI khác có công cụ bị dùng trong hệ thống. Nhưng ở phía người dùng, Claude đang phải đối mặt làn sóng quay lưng: từng có vị thế vững chắc trong tạo văn bản và hỗ trợ lập trình, nhưng giờ nhiều người chuyển sang ChatGPT hay Gemini. Các chính sách gây tranh cãi như watermark ẩn, cơ chế đọc lại toàn bộ lịch sử trò chuyện và hạn ngạch token khắt khe khiến người dùng lo ngại và bực bội. Cộng với việc Claude tụt hậu về giọng nói, đa phương tiện và gặp rào cản từ chính sách kiểm soát chặt, câu hỏi đặt ra là: biện pháp an toàn hiện tại có đủ để cứu lại niềm tin không, khi Claude AI lạm dụng đã thành chủ đề nóng hơn là năng lực viết code hay văn bản.

Khi niềm tin trở thành lớp bảo vệ cuối cùng

Điểm chung giữa việc Claude bị xâm phạm ở tầng mô hình và bị biến thành “cỗ máy” lừa đảo hàng loạt là khoảng cách giữa năng lực kỹ thuật và hệ sinh thái an toàn xung quanh nó. Các chiến dịch chưng cất từ Alibaba, Moonshot AI hay DeepSeek cho thấy kiểm soát đầu ra là bài toán mở, trong khi mạng lưới hẹn hò AI chứng minh rằng chỉ cần vài studio có tham vọng, lừa đảo AI tự động có thể đạt quy mô mà fraud thủ công không bao giờ chạm tới. Anthropic đã chủ động cấm tài khoản, chuyển bằng chứng cho nền tảng phân phối và chia sẻ thông tin với các nhà cung cấp AI khác, nhưng với người dùng, rủi ro AI Anthropic giờ không chỉ là câu chuyện về chính sách mà về niềm tin: bạn có tin rằng một hệ thống đang là mục tiêu tấn công quy mô lớn vẫn là nơi phù hợp để gửi gắm dữ liệu và quy trình công việc dài hạn? Câu trả lời buộc mỗi cá nhân, doanh nghiệp phải nhìn thẳng vào thực tế Claude AI lạm dụng hôm nay để quyết định mình sẽ đứng ở đâu trong kỷ nguyên AI vừa đầy hứa hẹn, vừa nhiều lỗ hổng.

Sammfy nhận hoa hồng khi bạn mua sắm qua liên kết của chúng tôi, bạn không phải trả thêm chi phí.

You May Also Like

Comments
Viết gì đó...
Chưa có bình luận nào. Hãy là người đầu tiên chia sẻ suy nghĩ!