Khám phá sở thích, cùng nhau

Deal thật, đánh giá chân thực và câu chuyện mua sắm từ những người cùng sở thích với bạn — mỗi ngày trên Sammfy.

Khám phá sở thích, cùng nhauDeal thật, đánh giá chân thực và câu chuyện mua sắm từ những người cùng sở thích với bạn — mỗi ngày trên Sammfy.

Microsoft thừa nhận ‘vụ đánh cắp sức lao động lớn nhất’ của AI

Microsoft thừa nhận ‘vụ đánh cắp sức lao động lớn nhất’ của AI
Sở thích|Khám phá ứng dụng AI

Khi chính Microsoft gọi AI là ‘vụ đánh cắp sức lao động lớn nhất’

Khủng hoảng đạo đức quanh huấn luyện dữ liệu AI là tình trạng các công ty công nghệ âm thầm thu thập hàng triệu tác phẩm báo chí và nội dung trực tuyến có bản quyền để nuôi mô hình, trong khi đa số tác giả không được hỏi ý kiến, không được trả công tương xứng và thành quả lao động của họ lại bị dùng để tạo ra sản phẩm có thể thay thế chính công việc đó. Điểm bùng nổ của tranh luận tới từ một phát biểu nội bộ: Brent Hecht, Giám đốc Khoa học Ứng dụng tại Microsoft, mô tả việc các mô hình AI thu thập khối lượng lớn nội dung trên Internet là "vụ trộm lao động lớn nhất trong lịch sử loài người". Chính cụm từ gây sốc này làm lộ ra điều mà ngành AI tránh nói thành lời: họ biết rất rõ rủi ro đạo đức và bản quyền nội dung AI, nhưng vẫn lao về phía trước.

Microsoft thừa nhận ‘vụ đánh cắp sức lao động lớn nhất’ của AI

Vụ kiện New York Times: nội bộ một kiểu, ra tòa một kiểu

Những tài liệu nội bộ của Microsoft và OpenAI chỉ xuất hiện công khai vì vụ kiện New York Times nhằm buộc hai công ty chịu trách nhiệm về việc sao chép hàng triệu bài báo có bản quyền để huấn luyện dữ liệu AI mà không xin phép. Vụ kiện bắt đầu vào cuối năm 2023, khi ChatGPT vừa tạo ra cơn địa chấn toàn cầu. Trong các bản ghi nhớ, Hecht thẳng thắn nghi ngờ việc thu thập dữ liệu rộng rãi có thể khó tương thích với lập luận "fair use" mà hai công ty đang bám vào để tự bảo vệ. Tuy nhiên, trước công chúng, họ vẫn khẳng định hoạt động huấn luyện không vi phạm bản quyền, cho rằng việc sao chép nội dung là mang tính biến đổi và được bảo vệ bởi nguyên tắc sử dụng hợp lý. Ngắn gọn: nội bộ nói đây giống đánh cắp, còn trước tòa lại cố chứng minh đó là hợp pháp.

Microsoft thừa nhận ‘vụ đánh cắp sức lao động lớn nhất’ của AI

‘Vòng luẩn quẩn’ dữ liệu: AI ăn vào chính nguồn sống của mình

Thừa nhận gây tranh cãi thứ hai của Hecht không chỉ là ngôn từ mạnh mà là một chẩn đoán cấu trúc: huấn luyện dữ liệu AI dựa trên báo chí và nội dung chất lượng tạo nên một vòng luẩn quẩn. AI dùng bài viết của các nhà xuất bản để học, nhưng khi chatbot trả lời trực tiếp, người dùng không còn lý do truy cập trang gốc, khiến doanh thu và khả năng tiếp tục sản xuất nội dung sạch bị bào mòn. Dữ liệu nội bộ Microsoft cho thấy trong một thử nghiệm, Copilot làm tỷ lệ người dùng nhấp sang trang New York Times giảm tới 93% so với tìm kiếm Bing truyền thống. Đây là con số khó có thể gọi là "không thay thế". Nick Turley ở OpenAI thậm chí coi chatbot là "mối đe dọa sống còn" với các nhà xuất bản, vì nó đang chiếm dần vai trò của trang tin trong hành trình thông tin của người dùng.

Đạo đức AI: khi ‘fair use’ bị kéo căng đến giới hạn

Ở cốt lõi, tranh chấp Microsoft–OpenAI không phải chỉ là cuộc chiến giữa vài tập đoàn với một tờ báo, mà là cuộc đối đầu giữa logic pháp lý cũ và thực tế công nghệ mới. Trọng tâm câu hỏi: liệu việc thu thập hàng loạt tác phẩm có bản quyền trên Internet để xây dựng mô hình AI, rồi dùng chúng tạo câu trả lời thay thế truy cập nguồn gốc, có thể coi là "fair use" hay không? Hecht nhấn mạnh phần lớn người tạo nội dung không có ý định cho sản phẩm của họ được sử dụng theo cách này và không nhận được bất kỳ thù lao tương xứng. Trong khi đó, ngay cả CEO Microsoft cũng thừa nhận chatbot có thể khiến người dùng không cần truy cập nguồn ban đầu vì thông tin đã xuất hiện trực tiếp trên nền tảng AI. Khi chính lãnh đạo thừa nhận rủi ro đạo đức AI ở mức này, việc tiếp tục trốn sau lá chắn pháp lý "sử dụng hợp lý" bắt đầu trở nên khó tin.

Tương lai sau phán quyết: trả công hay tiếp tục đánh cắp?

Điều đang được tòa án cân nhắc không chỉ là số phận của một vụ kiện New York Times, mà là chuẩn mực nền tảng cho cả ngành AI: các công ty có được phép dùng khối lượng khổng lồ tác phẩm do con người tạo ra để huấn luyện dữ liệu AI mà không trả tiền, đặc biệt khi chính AI lại trở thành sản phẩm thay thế nguồn nội dung ban đầu. Dù phán quyết cuối cùng chưa xuất hiện, cuộc chiến đã buộc ngành phải nhìn thẳng vào câu hỏi khó: nếu AI đúng là "vụ đánh cắp sức lao động lớn nhất lịch sử", giải pháp đạo đức không thể chỉ là thêm vài liên kết nguồn mà người dùng hiếm khi nhấp. Con đường bền vững duy nhất là xây dựng cơ chế trả công và xin phép minh bạch cho người sáng tạo – hoặc chấp nhận rằng kỷ nguyên AI hiện tại được dựng trên nền của một cuộc trưng dụng không tự nguyện.

Sammfy nhận hoa hồng khi bạn mua sắm qua liên kết của chúng tôi, bạn không phải trả thêm chi phí.

You May Also Like

Comments
Viết gì đó...
Chưa có bình luận nào. Hãy là người đầu tiên chia sẻ suy nghĩ!