Cuộc chiến kiện bản quyền AI là gì và vì sao bùng nổ lúc này?
Cuộc chiến kiện bản quyền AI là làn sóng tranh chấp pháp lý giữa các nhà xuất bản và doanh nghiệp trí tuệ nhân tạo xoay quanh việc các mô hình học máy sử dụng nội dung báo chí có bản quyền để huấn luyện mà không xin phép, không trả tiền, khiến tác giả, tòa soạn mất độc giả, doanh thu và quyền kiểm soát tác phẩm của mình. Hàng loạt vụ kiện bản quyền AI do các tổ chức báo chí khởi kiện OpenAI, nhà phát triển ChatGPT, đang bước vào giai đoạn mới. Tiêu biểu nhất là vụ The New York Times kiện OpenAI và Microsoft, thu hút sự chú ý của giới đầu tư khi nhiều tài liệu tòa án được công khai. Không còn là tranh luận học thuật, đây đã trở thành cuộc đối đầu trực diện về mô hình kinh doanh: AI được phép dùng mọi thứ trên Internet miễn phí, hay phải coi nội dung báo chí là tài sản cần trả tiền.

Từ phòng họp kín đến tài liệu tòa án: AI thừa nhận “đánh cắp sức lao động”
Vụ New York Times kiện OpenAI và Microsoft bùng lên vì một lý do rất cụ thể: báo cáo nội bộ của chính các tập đoàn này chứng minh họ hiểu rõ mình đang làm gì với nội dung báo chí. Một giám đốc Microsoft đã mô tả việc các mô hình AI thu thập nội dung để huấn luyện là “vụ đánh cắp sức lao động lớn nhất trong lịch sử nhân loại” trong một bản ghi nhớ nội bộ tháng 1/2023. Tài liệu pháp lý cho thấy bên kiện yêu cầu tòa xác định Microsoft và OpenAI phải chịu trách nhiệm về việc sao chép nội dung có bản quyền mà không được cho phép. Thêm vào đó, hồ sơ nêu rằng mô hình AI sẵn sàng “hút” cả nội dung sau tường phí, biến kho tin tức trả phí thành nguyên liệu miễn phí cho chatbot. Nếu đây không phải OpenAI vi phạm bản quyền thì khái niệm vi phạm còn có nghĩa gì nữa?

Fair use hay hợp thức hóa mô hình “lấy công việc, giữ tiền”?
Trọng tâm pháp lý của cuộc chiến nằm ở khái niệm sử dụng hợp lý (fair use) – ranh giới giữa huấn luyện AI hợp pháp và xâm phạm bản quyền. Các tranh chấp hiện nay tập trung đáng kể vào học thuyết này trong luật Mỹ. OpenAI lập luận rằng việc dùng dữ liệu thu thập từ Internet để huấn luyện mô hình thuộc phạm vi sử dụng hợp lý, còn phía nguyên đơn nhấn mạnh chatbot đã trở thành sản phẩm thay thế cho bài báo gốc, khi người dùng lấy xong thông tin mà không cần nhấp vào trang tin. Bản thân tài liệu nội bộ của một tập đoàn lớn thừa nhận LLM là “sản phẩm phá hủy chuỗi cung ứng” nội dung, khi vừa ăn dữ liệu của nhà báo, vừa cắt giảm việc làm của chính họ. Nói thẳng: fair use đang bị kéo căng đến mức trở thành cái cớ để mô hình “lấy công việc, giữ tiền” tồn tại hợp pháp.
Các nhà xuất bản không đòi đặc quyền, họ đòi tiền công
Đòi hỏi cốt lõi của các nhà xuất bản rất giản dị: nếu AI dùng bản quyền nội dung báo chí để huấn luyện, họ phải được trả công. Tranh chấp hiện nay xoay quanh quyền của chủ sở hữu tác phẩm khi nội dung báo chí được sử dụng làm dữ liệu đầu vào cho mô hình AI. Nhiều nhà xuất bản cho rằng việc dùng kho bài viết của họ để huấn luyện ChatGPT đã làm giảm lượng truy cập website và suy yếu thị trường nội dung khi sản phẩm AI cạnh tranh trực tiếp. Một giám đốc trong ngành so sánh chi phí cấp phép nội dung báo chí với khoản đầu tư khổng lồ cho hạ tầng AI và kết luận rằng phí bản quyền dù nhỏ với Big AI nhưng lại sống còn với tòa soạn. Mô hình “take it now, argue about legality later” – lấy nội dung trước, cãi pháp lý sau – không phải tai nạn, mà là thiết kế của mô hình kinh doanh hiện tại.
Người dùng được gì, mất gì – và điều gì sẽ xảy ra tiếp theo?
Người dùng thường “không quan tâm, họ chỉ cần một câu trả lời nhanh nghe có vẻ đúng”, nhưng cái giá dài hạn không hề nhỏ. Khi chatbot cung cấp thông tin trực tiếp, độc giả có thể không còn truy cập trang báo gốc, trong khi chính nội dung báo chí lại là nguồn dữ liệu quan trọng giúp AI học cách xử lý thông tin. Nếu chuỗi cung ứng này sụp đổ, mô hình sẽ thiếu dữ liệu chất lượng, kéo theo nguy cơ “tự ăn” lại nội dung do AI tạo ra và thoái hóa chất lượng. Trên mặt trận pháp lý, tòa án có thể ra phán quyết cho một số vấn đề then chốt trước khi các vụ riêng lẻ quay về tòa cấp quận để xét xử tiếp, bao gồm cả khả năng đưa ra xét xử đầy đủ. Bất kể kết quả là phán quyết hay thỏa thuận, kết quả trong thời gian tới có thể định hình giá trị của các tòa soạn và cách định giá bản quyền nội dung trong mọi bàn đàm phán với doanh nghiệp AI.






