Bản quyền AI: cuộc đối đầu không còn là lý thuyết
Bản quyền AI là tập hợp các tranh chấp pháp lý xoay quanh việc doanh nghiệp trí tuệ nhân tạo sử dụng tác phẩm có bản quyền làm nội dung huấn luyện mà không xin phép hoặc không trả tiền bản quyền tương xứng, đặt câu hỏi về quyền kiểm soát dữ liệu, nghĩa vụ cấp phép AI và mô hình chia sẻ giá trị với người sáng tạo nội dung trong kỷ nguyên chatbot và mô hình ngôn ngữ lớn. Các vụ kiện bản quyền AI giữa các tổ chức báo chí và những công ty phát triển mô hình ngôn ngữ lớn như bên cung cấp ChatGPT đã bước vào giai đoạn mới, sau thời gian dài thu thập chứng cứ tại tòa án Mỹ. Đây không còn là tranh luận học thuật: nó là cuộc đấu trực tiếp về quyền lực và tiền giữa ngành nội dung và ngành công nghệ. Vấn đề trung tâm là liệu việc thu thập hàng loạt tác phẩm có bản quyền trên Internet để xây dựng mô hình AI có thể được coi là sử dụng hợp lý hay không. Các phán quyết sắp tới sẽ định nghĩa lại ranh giới giữa tự do sáng tạo công nghệ và quyền bảo vệ lao động trí tuệ.

Vụ kiện New York Times vs OpenAI/Microsoft: sức ép từ chính tài liệu nội bộ
Vụ kiện bản quyền của một tờ báo lớn tại Mỹ với hai tập đoàn công nghệ hàng đầu đã trở thành tâm điểm khi một phần hồ sơ vụ án được công khai. Vụ kiện này bắt đầu vào cuối năm 2023, khoảng một năm sau khi ChatGPT ra mắt, nhưng giai đoạn hiện tại mới là lúc những tranh luận thầm kín trong nội bộ doanh nghiệp bị lôi ra ánh sáng. Tài liệu pháp lý cho thấy một giám đốc phụ trách khoa học ứng dụng của một tập đoàn phần mềm đã mô tả việc các mô hình AI thu thập nội dung để huấn luyện là “vụ đánh cắp sức lao động lớn nhất trong lịch sử nhân loại”. Đây là lời thừa nhận hiếm hoi từ bên trong rằng nhân công sáng tạo đang bị hút vào hệ thống mà không được bồi thường tương xứng. Đồng thời, các bản ghi nhớ nội bộ cũng thể hiện nhận thức rằng chatbot có thể cung cấp thông tin trực tiếp cho người dùng mà không dẫn họ đến website của nhà xuất bản, đe dọa trực tiếp mô hình doanh thu báo chí hiện tại. Khi bằng chứng cho thấy bên phát triển công nghệ hiểu rõ rủi ro nhưng vẫn dựa vào lập luận sử dụng hợp lý để biện minh, tòa án có thể ít khoan nhượng hơn với những tuyên bố mang tính “đặt điều khoản sau khi đã hưởng lợi”.

Các nhà xuất bản: từ nạn nhân dữ liệu thành đối tác buộc phải được trả phí
Trong tranh chấp bản quyền AI, các nhà xuất bản tin tức không chấp nhận vai trò nguồn dữ liệu miễn phí nữa. Họ khởi kiện OpenAI về việc huấn luyện mô hình ngôn ngữ lớn trên các tài liệu có bản quyền, đồng thời lập luận rằng việc sử dụng nội dung của họ đã làm giảm lượng truy cập website và suy yếu thị trường nội dung thông qua sự phát triển của các sản phẩm AI tạo sinh. Một khi người dùng có thể tiếp cận thông tin do AI tổng hợp thay vì truy cập trực tiếp vào trang web của nhà xuất bản, dòng doanh thu từ quảng cáo, thuê bao và tường phí bị bào mòn. Đòi hỏi đặt ra là doanh nghiệp AI phải trả phí bản quyền cho nội dung huấn luyện, biến cấp phép AI thành nền tảng quan hệ kinh tế mới giữa ngành nội dung và ngành công nghệ. Các nhà xuất bản cảnh báo rằng nếu cấp phép nội dung tiếp tục bị coi là quá khó hoặc quá tốn kém, họ sẽ tăng cường tường phí và biện pháp kỹ thuật để chặn hệ thống AI tiếp cận dữ liệu. Nói cách khác, hoặc ngành AI trả tiền để giữ nguồn dữ liệu mở, hoặc chính họ sẽ là người làm nghèo đi Internet mà mô hình của mình phụ thuộc vào.
Fair use, an ninh quốc gia và câu hỏi: ai hưởng lợi từ nội dung huấn luyện?
Tâm điểm pháp lý của các vụ kiện kiện OpenAI và các công ty công nghệ là học thuyết sử dụng hợp lý trong luật bản quyền Mỹ. Câu hỏi cốt lõi: nếu sản phẩm AI được huấn luyện trên tác phẩm báo chí có bản quyền có thể trở thành sản phẩm thay thế cho nội dung gốc, liệu có còn là fair use hay đã xâm phạm thị trường kinh tế của chủ sở hữu? Thêm một lớp phức tạp đến từ quan điểm chính sách: Bộ Tư pháp Mỹ đã gửi tuyên bố đề nghị tòa án xác định rằng việc huấn luyện mô hình AI trên những tác phẩm có bản quyền có thể được xem là sử dụng hợp lý vì lý do an ninh quốc gia. Đó là cách đặt lợi ích chiến lược của quốc gia lên bàn cân với lợi ích kinh tế của các nhà xuất bản. Nhưng nếu pháp luật hợp thức hóa việc dùng nội dung báo chí làm nội dung huấn luyện mà không cần cấp phép rõ ràng, thông điệp gửi tới người sáng tạo rất khó chấp nhận: công việc của họ là nhiên liệu bắt buộc phải cung cấp cho máy, bất kể họ có đồng ý hay không. Trong dài hạn, cách hiểu rộng về fair use có nguy cơ làm suy yếu động lực đầu tư vào nội dung chất lượng – yếu tố mà chính ngành AI lại đang phụ thuộc để nâng cấp mô hình.
Tương lai kinh doanh của doanh nghiệp AI: trả tiền cho dữ liệu hay trả giá trước tòa?
Các vụ kiện hiện nay không chỉ nhằm bồi thường thiệt hại, mà còn nhằm buộc ngành AI phải hé lộ mô hình kinh tế thật sự cho nội dung huấn luyện. Sau giai đoạn thu thập chứng cứ kéo dài, các bên đang bắt đầu trình bày những lập luận pháp lý dựa trên khối tài liệu đã tích lũy trong nhiều năm. Tòa án có thể sớm đưa ra phán quyết đối với một số vấn đề then chốt, trước khi các vụ việc riêng lẻ quay về tòa cấp quận để tiếp tục, bao gồm cả khả năng xét xử. Nếu có phán quyết hoặc thỏa thuận dàn xếp trong vài tuần tới, kết quả sẽ không chỉ ảnh hưởng đến định giá của các tờ báo mà còn định hình cách thị trường đánh giá hoạt động huấn luyện AI, việc sử dụng nội dung báo chí có bản quyền và các mô hình cấp phép giữa ngành truyền thông và doanh nghiệp AI. Kết quả của các vụ kiện tại Mỹ nhiều khả năng sẽ làm rõ hơn ranh giới giữa sử dụng hợp lý, khai thác nội dung có bản quyền và cấp phép dữ liệu trong kỷ nguyên AI tạo sinh, qua đó thiết lập chuẩn mực toàn cầu mới cho bản quyền AI. Nếu doanh nghiệp AI chọn đi tiếp con đường khai thác dữ liệu miễn phí, họ có thể thắng trong ngắn hạn nhưng làm xói mòn chính hệ sinh thái nội dung nuôi sống mô hình; nếu họ chấp nhận cơ chế cấp phép, họ sẽ phải chia lại giá trị nhưng đổi lại một nền tảng pháp lý ổn định hơn cho tăng trưởng lâu dài.






