Tâm điểm vụ kiện OpenAI: bản quyền AI không còn là vùng xám
Vụ kiện bản quyền AI giữa một tòa soạn lớn của Mỹ và các công ty phát triển mô hình ngôn ngữ đã trở thành phép thử trung tâm cho việc sử dụng hợp pháp nội dung báo chí trong dữ liệu huấn luyện AI, khi tòa án phải đối mặt đồng thời với câu hỏi về quyền tác giả, mô hình kinh tế báo chí và vai trò chiến lược của công nghệ trong kỷ nguyên chatbot. Vụ kiện OpenAI bùng nổ vào cuối năm 2023, khi tòa soạn này khởi kiện hai công ty công nghệ vì sử dụng bài viết của họ để huấn luyện dữ liệu huấn luyện AI mà không xin phép và cũng không trả bất kỳ khoản bồi thường nào. Cùng thời gian, thêm 11 cơ quan báo chí khác đã tham gia vụ kiện, cho thấy đây không còn là mâu thuẫn cá biệt mà là xung đột cấu trúc giữa ngành báo chí và làn sóng AI tạo sinh. Việc hồ sơ được công khai đã kéo tranh luận từ phạm vi pháp đình ra thị trường vốn và cả các bàn tròn chính sách về bản quyền AI.

Hồ sơ nội bộ rò rỉ: khi Big Tech thừa nhận “vụ cướp lao động lớn nhất”
Điểm khiến vụ kiện OpenAI trở nên khác biệt là lần này, quan điểm thẳng thắn nhất về dữ liệu huấn luyện AI không đến từ phía nguyên đơn, mà từ chính tài liệu nội bộ của các bị đơn. Một giám đốc khoa học ứng dụng của một tập đoàn công nghệ lớn mô tả việc dùng bài báo để huấn luyện mô hình là “vụ cướp lao động lớn nhất trong lịch sử”, trực tiếp ám chỉ cách đối tác AI của họ đang “hấp thụ” nội dung báo chí để xây dựng sản phẩm. Ông còn cảnh báo rằng hàng triệu người trên thế giới sẽ coi việc các mô hình lớn nuốt trọn công sức của họ là một hành vi cướp bóc chưa từng có, và gọi đây là loại sản phẩm “tự phá hủy chuỗi cung ứng” của chính ngành báo. Nội dung này làm suy yếu mạnh mẽ lập luận rằng việc sử dụng nội dung là “trung lập” hay không gây hại, đồng thời củng cố cáo buộc rằng các mô hình đang cạnh tranh trực tiếp với chính nguồn sống nuôi dưỡng chúng.
Chatbot thay thế báo chí: tác động với người dùng không còn là giả thuyết
Ở cấp độ người dùng, cuộc tranh luận về sử dụng hợp pháp nội dung không phải chuyện xa vời. Khi chatbot được dùng ngày càng giống công cụ tìm kiếm, nhiều website ghi nhận lượng truy cập từ kết quả tìm kiếm sụt hơn 50% sau khi các bản tóm tắt AI xuất hiện cùng đường link truyền thống. Một kỹ sư của một công ty AI đã sớm cảnh báo từ năm 2023 rằng dù chatbot có gắn nguồn với liên kết, người dùng sẽ không nhấp vào, và thực tế đang ủng hộ nhận định này. Các tài liệu công khai cho thấy lãnh đạo phía AI thừa nhận chatbot có thể cung cấp thông tin trực tiếp mà không dẫn người đọc về website của nhà xuất bản, biến chúng thành sản phẩm thay thế chứ không còn là kênh phân phối bổ trợ. Nếu người dùng tiếp tục tiếp cận tin tức chủ yếu qua AI, lượng truy cập và doanh thu quảng cáo của báo chí sẽ bị kéo vào trung tâm mọi tranh cãi về bản quyền và cấp phép.
Tường phí, fair use và bước ngoặt chính sách quanh dữ liệu huấn luyện AI
Tranh chấp không chỉ xoay quanh việc nội dung có bản quyền bị dùng cho dữ liệu huấn luyện AI, mà còn chạm đến vùng nhạy cảm nhất: nội dung sau tường phí. Tài liệu công khai nhắc tới cáo buộc một lãnh đạo AI từng “ăn mừng” khi nhân viên tạo được mẹo vượt tường phí của tòa soạn. Song song đó, CEO một tập đoàn công nghệ khác khẳng định mọi nội dung bị giới hạn bởi tường phí lẽ ra phải nằm trong khuôn khổ cấp phép nếu muốn sử dụng. Trong khi đó, Bộ Tư pháp Mỹ lại đề nghị tòa án xem việc huấn luyện mô hình trên tác phẩm có bản quyền là sử dụng hợp lý vì lý do an ninh quốc gia, lo ngại việc siết chặt quá mức sẽ làm suy yếu vị thế các nhà phát triển AI nội địa trước đối thủ nước ngoài. Nói cách khác, cuộc tranh luận về sử dụng hợp pháp nội dung đang bị kéo căng giữa hai cực: bảo vệ quyền tác giả và bảo đảm lợi thế chiến lược của quốc gia.
Sau phán quyết: tái thiết quan hệ giữa nhà xuất bản và công ty AI
Vụ kiện này không chỉ định đoạt trách nhiệm pháp lý của vài bị đơn, mà đang viết lại luật chơi giữa ngành truyền thông và các doanh nghiệp AI. Tòa án sẽ phải trả lời liệu sản phẩm AI huấn luyện trên nội dung báo chí có bản quyền, rồi quay lại cạnh tranh trực tiếp với chính tác phẩm gốc, có thể được xem là sử dụng hợp lý hay không. Nếu phán quyết bất lợi hoặc một thỏa thuận dàn xếp lớn xuất hiện trong vài tuần tới, các mô hình cấp phép nội dung mới gần như chắc chắn sẽ phải hình thành giữa nhà xuất bản và công ty AI. Kết quả vụ việc cũng sẽ tác động đến cách thị trường định giá hoạt động huấn luyện AI và mô hình kinh tế của báo chí trong kỷ nguyên chatbot, nơi câu hỏi không còn là “AI có nên dùng nội dung này không?”, mà là “đổi lại, ai được trả, được bảo vệ và được quyền chọn tham gia hay không?”.






