Bỏ qua đến nội dung chính
Về trang chủ
AI Tech 5 phút đọc

Nghệ sĩ đồng loạt khởi kiện các gã khổng lồ AI vì vi phạm bản quyền

Làn sóng nghệ sĩ và nhà văn khởi kiện Google, Meta và Anthropic mở ra cuộc chiến pháp lý căng thẳng về bản quyền dữ liệu huấn luyện AI.

Tier 1 · nguồn 63% độ tin cậy Đã được duyệt
Nguồn gốc theverge.com

Một làn sóng kiện tụng mới đang bùng lên khi các nghệ sĩ và nhà văn quyết định đối đầu pháp lý với các tập đoàn công nghệ lớn như Google, Meta và Anthropic. Theo tin tức từ The Verge, cuộc chiến giành lại quyền sở hữu trí tuệ này bắt đầu đạt được những bước tiến quan trọng, thay đổi vị thế của giới sáng tạo trước sự bành trướng của AI.

Sự việc bắt đầu thu hút chú ý khi tạp chí The Atlantic công bố một cơ sở dữ liệu có thể tìm kiếm, chứa các tác phẩm được sử dụng để huấn luyện AI. Giống như nhiều đồng nghiệp, nhà văn Kirk Wallace Johnson đã tò mò tìm kiếm tên mình và phát hiện các cuốn sách phi hư cấu nổi tiếng của ông như "The Feather Thief" và "The Fishermen and the Dragon" đều nằm trong danh sách này.

Diễn biến chi tiết

Theo The Verge, việc phát hiện tác phẩm bị tự ý sử dụng đã thúc đẩy hàng loạt nghệ sĩ tìm đến các văn phòng luật sư để chuẩn bị cho các vụ kiện quy mô lớn. Nhiều tác giả trước đây vốn không hề hay biết tác phẩm của mình bị đem đi huấn luyện cho các mô hình ngôn ngữ lớn (LLM) nay đã có trong tay bằng chứng xác thực nhờ công cụ tra cứu của The Atlantic. Sự phẫn nộ của cộng đồng sáng tạo đang biến thành hành động pháp lý cụ thể chống lại các gã khổng lồ công nghệ.

Không chỉ dừng lại ở việc phản đối, một số nhóm nghệ sĩ đã bắt đầu ghi nhận những chiến thắng bước đầu tại tòa án. Các thẩm phán đã bắt đầu chấp nhận một số lập luận về việc vi phạm bản quyền trực tiếp trong giai đoạn huấn luyện mô hình. Điều này mở ra cơ hội lớn cho giới tác giả trong việc yêu cầu bồi thường và buộc các công ty công nghệ phải thay đổi hành vi thu thập dữ liệu bất hợp pháp.

Bối cảnh & Nguyên nhân

Nguyên nhân cốt lõi của làn sóng kiện tụng này xuất phát từ phương thức thu thập dữ liệu của các công ty AI. Để xây dựng các mô hình trí tuệ nhân tạo mạnh mẽ, các ông lớn công nghệ đã quét hàng triệu trang web, sách báo và tác phẩm nghệ thuật trực tuyến mà không xin phép hay trả phí cho tác giả.

Việc sử dụng các bộ dữ liệu lậu, tiêu biểu là Books3 (chứa hàng trăm nghìn cuốn sách có bản quyền), đã trở thành thông lệ ngầm trong ngành. Khi các báo cáo điều tra vạch trần hành vi này, giới sáng tạo nhận ra rằng "chất xám" của họ đang bị sử dụng để tạo ra những công cụ AI có khả năng thay thế chính họ, tạo ra làn sóng phản đối mạnh mẽ gọi là "AI slop" (rác công nghệ).

Phân tích kỹ thuật & Công nghệ

Về mặt kỹ thuật, các mô hình ngôn ngữ lớn như của Meta hay Anthropic đòi hỏi lượng dữ liệu văn bản khổng lồ để học cấu trúc ngữ pháp, phong cách viết và kiến thức thực tế. Quá trình này được gọi là tiền huấn luyện (pre-training), nơi các thuật toán phân tích hàng tỷ từ để dự đoán từ tiếp theo trong câu.

Các bộ dữ liệu như Books3 cung cấp nguồn văn bản chất lượng cao, giúp AI cải thiện khả năng tư duy logic và hành văn tự nhiên. Tuy nhiên, việc tích hợp các tác phẩm có bản quyền vào trọng số (weights) của mô hình khiến việc bóc tách hay xóa bỏ dữ liệu sau khi huấn luyện trở nên cực kỳ phức tạp về mặt kỹ thuật. Đây chính là điểm mấu chốt khiến các nghệ sĩ phải ngăn chặn ngay từ khâu đầu vào của dữ liệu.

Ý kiến chuyên gia & Nhận định

Theo các chuyên gia pháp lý được dẫn nguồn bởi The Verge, các công ty AI thường viện dẫn điều khoản "sử dụng hợp lý" (fair use) để tự bảo vệ trước tòa. Họ lập luận rằng việc huấn luyện mô hình chỉ là phân tích học máy và tạo ra một sản phẩm mang tính chuyển đổi hoàn toàn mới.

Tuy nhiên, các luật sư đại diện cho phía nghệ sĩ phản bác rằng việc sao chép toàn bộ tác phẩm có bản quyền mà không có sự đồng ý hay bồi thường tài chính là hành vi vi phạm rõ ràng. Nhận định từ thị trường cho thấy các phán quyết bất lợi sắp tới có thể buộc các công ty công nghệ phải ký kết các thỏa thuận cấp phép trị giá hàng triệu USD với các nhà xuất bản và hiệp hội tác giả.

Tác động & Tương lai

Vụ việc này được dự báo sẽ tái định hình toàn bộ nền kinh tế AI trong tương lai gần. Nếu các nghệ sĩ giành chiến thắng triệt để, kỷ nguyên "thu thập dữ liệu miễn phí" của các tập đoàn công nghệ sẽ chính thức khép lại.

Đối với độc giả và những nhà sáng tạo nội dung tại Việt Nam, vụ kiện này là một bài học quan trọng về bảo vệ tài sản trí tuệ trong kỷ nguyên số. Xu hướng toàn cầu đang dịch chuyển sang việc sử dụng dữ liệu sạch, có bản quyền, điều này sẽ thúc đẩy sự phát triển của các mô hình AI minh bạch và có đạo đức hơn.