Ngành xuất bản thế giới vừa chứng kiến một bước leo thang mới trong cuộc đối đầu pháp lý giữa giới sáng tạo và các tập đoàn công nghệ phát triển trí tuệ nhân tạo. Một vụ kiện tập thể (class action) nhắm vào Meta và cá nhân người sáng lập, ông Mark Zuckerberg, đã được các nhà xuất bản và tác giả đệ trình, với cáo buộc xâm phạm quyền tác giả có chủ ý nhằm phục vụ việc phát triển các mô hình ngôn ngữ lớn Llama.
Theo hachettebookgroup.com — thông cáo chính thức do chính nhà xuất bản Hachette Book Group công bố ngày 5/5/2026 — nhóm nguyên đơn gồm các nhà xuất bản và tác giả đã nộp đơn khởi kiện tập thể chống lại Meta và ông Mark Zuckerberg, cáo buộc công ty này đã sao chép trái phép hàng triệu tác phẩm văn bản để huấn luyện các mô hình AI thuộc dòng Llama.
Điểm đáng chú ý nhất trong cách đặt vấn đề của nguyên đơn nằm ở hai chữ "có chủ ý" (willful). Trong hệ thống pháp luật bản quyền của Hoa Kỳ, việc chứng minh hành vi xâm phạm mang tính cố ý có ý nghĩa rất lớn: nó không chỉ ảnh hưởng đến khả năng viện dẫn các ngoại lệ như sử dụng hợp lý (fair use), mà còn mở đường cho mức bồi thường theo luật định cao hơn đáng kể so với hành vi xâm phạm vô ý. Việc nguyên đơn đưa cả cá nhân người đứng đầu tập đoàn vào danh sách bị đơn cũng là một tín hiệu pháp lý mạnh, hàm ý rằng trách nhiệm không chỉ dừng ở cấp độ pháp nhân.
Sách và các tác phẩm văn bản dài là "nguyên liệu" có giá trị đặc biệt đối với mô hình ngôn ngữ lớn: chúng có cấu trúc chặt chẽ, ngôn ngữ chuẩn mực, lập luận mạch lạc và độ dài đủ để mô hình học được cách duy trì ngữ cảnh. Chính vì vậy, kho tác phẩm của các nhà xuất bản trở thành mục tiêu khai thác hấp dẫn — nhưng đồng thời cũng là tài sản trí tuệ được bảo hộ nghiêm ngặt.
Vụ kiện đặt ra một loạt câu hỏi pháp lý mà cả thế giới đang chờ lời giải:
Cơ chế class action cho phép một nhóm nguyên đơn đại diện cho toàn bộ những chủ thể quyền có hoàn cảnh tương tự. Điều này giúp cân bằng lại tương quan lực lượng vốn rất chênh lệch giữa từng tác giả đơn lẻ và một tập đoàn công nghệ toàn cầu — đồng thời khiến rủi ro tài chính đối với bị đơn trở nên khổng lồ.
Vụ kiện của các nhà xuất bản và tác giả đối với Meta không tồn tại đơn lẻ. Nó nằm trong một làn sóng rộng lớn hơn, trong đó cộng đồng sáng tạo — nhà văn, nhạc sĩ, họa sĩ, nhiếp ảnh gia, cơ quan báo chí — đang sử dụng công cụ tư pháp để buộc ngành AI phải trả lời câu hỏi cốt lõi: ai được hưởng lợi từ giá trị mà tác phẩm sáng tạo mang lại cho mô hình AI?
Kết quả của những vụ kiện dạng này nhiều khả năng sẽ định hình ba xu hướng: (1) hình thành thị trường cấp phép dữ liệu huấn luyện có thu phí; (2) yêu cầu minh bạch nguồn dữ liệu như một nghĩa vụ pháp lý bắt buộc; và (3) chuẩn hóa các công cụ kỹ thuật cho phép chủ sở hữu quyền tuyên bố "từ chối" (opt-out) hoặc "cho phép có điều kiện" đối với việc khai thác tác phẩm.
Việt Nam là thành viên Công ước Berne và có hệ thống pháp luật sở hữu trí tuệ ngày càng hoàn thiện. Tác phẩm của tác giả Việt Nam được bảo hộ tự động tại các quốc gia thành viên, và ngược lại. Điều đó có nghĩa: khi một mô hình AI toàn cầu thu thập dữ liệu trên internet, các tác phẩm tiếng Việt — sách, báo, giáo trình, tác phẩm số — hoàn toàn có thể nằm trong tập dữ liệu đó mà chủ sở hữu quyền không hề hay biết.
Thách thức của Việt Nam hiện nay không chỉ là quy định pháp lý, mà còn là năng lực chứng minh và thực thi: làm sao xác lập bằng chứng tác phẩm đã bị sử dụng; làm sao tập hợp các chủ thể quyền phân tán để theo đuổi một tiến trình pháp lý dài hơi; và làm sao xây dựng hạ tầng dữ liệu bản quyền đủ tin cậy để phục vụ đàm phán cấp phép.
Với chức năng nghiên cứu và thúc đẩy phát triển sáng tạo, bản quyền, Viện Nghiên cứu Phát triển Sáng tạo và Bản quyền Việt Nam (VCDI) xác định một số hướng công việc thiết thực:
Vụ kiện tập thể nhắm vào Meta và ông Mark Zuckerberg là một cột mốc đáng theo dõi của năm 2026. Dù kết quả cuối cùng ra sao, thông điệp đã rất rõ: kỷ nguyên khai thác dữ liệu sáng tạo "miễn phí và không hỏi ý kiến" đang khép lại. Với Việt Nam, đây là thời điểm thích hợp để chủ động chuẩn bị — về pháp lý, hạ tầng dữ liệu và nhận thức — thay vì chờ đến khi tranh chấp xảy ra mới đi tìm câu trả lời.
Các nhà xuất bản và tác giả đã nộp đơn kiện tập thể chống Meta và Mark Zuckerberg, cáo buộc sao chép trái phép hàng triệu tác phẩm văn bản để huấn luyện mô hình AI Llama. Vụ kiện đặt ra câu hỏi cốt lõi: ai được hưởng lợi từ giá trị mà tác phẩm sáng tạo mang lại cho AI?
Ảnh: Minh họa tạo bằng AI — VCDI