Huấn luyện mô hình AI bằng sách có bản quyền: Hợp pháp hay không?
Việc sử dụng hàng triệu tác phẩm có bản quyền để huấn luyện các mô hình AI như ChatGPT hay Claude đang là tâm điểm của các cuộc tranh cãi pháp lý. Liệu đây là hành vi vi phạm hay là sự phát triển tất...
- Giọng nữ Bắc
Các mô hình AI đứng sau những chatbot phổ biến như ChatGPT, Gemini hay Claude hiện được huấn luyện trên những kho dữ liệu khổng lồ, bao gồm hàng trăm triệu cuốn sách, bài báo và tài liệu học thuật. Nhiều tác giả cảm thấy lo ngại khi tác phẩm của họ bị sử dụng mà không có sự đồng ý, thậm chí đe dọa trực tiếp đến sinh kế của chính họ. Tuy nhiên, ranh giới pháp lý trong vấn đề này phức tạp hơn nhiều so với vẻ ngoài.
Table Of Content
Phán quyết mang tính bước ngoặt
Năm ngoái, thẩm phán William Alsup đã đưa ra một phán quyết đáng chú ý khi yêu cầu Anthropic bồi thường 1,5 tỷ USD cho một nhóm tác giả. Dù đây được xem là chiến thắng về mặt đạo đức cho giới văn nghệ sĩ, nhưng thực tế, tòa án lại khẳng định việc Anthropic huấn luyện AI là hợp pháp. Khoản phạt này chủ yếu nhắm vào hành vi sao chép sách từ các thư viện lậu (shadow libraries) thay vì bản chất của việc huấn luyện mô hình.
Thẩm phán Alsup lập luận rằng, cách các mô hình ngôn ngữ lớn (LLM) tiếp nhận hàng nghìn tỷ từ ngữ cũng tương tự như cách một nhà văn học hỏi từ các tác phẩm văn học để tạo ra những giá trị mới, thay vì chỉ đơn thuần sao chép hay thay thế tác phẩm gốc.
Thách thức từ luật bản quyền lỗi thời
Luật bản quyền hiện tại vẫn dựa trên các quy định từ năm 1976, gây khó khăn cho các thẩm phán khi phải áp dụng vào những công nghệ hiện đại. Các chuyên gia pháp lý cho rằng luật pháp hiện chưa theo kịp tốc độ phát triển của AI. Trọng tâm của các vụ kiện thường xoay quanh khái niệm “sử dụng hợp lý” (fair use) – liệu việc sử dụng dữ liệu có mang tính “chuyển đổi” (transformative) hay không.
Theo luật, việc sử dụng tài liệu có bản quyền mà không cần xin phép có thể được chấp nhận nếu phục vụ mục đích phê bình, giáo dục hoặc tạo ra tác phẩm mới mang tính đột phá. Tuy nhiên, nếu mục đích huấn luyện là để tạo ra sản phẩm cạnh tranh trực tiếp với tác phẩm gốc, tòa án thường sẽ có cái nhìn khắt khe hơn. Điển hình là vụ kiện giữa Thomson Reuters và Ross Intelligence, nơi tòa án phán quyết rằng việc huấn luyện AI để tạo ra nền tảng pháp lý cạnh tranh trực tiếp với Reuters là không hợp lý.
Tương lai của AI và bản quyền
Một vấn đề khác gây tranh cãi là liệu các tác phẩm do AI tạo ra có được bảo hộ bản quyền hay không. Trong vụ kiện Thaler v. Perlmutter, tòa án đã phán quyết rằng các tác phẩm do AI tạo ra hoàn toàn không được bảo hộ bản quyền. Điều này đặt ra thách thức lớn: làm thế nào để xác định tỷ lệ tham gia của AI trong một tác phẩm?
Hiện tại, các công ty AI vẫn đang đối mặt với hàng loạt vụ kiện tụng kéo dài. Các phán quyết ban đầu đang định hình cách ngành công nghiệp này vận hành, nhưng chưa có một giải pháp cuối cùng nào được đưa ra. Trong thời gian tới, sự không chắc chắn về mặt pháp lý sẽ tiếp tục là rào cản lớn mà các doanh nghiệp công nghệ buộc phải cân nhắc kỹ lưỡng.
Nguồn tham khảo: TechCrunch

No Comment! Be the first one.