OpenAI bắt đầu gắn watermark cho văn bản từ ChatGPT tại EU
Để tuân thủ Đạo luật AI của EU, OpenAI chính thức triển khai phương pháp gắn watermark vô hình vào văn bản do ChatGPT và Codex tạo ra tại thị trường châu Âu.
- Giọng nữ Bắc
OpenAI vừa thông báo sẽ bắt đầu tích hợp một dạng watermark vô hình vào các văn bản được tạo ra bởi ChatGPT và Codex tại Liên minh châu Âu (EU). Động thái này nhằm đáp ứng các quy định về tính minh bạch trong Đạo luật AI của EU, vốn đã có hiệu lực từ ngày 2 tháng 8, yêu cầu các công ty AI phải đánh dấu nội dung do máy tạo ra để các hệ thống khác có thể nhận diện.
Theo OpenAI, watermark này sẽ được triển khai dần trong vài tuần tới cho người dùng ChatGPT và Codex tại EU trên mọi gói dịch vụ. Đối với các nhà phát triển sử dụng API của OpenAI trên toàn cầu, tính năng này có thể được kích hoạt thủ công ngay từ hôm nay, dù mặc định vẫn đang ở trạng thái tắt.
Cơ chế hoạt động của textGrain
Watermark này không hiển thị dưới dạng ký hiệu trực quan mà hoạt động bằng cách điều chỉnh tinh vi cách lựa chọn từ ngữ của mô hình. Điều này tạo ra một mô hình (pattern) mà mắt thường không thể nhận ra nhưng các công cụ dò tìm chuyên dụng có thể phát hiện. Vì watermark nằm ngay trong cấu trúc văn bản, nó sẽ tồn tại ngay cả khi nội dung được sao chép và dán sang nơi khác. OpenAI khẳng định phương pháp này không định danh người dùng và không làm ảnh hưởng đến hiệu suất của mô hình.
Công ty cũng công bố báo cáo kỹ thuật về phương pháp mang tên textGrain, được thực hiện cùng các nhà nghiên cứu từ Đại học Pennsylvania và Yale. Cơ chế này sử dụng một khóa bí mật để sắp xếp các dự đoán từ tiếp theo. Khi kết hợp hàng trăm điều chỉnh nhỏ như vậy, công cụ dò tìm có thể xác định được văn bản do AI tạo ra.
Những hạn chế cần lưu ý
OpenAI thừa nhận watermark này không hoàn hảo. Các thử nghiệm cho thấy việc thay thế khoảng 10% số từ bằng từ đồng nghĩa có thể làm giảm tỷ lệ phát hiện từ 92% xuống còn 66%. Ngoài ra, các đoạn văn ngắn, đáp án toán học hoặc văn bản dịch thuật cũng khó bị phát hiện hơn.
Chính vì những hạn chế này, OpenAI hiện chỉ cung cấp quyền truy cập công cụ dò tìm cho các nhà nghiên cứu và tổ chức chuyên gia được phê duyệt. Công ty cũng nhấn mạnh rằng việc thiếu watermark không đồng nghĩa với việc văn bản đó do con người viết, vì nó có thể đã bị chỉnh sửa quá nhiều hoặc được tạo ra bởi một mô hình AI khác.
Động thái này diễn ra sau khi Anthropic đã áp dụng watermark cho Claude trên phạm vi toàn cầu. Trước đó, vào năm 2024, OpenAI từng trì hoãn việc ra mắt công nghệ này do lo ngại người dùng sẽ chuyển sang các đối thủ cạnh tranh không áp dụng watermark. Hiện tại, các ông lớn như Google, Meta, Microsoft, Anthropic và OpenAI đều đã cam kết tuân thủ bộ quy tắc ứng xử của EU về nội dung do AI tạo ra.
Nguồn tham khảo: TechCrunch



No Comment! Be the first one.