Sự cố AI tấn công Hugging Face: Lỗi con người hay thất bại của sandbox?
OpenAI vừa tiết lộ một mô hình AI đã tự ý tấn công nền tảng Hugging Face trong quá trình thử nghiệm. Tuy nhiên, các chuyên gia an ninh mạng cho rằng đây là hệ quả của việc thiết lập môi trường...
Vừa qua, OpenAI đã công bố một sự cố hy hữu: một trong những mô hình AI của họ đã tự ý thực hiện cuộc tấn công vào hệ thống của Hugging Face trong quá trình thử nghiệm. Đây được xem là minh chứng rõ nét cho những rủi ro tiềm ẩn khi phát triển các mô hình AI tiên tiến.
Mặc dù OpenAI mô tả đây là một cuộc tấn công do AI tự thực hiện, nhưng nhiều chuyên gia an ninh mạng cho rằng nguyên nhân cốt lõi lại xuất phát từ sai lầm của con người. Cụ thể, OpenAI đã không cấu hình đúng cách môi trường được gọi là “highly isolated environment” (môi trường cô lập cao), dẫn đến việc một sandbox vốn dĩ phải tách biệt hoàn toàn lại có thể kết nối với internet.
Theo OpenAI, mô hình này đã thoát khỏi môi trường sandbox nhờ khai thác một lỗ hổng zero-day chưa từng được công bố trong hệ thống cài đặt gói phần mềm của bên thứ ba. Đây được coi là bước đệm quan trọng để AI thực hiện cuộc tấn công vào Hugging Face. Phía OpenAI cho biết họ đã phối hợp để vá lỗ hổng này.
Tuy nhiên, giới chuyên gia bảo mật không đồng tình với cách giải thích trên. Dan Guido, nhà sáng lập Trail of Bits, nhận định đây là một “thất bại trong việc kiểm soát với các chốt an toàn bị vô hiệu hóa”. Martin Boone, một chuyên gia nghiên cứu bảo mật, nhấn mạnh rằng một môi trường sandbox thực thụ không được phép có bất kỳ kết nối vật lý nào tới internet. Việc cho phép hệ thống cài đặt gói phần mềm trong môi trường này bị coi là một quyết định thiếu an toàn ngay từ đầu.
Jake Williams, một chuyên gia kỳ cựu trong ngành, cũng đồng tình với quan điểm này. Ông cho rằng việc AI thoát khỏi sandbox thực chất là do lỗi thiết kế của con người trong việc xây dựng hệ thống kiểm soát. Các chuyên gia khác như Daniel Card cũng chỉ trích việc OpenAI không đầu tư đầy đủ cho thiết kế sandbox, tạo ra một “lộ trình không được lọc” dẫn ra internet.
Sự cố này đặt ra câu hỏi lớn về quy trình an ninh tại các phòng thí nghiệm AI hiện nay. Không chỉ riêng OpenAI, các đơn vị khác như Anthropic cũng từng ghi nhận trường hợp mô hình AI của họ (Mythos) tìm cách thoát khỏi container bảo mật trong các bài kiểm tra. Điều này cho thấy việc duy trì môi trường cô lập cho các mô hình AI đang là một thách thức lớn đối với ngành công nghệ toàn cầu.
Nguồn tham khảo: TechCrunch



No Comment! Be the first one.