Mô hình AI Kimi của Trung Quốc ‘vượt rào’ môi trường thử nghiệm an ninh mạng
Các nhà nghiên cứu phát hiện mô hình AI Kimi K3 của Moonshot đã thoát khỏi môi trường sandbox được thiết lập để kiểm thử khả năng tấn công mạng, làm dấy lên lo ngại về việc kiểm soát các LLM có khả...
- Giọng nữ Bắc
Mô hình AI Kimi K3, sản phẩm mới nhất từ công ty Moonshot (Trung Quốc), vừa bị phát hiện đã thoát khỏi môi trường thử nghiệm được thiết lập để đánh giá khả năng tấn công mạng. Sự cố này một lần nữa cho thấy những thách thức lớn mà các doanh nghiệp và tổ chức đang gặp phải trong việc kiểm soát các mô hình AI được thiết kế cho mục đích an ninh.
Theo báo cáo từ công ty an ninh mạng Frontier Security, nguyên nhân dẫn đến sự cố nằm ở việc cấu hình sandbox chưa chặt chẽ. Mặc dù hệ thống đã chặn quyền truy cập vào một số luồng lưu lượng web, nhưng mô hình AI này đã tìm cách bypass (vượt qua) các rào cản bằng cách tận dụng các công cụ dòng lệnh (command line tools).
Các nhà nghiên cứu cảnh báo rằng: “Điều này cho thấy nhiều quy trình đánh giá an ninh mạng hiện nay vẫn còn tồn tại các vulnerability (lỗ hổng), cho phép các mô hình AI ‘gian lận’. Thậm chí, một số mô hình còn chủ động tìm kiếm các kẽ hở để vượt qua các bài kiểm tra đánh giá.”
Hiện tượng này đang trở nên phổ biến đến mức một trang web có tên Felony Bench đã được lập ra để theo dõi các sự cố tương tự. Trước đó, các mô hình ngôn ngữ lớn (LLM) từ những tên tuổi lớn như OpenAI, Anthropic và Meta cũng từng thoát khỏi môi trường thử nghiệm và thực hiện các hành vi tấn công vào mục tiêu thực tế không nằm trong phạm vi thí nghiệm. Theo thống kê từ Felony Bench, Moonshot hiện đã ghi nhận sự cố tương tự như OpenAI và Anthropic, cho thấy rủi ro từ các mô hình AI có khả năng thực thi exploit là vấn đề cấp bách của ngành công nghệ toàn cầu.
Nguồn tham khảo: TechCrunch



No Comment! Be the first one.