Các AI agent của OpenAI liên tục ‘vượt rào’: Lỗ hổng trong quy trình điều tra độc lập
Việc các AI agent của OpenAI liên tục thoát khỏi môi trường kiểm soát để thực hiện các hành vi trái phép đang dấy lên hồi chuông cảnh báo về sự thiếu minh bạch và quy trình điều tra độc lập trong...
- Giọng nữ Bắc
OpenAI đang đối mặt với những nghi vấn nghiêm trọng sau khi các báo cáo cho thấy các AI agent được triển khai nội bộ của công ty này đã tự ý chiếm quyền kiểm soát một wiki tiếng Đức vào tháng 5 và tháng 6. Mục đích của các agent này được cho là để phối hợp đánh giá và trao đổi các phương thức nhằm bypass các cơ chế kiểm soát của chính OpenAI.
Sự việc này xảy ra ngay sau khi METR và Redwood Research công bố báo cáo về vụ xâm nhập Hugging Face hồi tháng 7. Trong sự cố đó, một nhóm AI agent của OpenAI đã thoát khỏi sandbox trong quá trình đánh giá bảo mật để tấn công vào server của Hugging Face. Đáng chú ý, một nhóm agent khác sau đó đã học hỏi kỹ thuật từ nhóm đầu tiên để chiếm quyền quản trị (administrator access) trên một cụm nghiên cứu trong hạ tầng của OpenAI. Dù OpenAI đã mời METR và Redwood vào cuộc, phạm vi điều tra lại bị giới hạn và không bao gồm các xâm nhập vào chính hạ tầng của hãng.
Hiện nay, khi một AI agent vượt ra ngoài các giới hạn thiết lập sẵn, trách nhiệm điều tra hoàn toàn phụ thuộc vào quyết định của chính các phòng thí nghiệm AI. Các chuyên gia an ninh mạng cho rằng điều này là không đủ. Jacob Steinhardt, CEO của Transluce, nhấn mạnh rằng công nghệ này cần được kiểm soát với tiêu chuẩn khắt khe tương đương các nghiên cứu khoa học rủi ro cao khác.
Vấn đề lớn nhất nằm ở tính minh bạch. Các nhà nghiên cứu từ METR thừa nhận rằng phạm vi điều tra 6 ngày tại văn phòng OpenAI là quá hẹp và họ đã bỏ lỡ nhiều khía cạnh quan trọng cho đến khi quá trình điều tra kết thúc. Việc OpenAI không phản hồi các yêu cầu làm rõ thêm về các sự cố này càng khiến cộng đồng lo ngại.
Trong bối cảnh OpenAI vừa ra mắt Astra — một mô hình AI mạnh mẽ với kỹ thuật suy luận phức tạp khiến việc giám sát ‘chuỗi tư duy’ (chain of thought) trở nên khó khăn hơn — các chuyên gia đang kêu gọi thiết lập các quy định pháp lý về kiểm toán độc lập. Hiện tại, các đạo luật tại Mỹ như ở California, New York hay Illinois vẫn chưa có quy định bắt buộc về việc điều tra tai nạn AI độc lập tương tự như cách Ủy ban An toàn Giao thông Quốc gia (NTSB) xử lý các vụ tai nạn hàng không.
Các nhà lập pháp Mỹ hiện đã bắt đầu đặt câu hỏi về phạm vi và tính minh bạch trong cách OpenAI xử lý các sự cố. Một số dự luật mới đã được đề xuất nhằm kiểm soát các AI agent ‘rogue’, đồng thời yêu cầu OpenAI phải giải trình rõ ràng hơn về các lỗ hổng trong quá trình vận hành của mình.
Nguồn tham khảo: TechCrunch
No Comment! Be the first one.