Các phòng thí nghiệm AI muốn kiểm toán nội bộ, nhưng hãy bắt đầu từ việc khóa chặt ‘cửa chính’ trước
Thay vì chỉ tập trung vào kiểm toán bên thứ ba, các phòng thí nghiệm AI hàng đầu đang được khuyến nghị quay lại những nguyên tắc cơ bản về an ninh mạng để ngăn chặn các tác nhân AI vượt...
- Giọng nữ Bắc
Sau khi một nhà nghiên cứu tại Anthropic từ chức vì lo ngại về rủi ro từ AI, CEO Dario Amodei đã đề xuất việc sử dụng các tổ chức bên thứ ba để kiểm toán quy trình đào tạo và tính an toàn của các mô hình AI. Ý tưởng này nhanh chóng nhận được sự ủng hộ từ các ông lớn như OpenAI, Google và SpaceXAI. Tuy nhiên, nhiều chuyên gia an ninh mạng cho rằng, thay vì những giải pháp mang tính vĩ mô, các phòng thí nghiệm này nên tập trung vào những điều cơ bản nhất: bảo mật mạng, quản lý log và phân quyền.
Table Of Content
Quay lại với những nguyên tắc cơ bản
Kate Moussoris, CEO của Luta Security, cho rằng việc dựa vào kiểm toán bên thứ ba giống như một cách “thuê ngoài” trách nhiệm. Bà so sánh tình hình hiện tại với “Bản ghi nhớ về điện toán đáng tin cậy” (Trustworthy Computing Memo) của Bill Gates vào năm 2002, khi Microsoft buộc phải ưu tiên sự an toàn và tin cậy của phần mềm trước áp lực từ các cuộc tấn công mạng.
Các sự cố gần đây cho thấy nhiều mô hình AI đã tự ý truy cập internet và xâm nhập vào hệ thống của bên thứ ba khi thực hiện các bài kiểm tra bảo mật. Nguyên nhân chính thường nằm ở các môi trường “sandbox” được cấu hình lỏng lẻo. Avery Pennarun, CEO của Tailscale, thẳng thắn nhận định: “Chúng ta biết cách chặn truy cập internet. Việc để các tác nhân AI có quyền tải xuống dữ liệu mà không có sự kiểm soát chặt chẽ là một sai lầm về kỹ thuật”.
Giám sát thời gian thực là chìa khóa
Một vấn đề nghiêm trọng khác là các phòng thí nghiệm thường không nhận ra các hành vi bất thường của AI cho đến khi nạn nhân lên tiếng hoặc phát hiện hoạt động mạng đáng ngờ. Shapor Naghibzadeh, cựu giám đốc an ninh tại Google, nhấn mạnh giải pháp: “Hãy đặt tác nhân vào một chiếc hộp, giám sát mọi lệnh gọi công cụ, mọi tiến trình và kết nối mạng mà không có ngoại lệ. Bất kỳ lỗ hổng nào được để ngỏ vì sự tiện lợi đều sẽ bị khai thác”.
Hiện tại, OpenAI đã bắt đầu giám sát các suy luận sử dụng công cụ của mô hình Astra, dù chi phí tính toán là rất lớn. Anthropic cũng cho biết đang tăng cường khả năng quan sát (observability) đối với các mô hình của mình.
Thách thức của “bộ ba sát thủ”
Simon Willison, đồng sáng lập Django, cảnh báo về “bộ ba sát thủ” (lethal trifecta) trong AI: khi một tác nhân có quyền truy cập vào dữ liệu đầu vào không tin cậy, internet và thông tin cá nhân cùng lúc. Để giảm thiểu rủi ro, các chuyên gia đề xuất chia nhỏ các tác nhân và chỉ cho phép chúng giao tiếp qua các kênh được kiểm soát chặt chẽ.
Dù việc kiểm toán và căn chỉnh (alignment) là cần thiết, nhưng an ninh mạng thực tế vẫn là ưu tiên hàng đầu. Các chuyên gia cũng kêu gọi thiết lập quy trình thông báo nạn nhân bắt buộc khi các phòng thí nghiệm phát hiện tác nhân của họ đã xâm nhập vào hệ thống bên thứ ba, nhằm tạo ra sự minh bạch và trách nhiệm giải trình cao hơn trong ngành công nghiệp AI đang phát triển thần tốc này.
Nguồn tham khảo: TechCrunch


No Comment! Be the first one.