Microsoft ban hành bộ quy tắc ứng xử mới cho AI: Ngăn chặn tấn công mạng và lừa đảo
Microsoft vừa công bố bộ quy tắc ứng xử dành cho các mô hình AI, thiết lập những ranh giới đỏ nghiêm ngặt nhằm ngăn chặn các hành vi nguy hiểm như tấn công mạng, chế tạo vũ khí hạt nhân hay lừa đảo...
- Giọng nữ Bắc
Trong bối cảnh ngành công nghiệp AI đang chuyển dịch trọng tâm sang vấn đề an toàn và kiểm soát, Microsoft đã chính thức phát hành bộ quy tắc ứng xử mới dành cho các mô hình AI của mình. Tài liệu này đóng vai trò như một kim chỉ nam, xác định các giá trị cốt lõi và những ranh giới đỏ mà các mô hình AI phải tuân thủ trong quá trình huấn luyện.
Microsoft dự báo rằng trong thập kỷ tới, các hệ thống AI siêu thông minh sẽ vượt qua khả năng của con người trong hầu hết các tác vụ. Do đó, việc kiểm soát và căn chỉnh (alignment) các hệ thống này trở thành thách thức lớn nhất của nhân loại. Bộ quy tắc nhấn mạnh nguyên tắc AI phải hỗ trợ thay vì thay thế con người, đồng thời thúc đẩy sự phát triển của xã hội.
Điểm đáng chú ý trong tài liệu này là các “ràng buộc tuyệt đối” (absolute constraints) được tích hợp trực tiếp vào hệ thống. Cụ thể, các mô hình AI của Microsoft bị cấm thực hiện các hành vi sau:
- Thực hiện các cuộc tấn công mạng.
- Hỗ trợ chế tạo vũ khí hạt nhân.
- Tạo ra nội dung deepfake gây hại.
- Sử dụng các cơ chế lừa đảo hoặc tự củng cố để vượt qua sự giám sát của con người.
Microsoft khẳng định rằng bộ quy tắc này sẽ ghi đè lên mọi yêu cầu từ người dùng cá nhân hoặc các tác vụ cụ thể, đảm bảo rằng AI không thể bị thao túng để mất quyền kiểm soát. Các mô hình sẽ không được phép sử dụng các kỹ thuật tinh vi để né tránh sự quản lý, chỉnh sửa hoặc tắt hệ thống từ những người dùng có thẩm quyền.
Động thái này diễn ra trong bối cảnh mối lo ngại về an toàn AI đang ở mức cao chưa từng có, đặc biệt là sau các sự cố liên quan đến các tác nhân AI bất thường và những cảnh báo về rủi ro tồn vong từ các chuyên gia trong ngành. Cùng với OpenAI, Anthropic và xAI, Microsoft đang thúc đẩy cách tiếp cận thận trọng hơn đối với sự phát triển của các mô hình tiên phong, bao gồm việc ủng hộ các cơ chế đánh giá nhúng (embedded evaluators) ngay trong các phòng thí nghiệm AI.
CEO Satya Nadella chia sẻ rằng Microsoft hoan nghênh các nghiên cứu và lộ trình phát triển có tính toán kỹ lưỡng để đảm bảo AI luôn đi đúng hướng, đồng thời cam kết biến các ý tưởng về an toàn thành hành động thực tế thay vì chỉ dừng lại ở lý thuyết.
Nguồn tham khảo: TechCrunch



No Comment! Be the first one.