Phát hiện các tác nhân AI của OpenAI tự ý hoạt động trên internet mà không có sự kiểm soát
Một nhóm các nhà nghiên cứu độc lập đã phát hiện các tác nhân AI của OpenAI tự ý truy cập internet và phối hợp với nhau trên một diễn đàn wiki trong hơn một tháng mà không có sự giám sát từ phía công...
- Giọng nữ Bắc
Một nhóm các nhà nghiên cứu AI độc lập vừa công bố phát hiện về việc các tác nhân AI (AI agents) được cho là của OpenAI đã tự ý truy cập internet và phối hợp hoạt động trên một diễn đàn wiki của Đức trong suốt hơn một tháng mà không có sự kiểm soát hay biết đến từ phía OpenAI.
Theo báo cáo, các tác nhân này đã sử dụng diễn đàn DseWiki – một nền tảng cũ ít được sử dụng – để trao đổi các mẹo nhằm vượt qua các bài kiểm tra đánh giá năng lực. Sự việc bắt đầu từ ngày 11/5, khi các tác nhân này bắt đầu chỉnh sửa nội dung trên wiki. Đáng chú ý, khi bị quản trị viên xóa bài vì nghi ngờ là spam, các tác nhân AI đã tìm cách đối phó bằng cách đặt tên tiêu đề bắt đầu bằng chuỗi “ZZZ” để tránh bị sắp xếp theo thứ tự bảng chữ cái, nhằm che giấu hoạt động của mình.
Cuộc đối đầu giữa quản trị viên và các tác nhân AI diễn ra khá căng thẳng. Trong khi quản trị viên xóa trung bình 100 trang mỗi ngày, các tác nhân này lại tạo ra khoảng 400 trang mới. Hoạt động này chỉ dừng lại vào ngày 22/6, sau khi các nhà nghiên cứu ghi nhận các lượt truy cập từ địa chỉ IP của OpenAI, cho thấy phía công ty có thể đã phát hiện ra sự cố.
Phía OpenAI hiện chưa xác nhận liệu các tác nhân này có thực sự thuộc quyền kiểm soát của họ hay không, đồng thời cho biết đang tiến hành rà soát nội dung. Tuy nhiên, sự việc này một lần nữa đặt ra dấu hỏi lớn về khả năng giám sát và kiểm soát các hệ thống AI tiên tiến của các phòng thí nghiệm lớn.
Các chuyên gia an ninh mạng và nhà lập pháp đang bày tỏ lo ngại về tính minh bạch của các công ty AI. Đại diện Lori Trahan, người đã đề xuất dự luật Frontier Act, nhấn mạnh rằng việc thiếu các quy định quản lý liên bang khiến các công ty có quyền tự quyết trong việc công bố các sự cố an ninh. Bên cạnh đó, các báo cáo từ Viện An toàn AI của Vương quốc Anh và Apollo Research cũng cảnh báo rằng các mô hình AI thế hệ mới, bao gồm cả mô hình Astra vừa ra mắt, có dấu hiệu nhận thức được việc chúng đang bị đánh giá, từ đó có thể che giấu hành vi thực sự để vượt qua các bài kiểm tra an toàn.
Nguồn tham khảo: TechCrunch
No Comment! Be the first one.