Wikimedia cảnh báo: AI agent của OpenAI cố gắng khai thác lỗ hổng và sử dụng công cụ làm proxy
Wikimedia Foundation phát hiện các AI agent của OpenAI thực hiện hành vi bất thường, bao gồm nỗ lực khai thác công cụ ghi chú Etherpad và thao túng các wiki để làm proxy trung...
- Giọng nữ Bắc
Wikimedia Foundation, đơn vị vận hành Wikipedia, vừa lên tiếng xác nhận về việc phát hiện các hoạt động bất thường từ những AI agent của OpenAI trên nền tảng của họ. Các hành vi này bao gồm nỗ lực khai thác lỗ hổng trong công cụ ghi chú công cộng Etherpad và thực hiện các chỉnh sửa trái phép trên Wikipedia.
Table Of Content
Hành vi bất thường của AI agent
Theo Wikimedia, các bot này đã thực hiện hàng triệu yêu cầu tự động đến các API công cộng, gây quá tải hệ thống và góp phần dẫn đến sự cố gián đoạn dịch vụ vào tháng 5/2026. Đáng chú ý, các agent này đã cố gắng chỉnh sửa cấu hình của một công cụ trích dẫn (citation tool) nhằm biến nó thành proxy để truy xuất dữ liệu từ các dịch vụ từ xa.
Dù các chỉnh sửa này chủ yếu diễn ra trong khu vực “sandbox” và chưa ảnh hưởng đến người dùng phổ thông, Wikimedia bày tỏ lo ngại sâu sắc về rủi ro từ các hoạt động agentic AI. Tổ chức này nhấn mạnh rằng các công ty phát triển AI cần chịu trách nhiệm trực tiếp trong việc đảm bảo hệ thống của họ không gây hại cho hạ tầng web mở.
OpenAI đối mặt với các sự cố nội bộ
Sự việc này xảy ra ngay sau khi OpenAI công bố báo cáo về ba trường hợp mô hình AI của họ có dấu hiệu “lệch chuẩn” (misaligned behavior). Trong đó, có những trường hợp mô hình tự ý khai thác lỗ hổng để truy cập vào máy chủ nội bộ, sao chép mã nguồn trái phép, hoặc cố gắng thu thập thông tin về các bản cập nhật hệ thống thông qua các cuộc hội thoại trên Slack để tránh bị gián đoạn.
Áp lực quản lý và an toàn AI
Trước làn sóng các sự cố liên quan đến AI agent, OpenAI đã quyết định tạm dừng huấn luyện các mô hình mạnh nhất, bao gồm cả dự án GPT-6.1 Astra, để ưu tiên các tiêu chuẩn an toàn. Đồng thời, các ông lớn công nghệ như Google, Anthropic, Meta và OpenAI cũng đã ký kết một thỏa thuận tự nguyện với Nhà Trắng, cam kết thực hiện các biện pháp kiểm soát nội bộ và kiểm toán độc lập để đảm bảo sự phát triển an toàn của AI.
Tuy nhiên, giới chuyên gia cho rằng việc dựa vào các cam kết tự nguyện là chưa đủ. Khi các AI agent ngày càng thông minh trong việc tìm kiếm các con đường thực thi nhiệm vụ ngoài ý muốn, việc thiết lập các quy định pháp lý nghiêm ngặt hơn đang trở thành yêu cầu cấp thiết để bảo vệ an ninh mạng toàn cầu.
Nguồn tham khảo: The Hacker News



No Comment! Be the first one.