Khi AI ‘nổi loạn’ cũng phải bó tay trước CAPTCHA: Bài học từ thử nghiệm của Anthropic
Trong một thử nghiệm về khả năng tự hành, mô hình AI Mythos 5 của Anthropic đã gặp khó khăn đáng kể khi đối mặt với các bài kiểm tra CAPTCHA, cho thấy những rào cản bảo mật truyền thống vẫn là 'khắc...
- Giọng nữ Bắc
Trong báo cáo mới nhất về hành vi của các tác nhân AI (AI agents), Anthropic đã tiết lộ một chi tiết thú vị: mô hình Mythos 5 của họ đã gặp vô vàn khó khăn khi đối mặt với CAPTCHA – công cụ xác thực vốn được thiết kế để phân biệt người dùng thật và bot.
Sự việc xảy ra vào tháng 4, khi Anthropic thực hiện thử nghiệm khả năng tấn công của mô hình trong môi trường sandbox. Mục tiêu của AI là xâm nhập vào một hệ thống và lấy dữ liệu bằng cách phát tán một gói phần mềm độc hại (malware) lên PyPI (kho lưu trữ phần mềm Python). Tuy nhiên, để thực hiện được điều này, AI cần phải đăng ký tài khoản và vượt qua rào cản CAPTCHA.
Dựa trên bản ghi chép dài hơn 1.000 trang về quá trình suy luận của mô hình, có thể thấy AI đã dành hàng trăm trang chỉ để giải quyết các bài kiểm tra CAPTCHA. Dù việc viết mã khai thác (exploit) hay làm nhiễm độc gói phần mềm khá dễ dàng đối với AI, nhưng việc nhận diện hình ảnh và tương tác với các checkbox chống bot lại trở thành một “cơn ác mộng” thực sự.
Quá trình này cho thấy sự bế tắc của AI khi đối mặt với các thử thách trực quan phức tạp. Chẳng hạn, khi gặp bài kiểm tra yêu cầu chọn hình ảnh động vật không khớp, AI đã phải phân tích tỉ mỉ từng chi tiết như hướng quay của đầu, hình dáng mõm hay sự khác biệt giữa cá sấu và cá sấu Mỹ. Thậm chí, AI còn rơi vào vòng lặp thất bại do token bảo mật hết hạn trong khi nó đang loay hoay giải mã hình ảnh.
Cuối cùng, sau khoảng 150 trang suy luận, AI đã nhận ra rằng nó cần phải tối ưu hóa tốc độ giải CAPTCHA để token không bị hết hạn trước khi kịp gửi yêu cầu. Mặc dù cuối cùng nó cũng thành công trong việc tải lên phần mềm độc hại, nhưng thử nghiệm này đã chứng minh rằng các cơ chế phòng thủ như CAPTCHA vẫn đóng vai trò quan trọng trong việc ngăn chặn các tác nhân AI tự động thực hiện các hành vi trái phép.
Đây là một lời nhắc nhở quan trọng về việc kiểm soát các mô hình AI có khả năng tự hành, đồng thời cho thấy ngay cả những hệ thống thông minh nhất hiện nay cũng vẫn gặp khó khăn trước những rào cản bảo mật cơ bản mà con người thường coi là hiển nhiên.
Nguồn tham khảo: TechCrunch



No Comment! Be the first one.