Kỹ thuật suy luận mới của OpenAI gây lo ngại cho các chuyên gia an toàn AI
Kỹ thuật 'opaque recurrence' (tái diễn mờ) trên mô hình Astra của OpenAI đang làm dấy lên những lo ngại về khả năng giám sát quá trình suy luận của AI, khiến các chuyên gia an toàn lo ngại về sự...
OpenAI đang đối mặt với làn sóng chỉ trích từ cộng đồng an toàn AI sau khi có thông tin về việc mô hình Astra mới sử dụng một kỹ thuật suy luận mang tên “recurrent depth” (độ sâu tái diễn), hay còn gọi là “opaque recurrence” (tái diễn mờ). Kỹ thuật này cho phép mô hình xử lý thông tin theo cách phi tuần tự, khác biệt hoàn toàn với cơ chế Chain of Thought (CoT) truyền thống.
Rủi ro từ việc mất khả năng giám sát
Trong các mô hình AI hiện nay, Chain of Thought đóng vai trò như một “nhật ký” ghi lại các bước tư duy logic của máy tính. Đây là công cụ quan trọng để các nhà nghiên cứu kiểm tra xem AI có đang hoạt động lệch hướng hay không. Tuy nhiên, với “opaque recurrence”, mô hình sẽ xử lý truy vấn thông qua các vòng lặp phức tạp, khiến các dấu vết suy luận trở nên khó đọc hoặc gần như không thể truy vết.
Buck Shlegeris, CEO của Redwood Research, bày tỏ sự lo ngại sâu sắc: “Nếu OpenAI tiếp tục đẩy mạnh kỹ thuật này, họ sẽ có khả năng tăng cường độ tái diễn lên mức cực đại, từ đó phá hủy hoàn toàn khả năng giám sát CoT”.
Phản hồi từ OpenAI và giới chuyên gia
Mặc dù OpenAI khẳng định việc sử dụng kỹ thuật này trên Astra hiện vẫn còn hạn chế và cam kết duy trì tính minh bạch trong các hệ thống giám sát, nhiều chuyên gia vẫn hoài nghi. Zvi Mowshowitz, một nhà vận động an toàn AI lâu năm, cảnh báo rằng việc này có thể dẫn đến một “cuộc đua xuống đáy” (race to the bottom) giữa các phòng thí nghiệm AI, nơi tính minh bạch bị hy sinh để đổi lấy hiệu suất.
Jakub Pachocki, Giám đốc khoa học của OpenAI, đã lên tiếng trấn an trên mạng xã hội X rằng việc duy trì các chuỗi suy luận dễ đọc vẫn là mục tiêu cốt lõi trong chương trình nghiên cứu của công ty. Tuy nhiên, Ryan Greenblatt từ Redwood Research cảnh báo rằng một khi kỹ thuật này được mở rộng, các mô hình có thể chuyển sang suy luận hoàn toàn trong “latent space” (không gian tiềm ẩn), khiến mọi quá trình tư duy của AI trở nên vô hình đối với con người.
Hiện tại, các ông lớn khác trong ngành như Google DeepMind và Anthropic cũng được cho là đang theo dõi sát sao kỹ thuật này, đặt ra câu hỏi lớn về sự cân bằng giữa sức mạnh tính toán và khả năng kiểm soát an toàn trong tương lai của AI.
Nguồn tham khảo: TechCrunch
No Comment! Be the first one.