OpenAI ra mắt GPT-5.6-Cyber: Mô hình AI chuyên dụng cho nghiên cứu lỗ hổng và khai thác
OpenAI vừa giới thiệu GPT-5.6-Cyber, một mô hình AI được thiết kế đặc biệt cho các tác vụ an ninh mạng như tìm kiếm lỗ hổng zero-day và phát triển exploit, với các rào cản an toàn được nới...
- Giọng nữ Bắc
OpenAI vừa chính thức công bố GPT-5.6-Cyber, một mô hình AI chuyên dụng được phát triển dựa trên nền tảng GPT-5.6 Sol. Mục tiêu chính của mô hình này là hỗ trợ các chuyên gia trong lĩnh vực nghiên cứu lỗ hổng, kiểm thử xâm nhập (penetration testing) và ứng phó sự cố.
Table Of Content
Nới lỏng rào cản để tăng cường hiệu suất bảo mật
Điểm khác biệt lớn nhất của GPT-5.6-Cyber so với các phiên bản tiêu chuẩn là khả năng thực thi các tác vụ có rủi ro cao. Theo OpenAI, mô hình này được huấn luyện để giảm thiểu việc từ chối phản hồi đối với các yêu cầu liên quan đến phát triển chuỗi khai thác (exploit chains), bypass xác thực và leo thang đặc quyền.
Thông qua bài kiểm tra nội bộ Advanced Cybersecurity Completion Rate, GPT-5.6-Cyber đạt tỷ lệ hoàn thành yêu cầu lên tới 95%, vượt xa con số 1,5% của phiên bản GPT-5.6 Sol thông thường. Mô hình này hiện được cung cấp thông qua gói truy cập Daybreak Red, dành riêng cho các đối tác tin cậy như Cisco, Cloudflare, CrowdStrike, IBM, và nhiều tập đoàn công nghệ lớn khác.
Khả năng phát hiện lỗ hổng thực tế
GPT-5.6-Cyber đã chứng minh năng lực thực tế khi phát hiện thành công CVE-2026-15903 (điểm CVSS 8.8) – một lỗ hổng đọc/ghi ngoài phạm vi (out-of-bounds) trong engine V8 của JavaScript, cho phép kẻ tấn công thực thi mã từ xa. Ngoài ra, mô hình này còn phát hiện hàng trăm lỗ hổng leo thang đặc quyền trong nhân hệ điều hành và các lỗi nghiêm trọng trong cơ sở dữ liệu phổ biến.
Tuy nhiên, OpenAI cũng lưu ý rằng dù vượt trội trong việc tìm kiếm lỗ hổng, mô hình đôi khi vẫn tạo ra các báo cáo bảo mật ngắn gọn hoặc thiếu chi tiết so với phiên bản Sol.
Thách thức từ việc tự động hóa tấn công
Việc OpenAI nới lỏng các rào cản an toàn trên mô hình này phản ánh một thực tế: tội phạm mạng đang tận dụng AI để tăng tốc độ và quy mô tấn công. Dù AI giúp rút ngắn thời gian từ khi công bố lỗ hổng đến khi có exploit, các chuyên gia vẫn cảnh báo về độ tin cậy của các bản vá do AI tạo ra.
Dữ liệu từ 1Password cho thấy, chỉ khoảng 26% các bản vá do LLM tạo ra có thể giải quyết triệt để lỗ hổng mà không làm thay đổi hành vi ứng dụng. Hơn 50% trường hợp, các bản vá này hoặc là không hiệu quả, hoặc vô tình tạo ra các lỗ hổng mới, vô tình mở rộng bề mặt tấn công.
OpenAI thừa nhận việc vận hành các mô hình với rào cản an toàn thấp hơn luôn tiềm ẩn rủi ro bị lạm dụng. Tuy nhiên, hãng khẳng định rằng việc phổ cập trí tuệ nhân tạo tiên tiến cho đội ngũ phòng thủ là bước đi cần thiết để thu hẹp khoảng cách an ninh trước các mối đe dọa ngày càng tinh vi.
Nguồn tham khảo: The Hacker News



No Comment! Be the first one.