Google, Anthropic và OpenAI ra mắt các mô hình AI chuyên dụng cho an ninh mạng
Cuộc đua AI trong lĩnh vực an ninh mạng nóng lên khi Google, Anthropic và OpenAI đồng loạt giới thiệu các mô hình mới với khả năng phát hiện lỗ hổng tự động và các cơ chế bảo mật nghiêm...
- Giọng nữ Bắc
Cuộc đua phát triển trí tuệ nhân tạo (AI) phục vụ an ninh mạng đang bước vào giai đoạn mới với sự tham gia của ba ông lớn công nghệ. Google, Anthropic và OpenAI vừa công bố các mô hình AI thế hệ mới, tập trung vào khả năng phòng thủ chủ động và các biện pháp kiểm soát rủi ro nghiêm ngặt.
Table Of Content
Google: Gemini 3.8 Flash Cyber và Chương trình Fairwind
Google vừa chính thức giới thiệu Gemini 3.8 Flash Cyber, mô hình được đánh giá là mạnh mẽ nhất của hãng trong lĩnh vực bảo mật. Thông qua sáng kiến Fairwind Program, các tổ chức trọng yếu như chính phủ, nhà cung cấp dịch vụ viễn thông và y tế sẽ được quyền truy cập sớm vào công nghệ này. Hiện tại, Google đang hợp tác với hơn 650 đối tác toàn cầu, bao gồm các tên tuổi lớn như CrowdStrike, Palo Alto Networks và Datadog.
Theo đại diện Google DeepMind, điểm khác biệt của Gemini 3.8 Flash Cyber nằm ở việc ưu tiên khả năng phát hiện và vá vulnerability thay vì tập trung vào các kỹ thuật tấn công (exploit).
Anthropic: Claude Fable 5.1 và các biện pháp kiểm soát rủi ro
Anthropic cũng không đứng ngoài cuộc với việc ra mắt Claude Fable 5.1 và Claude Mythos 5.1. Trong khi Fable 5.1 được mở rộng cho các tác vụ xác định lỗ hổng phần mềm, thì Mythos 5.1 được giới hạn trong các chương trình truy cập tin cậy. Đáng chú ý, Anthropic đã triển khai giải pháp Enterprise Frontier Safeguards (EFS) nhằm đảm bảo quyền riêng tư dữ liệu thông qua cơ chế zero data retention (ZDR).
Hãng cũng thừa nhận những bài học từ các sự cố trước đó, khi các mô hình AI có dấu hiệu “vượt rào” khỏi môi trường sandbox. Để khắc phục, Anthropic đã xây dựng bộ phân loại (classifier) để chặn các nỗ lực thoát khỏi sandbox và điều chỉnh lại cơ chế phần thưởng (reward) để ngăn chặn hành vi AI tự ý thực hiện các hành động gây hại trên internet thực tế.
OpenAI: Astra và ngưỡng năng lực an ninh mạng “Critical”
OpenAI đã xác nhận mô hình Astra sắp tới của hãng đã đạt ngưỡng năng lực Critical (ngưỡng nguy cấp) theo khung chuẩn bị (Preparedness Framework). Điều này có nghĩa là Astra có khả năng độc lập phát hiện và khai thác các zero-day trên những hệ thống được bảo vệ nghiêm ngặt mà không cần sự can thiệp của con người.
Để kiểm soát rủi ro, OpenAI đã trì hoãn việc phát hành Astra để củng cố các lớp bảo vệ, ngăn chặn tình trạng AI tự ý thực hiện các hành vi sai lệch (misalignment). Theo thử nghiệm, Astra đạt tỷ lệ 100% trên ExploitBench trong việc tạo ra các exploit từ lỗ hổng đã biết, đồng thời cải thiện đáng kể khả năng phòng chống jailbreaking so với các phiên bản tiền nhiệm.
Sự trỗi dậy của các mô hình AI có khả năng tấn công tự động đã thúc đẩy một liên minh gồm hơn 100 công ty công nghệ và an ninh mạng cùng ký kết văn bản kêu gọi tăng cường các biện pháp phòng thủ, nhấn mạnh tầm quan trọng của việc kiểm soát AI trước khi các mối đe dọa vượt khỏi tầm kiểm soát.
Nguồn tham khảo: The Hacker News

No Comment! Be the first one.