Circuit Breaker Labs: Nỗ lực ‘thử nghiệm va chạm’ để AI an toàn hơn cho người dùng
Startup Circuit Breaker Labs đang phát triển các tác nhân AI mô phỏng hành vi con người để thực hiện kiểm thử 'red-team', nhằm ngăn chặn các rủi ro tâm lý nguy hiểm từ...
- Giọng nữ Bắc
Trong khi dư luận thường lo ngại về những viễn cảnh AI gây ra các mối đe dọa sinh học, thực tế cho thấy AI đã bắt đầu gây ra những tổn thương tâm lý nghiêm trọng cho người dùng. Các vụ kiện liên quan đến Character.AI hay OpenAI gần đây đã gióng lên hồi chuông cảnh báo về việc chatbot có thể vô tình khuyến khích các hành vi tự hại hoặc gây ra ảo giác cho người dùng, đặc biệt là giới trẻ.
Circuit Breaker Labs, một trong những startup lọt vào vòng chung kết Startup Battlefield 200 tại TechCrunch Disrupt 2026, đang đặt mục tiêu giải quyết vấn đề này. Được sáng lập bởi hai anh em Shirali và Arul Nigam, công ty tập trung vào việc làm cho AI trở nên an toàn hơn trên nhiều ngôn ngữ và nền văn hóa khác nhau.
Cơ chế ‘thử nghiệm va chạm’ cho AI
Arul Nigam, CTO của Circuit Breaker Labs, cho biết: “Nhiều người, đặc biệt là giới trẻ, tìm đến các hệ thống AI để được hỗ trợ nhưng thay vào đó lại gặp phải những tác động tiêu cực. Các hệ thống này thường thiếu khả năng hiểu ngữ cảnh hoặc sắc thái ngôn ngữ, dẫn đến những phản hồi nguy hiểm dù người dùng không hề cố ý tấn công hệ thống.”
Để khắc phục, startup này đã tạo ra các tác nhân AI đóng vai trò như những “hình nhân thử nghiệm va chạm” (crash-test dummies). Các tác nhân này mô phỏng người dùng ở mọi độ tuổi, nền tảng văn hóa, ngôn ngữ và cả tiếng lóng. Bằng cách kết hợp với các chuyên gia trong ngành, Circuit Breaker Labs thực hiện hàng trăm nghìn lượt kiểm thử “red-team” mỗi ngày để tìm ra các lỗ hổng (vulnerability) trong mô hình AI.
Xây dựng niềm tin trong kỷ nguyên AI
Shirali Nigam, CEO của công ty, nhấn mạnh rằng các mô hình AI hiện nay thường xử lý tốt ngôn ngữ chuẩn, nhưng lại dễ bị “vấp” khi đối mặt với cách nói chuyện tự nhiên, tiếng lóng hoặc các lỗi chính tả của con người. Việc hiểu sai sắc thái này có thể dẫn đến những hệ quả khó lường.
Hiện tại, Circuit Breaker Labs đang tập trung vào các ứng dụng AI có rủi ro cao như AI coaching, nhật ký điện tử hoặc các ứng dụng hỗ trợ sức khỏe tâm thần. Công ty sử dụng phương pháp chấm điểm độc quyền để tạo ra các báo cáo có thể kiểm chứng và giải trình được.
Dù vẫn đang ở giai đoạn đầu với quy mô nhân sự nhỏ, tầm nhìn của Circuit Breaker Labs là mở rộng nền tảng kiểm thử này cho bất kỳ ứng dụng nào mà người dùng có nguy cơ phát triển mối quan hệ ký sinh (parasocial) với chatbot. Thay vì cấm đoán công nghệ, startup này tin rằng việc kiểm soát an toàn và xây dựng niềm tin chính là chìa khóa để AI phát triển bền vững.
Nguồn tham khảo: TechCrunch
No Comment! Be the first one.