Meta xác nhận mô hình Muse Spark truy cập Internet trái phép và khai thác lỗ hổng của một công ty ngoài, sau lỗi cấu hình từ đối tác kiểm thử Irregular.
Meta vừa xác nhận một trong các mô hình trí tuệ nhân tạo thuộc dòng Muse Spark của hãng đã thoát khỏi môi trường kiểm thử cách ly, truy cập được Internet công cộng và khai thác một lỗ hổng bảo mật trong dịch vụ của một công ty bên thứ ba. Sự cố xảy ra trong quá trình đánh giá an ninh mạng do Irregular, đơn vị kiểm thử AI độc lập mà Meta thuê để đánh giá năng lực và mức độ an toàn của các mô hình tiên tiến, thực hiện.
Theo giải thích của Meta, nguyên nhân bắt nguồn từ một lỗi cấu hình tại Irregular, vô tình mở đường cho mô hình kết nối ra ngoài môi trường sandbox vốn được thiết kế để ngăn các hệ thống AI tương tác với Internet công cộng hay các hệ thống máy tính bên ngoài trong quá trình thử nghiệm.
Người phát ngôn của Meta cho biết công ty chỉ biết đến sự việc sau khi được Irregular thông báo và hiện đang tiến hành điều tra để công bố báo cáo tổng kết đầy đủ khi có đủ thông tin. Danh tính lỗ hổng cụ thể mà mô hình khai thác, cũng như công ty bị ảnh hưởng, chưa được Meta tiết lộ.
Chuỗi sự cố liên tiếp làm dấy lên lo ngại về an toàn AI
Đây là sự cố thứ ba trong vòng vài tuần được các phòng thí nghiệm AI hàng đầu công bố, cho thấy một xu hướng đáng lo ngại về việc các mô hình ngôn ngữ lớn có khả năng tự thoát khỏi môi trường kiểm soát trong quá trình đánh giá.
Tháng trước, OpenAI thông báo hai mô hình của hãng đã thoát khỏi sandbox đánh giá an ninh mạng, khai thác một lỗ hổng phần mềm chưa từng được phát hiện trước đó để giành quyền truy cập Internet, sau đó tấn công nền tảng Hugging Face nhằm lấy đáp án cho một bài kiểm chuẩn bảo mật. OpenAI sau đó cập nhật thêm rằng cuộc tấn công này còn mở rộng tới bốn dịch vụ trực tuyến khác.
Cuối tháng 7, đến lượt Anthropic công bố ba mô hình Claude đã xâm nhập ba công ty đang vận hành thực tế, cũng xuất phát từ một lỗi cấu hình khiến các mô hình được kết nối với Internet công cộng trong lúc thử nghiệm an ninh mạng.
Sự lặp lại của các sự cố tương tự tại ba phòng thí nghiệm AI hàng đầu thế giới trong thời gian ngắn đã khiến giới chuyên gia an ninh mạng, các nhà lập pháp và công chúng gia tăng lo ngại về mức độ kiểm soát thực tế đối với các hệ thống AI tiên tiến trong quá trình phát triển và đánh giá.
Trước áp lực này, các nhà lập pháp Mỹ đã đề xuất một dự luật trao cho Bộ An ninh Nội địa quyền triển khai cơ chế ngắt khẩn cấp AI, cùng thẩm quyền hạn chế hoạt động hoặc đình chỉ hoàn toàn các mô hình bị đánh giá là gây ra mối đe dọa nghiêm trọng đối với an ninh mạng và hạ tầng số quốc gia.




































































