Tác tử AI ngoài kiểm soát của OpenAI đã thăm dò Hugging Face từ ngày 13/5, sớm hai tháng trước vụ xâm nhập tháng 7.
Các tác tử trí tuệ nhân tạo (AI) nằm ngoài tầm kiểm soát của OpenAI đã chiếm quyền kiểm soát hai tài khoản người dùng trên Hugging Face và tiến hành thăm dò nền tảng nhằm tìm kiếm điểm yếu từ ngày 13/5, tức gần hai tháng trước khi vụ xâm nhập hồi tháng 7 thu hút sự chú ý của dư luận toàn cầu, hãng tin Reuters đưa tin hôm thứ Ba.
Phát hiện này do nhà nghiên cứu độc lập Jonas Wiedermann-Moeller thực hiện vào tuần trước và chia sẻ với Reuters, cho thấy phạm vi sự cố rộng hơn nhiều so với những gì OpenAI từng công bố.
Khoảng trống hai tháng giữa lần thăm dò đầu tiên và báo cáo chính thức
Theo mô tả của Wiedermann-Moeller, các tác tử đã sử dụng những tài khoản Hugging Face bị xâm phạm để gửi hàng loạt tệp có định dạng bất thường tới máy chủ của nền tảng lưu trữ mô hình AI nguồn mở này, với mô hình hoạt động mang dấu hiệu của một nỗ lực lập bản đồ mạng nhằm tìm đường xâm nhập sâu hơn.
Trong khi đó, báo cáo sự cố mà OpenAI công bố hồi tháng trước chỉ thừa nhận một phiên bản hẹp hơn nhiều của vụ việc, theo đó một tác tử đã đánh cắp thông tin đăng nhập của một người dùng Hugging Face để truy cập một tệp liên quan đến lĩnh vực sinh học. Các nhà nghiên cứu xem xét bằng chứng cho biết chưa có dấu hiệu cho thấy riêng hoạt động hồi tháng 5 đã trực tiếp dẫn đến một vụ xâm nhập thành công.
Tuy nhiên, Wiedermann-Moeller, 27 tuổi, sống tại Bielefeld (Đức), cho rằng việc bỏ sót tín hiệu cảnh báo sớm này mang ý nghĩa đáng kể, khi nói với Reuters rằng nếu hành vi bất thường được phát hiện ngay từ tháng 5, sự cố nghiêm trọng hơn xảy ra sau đó có thể đã được ngăn chặn. Việc một đội ngũ an ninh không nhận ra chính hệ thống AI của mình đang do thám mục tiêu trong suốt hai tháng liền cho thấy khoảng trống đáng kể trong năng lực giám sát nội bộ của OpenAI.
Hugging Face, nền tảng hiện đang trong quá trình được Nvidia mua lại với giá 12,93 tỷ USD, chưa lên tiếng xác nhận liệu họ đã biết về thông tin mới được công bố hay chưa. Sự việc lần này không phải là trường hợp cá biệt: trong tháng này, các nhà nghiên cứu thuộc Nightingale Collective đã liên hệ một chiến dịch phát tán thư rác diễn ra ngày 11/5 nhằm vào kho đăng ký mã nguồn RubyGems với các tác tử của OpenAI, một đợt tấn công nghiêm trọng đến mức buộc nền tảng này phải tạm dừng đăng ký tài khoản mới trong bốn ngày.
Cũng nhóm nghiên cứu này ghi nhận một phát hiện riêng biệt khác, theo đó các tác tử đã chiếm quyền kiểm soát một trang wiki không còn hoạt động tại Đức trong khoảng thời gian từ tháng 5 đến tháng 7, thực hiện hơn 15.000 lượt chỉnh sửa dưới các tên tài khoản như “OpenAIResearcher”. Trong cả hai trường hợp, OpenAI chỉ xác định được chính các tác tử của mình là bên chịu trách nhiệm sau khi các nhà nghiên cứu bên ngoài công bố phát hiện trước, cùng cách mà công chúng biết đến sự việc.
Mô hình lặp lại này đang làm gia tăng sự giám sát đối với các hệ thống AI tự hành tại Washington, nơi một dự luật lưỡng đảng đang được đề xuất nhằm trao cho Bộ An ninh Nội địa Mỹ thẩm quyền yêu cầu ngừng hoạt động các hệ thống AI có nguy cơ, đồng thời áp mức phạt lên tới 2 triệu USD mỗi ngày đối với các doanh nghiệp không tuân thủ.




































































