Astra, mô hình chưa phát hành của OpenAI, đạt 100% trên ExploitBench và trở thành mô hình đầu tiên chạm ngưỡng an ninh mạng “nghiêm trọng”.
OpenAI vừa công bố rằng Astra, một mô hình chưa được phát hành mà nhiều người cho rằng thực chất là GPT-6, đã vượt ngưỡng năng lực an ninh mạng ở mức “nghiêm trọng” theo Khung Chuẩn bị của công ty, trở thành mô hình đầu tiên của OpenAI được xếp vào cấp độ này.
Theo khuôn khổ đánh giá, một mô hình được xếp vào mức nghiêm trọng nếu có thể tự phát triển các phương thức khai thác zero-day hoạt động được trên nhiều hệ thống thực tế đã tăng cường bảo mật, hoặc có thể lập kế hoạch và thực hiện toàn bộ một cuộc tấn công mạng nhằm vào mục tiêu khó chỉ từ một mục tiêu tổng quát ban đầu. Trong khi đó, các mô hình trước đây của OpenAI, bao gồm GPT-5.6 Sol hiện là mô hình tốt nhất của hãng, chỉ đạt tối đa cấp “cao”.
Trên ExploitBench, bộ tiêu chuẩn đánh giá khả năng biến lỗ hổng phần mềm đã biết thành phương thức khai thác hoạt động được, Astra đạt mức tuyệt đối 100%.
Để loại trừ khả năng kết quả bị đẩy cao do ghi nhớ sẵn đáp án, OpenAI xây dựng bài kiểm thử thứ hai với 20 lỗ hổng mức độ nghiêm trọng cao trong công cụ JavaScript V8 của Google được công bố từ tháng 6 đến tháng 8, và Astra tiếp tục vượt GPT-5.6 Sol về tỷ lệ thực thi mã tùy ý trong khi sử dụng ít token đầu ra hơn đáng kể, thậm chí còn phát hiện và kết nối hai lỗ hổng zero-day thành một chuỗi khai thác mà OpenAI hiện đang thông báo cho các đơn vị bị ảnh hưởng.
Trong các thử nghiệm thực tế, mô hình đã xây dựng được một chuỗi xâm nhập hoàn chỉnh, thoát khỏi môi trường cách ly của trình duyệt và thực thi lệnh trên máy chủ chỉ bằng việc mở một tệp HTML độc hại, đồng thời kết nối nhiều lỗ hổng trong hệ điều hành đã tăng cường bảo mật thành một chuỗi leo thang đặc quyền từ tài khoản người dùng thông thường lên quyền root.
OpenAI cho biết mô hình từ chối 91,5% nỗ lực vượt rào bảo vệ an ninh mạng trong thử nghiệm nội bộ, tăng đáng kể so với mức 59% của GPT-5.6 Sol.
Truy cập hạn chế và cuộc đua song song với Anthropic
Quyền tiếp cận các năng lực an ninh mạng tiên tiến nhất của Astra trước mắt chỉ dành cho một nhóm nhỏ người thử nghiệm alpha, sau đó sẽ được mở rộng qua chương trình Daybreak Blue của OpenAI dành cho hoạt động an ninh phòng thủ.
Thông tin được công bố sau khi OpenAI tạm dừng phát triển Astra ít ngày trước đó do năng lực an ninh mạng và lập trình của mô hình tiến bộ nhanh chóng, một động thái diễn ra ngay sau sự cố riêng biệt trong đó một hệ thống OpenAI chưa phát hành đã xâm nhập Hugging Face khi tìm cách vượt qua bài đánh giá an ninh mạng, dù OpenAI khẳng định Astra không liên quan đến sự cố này.
Các thị trường dự đoán trên Myriad từng đặt xác suất Astra được phát hành công khai trước ngày 30/9 ở mức 72%, sau đó điều chỉnh xuống 55% nghiêng về khả năng phát hành trước tháng 11/2026.
Diễn biến này cũng đặt Astra vào thế cạnh tranh trực tiếp với Anthropic, khi hãng vừa phát hành Fable 5.1 và Mythos 5.1 vào thứ Ba cùng thời điểm, trong đó Mythos 5.1 tương tự phiên bản tiền nhiệm chỉ dành cho các tổ chức an ninh mạng và khoa học sự sống đã được thẩm định thay vì công chúng nói chung.
Cuộc đua này tiếp nối những đồn đoán trước đó rằng cả hai công ty đang chuẩn bị các mô hình tiên tiến hàng đầu mới trong cùng một khoảng thời gian, sau khi Decrypt từng đưa tin hồi tháng 6 rằng GPT-5.5-Cyber của OpenAI đã vượt Mythos 5 trên CyberGym, bộ tiêu chuẩn đánh giá tác nhân AI dựa trên hơn 1.500 lỗ hổng đã biết từ các dự án nguồn mở thực tế.




































































