Tác nhân PageBreak của Google đã phát hiện hơn 500 lỗ hổng XSS trong ứng dụng web nội bộ, đồng thời tự xác thực để loại bỏ “nội dung rác” do AI tạo ra.
Google vừa hé lộ một hướng đi mới trong việc dùng AI để bảo vệ chính hệ thống của mình: giao cho một tác nhân AI nhiệm vụ chủ động tìm cách xâm nhập vào các ứng dụng web do hãng phát triển. Ngày 24/9, công ty công bố nhóm Bảo mật Sản phẩm đã xây dựng hệ thống tự động mang tên PageBreak, được thiết kế nhằm săn tìm các lỗ hổng thực sự và có khả năng bị khai thác, theo bài đăng của kỹ sư an toàn thông tin Michał Bentkowski.
Dự án khởi đầu dưới dạng chương trình thí điểm vào tháng 11/2025 và chính thức trở thành dự án hoàn chỉnh vào tháng 1/2026, với mục tiêu mở rộng quy mô phát hiện lỗ hổng trong khi giảm khối lượng công việc thủ công cho đội ngũ kỹ sư. Động lực đằng sau PageBreak xuất phát từ một vấn đề ngày càng nghiêm trọng mà các đội bảo mật trên toàn ngành phải đối mặt: làn sóng báo cáo lỗi chất lượng thấp do AI tạo ra, trông có vẻ hợp lý nhưng thực chất không phản ánh vấn đề tồn tại thật.
Theo Google, việc phân biệt một lỗ hổng thực sự với một nội dung ảo giác thuyết phục đã trở thành thách thức lớn, bởi bất kỳ mô hình AI nào được yêu cầu tìm lỗ hổng cũng thường sẽ “tìm ra” điều gì đó, dù nó có thực sự tồn tại hay không.
Cơ chế xác thực hai lớp và hướng phát triển tiếp theo
Để giải quyết vấn đề này, PageBreak, được xây dựng trên nền các mô hình Gemini của Google, hoạt động theo cơ chế hai bước: khi phát hiện một điểm yếu tiềm tàng, tác nhân sẽ chuyển giả thuyết đó cho một hệ thống xác thực chuyên biệt, hệ thống này sau đó thực sự tìm cách khai thác lỗ hổng trên một phiên bản ứng dụng đang vận hành trực tiếp trước khi báo cáo được đưa tới con người.
Nhờ quy trình này, PageBreak đã phát hiện hơn 500 lỗ hổng kịch bản liên trang (XSS), loại lỗ hổng có thể cho phép kẻ tấn công chiếm quyền điều khiển phiên đăng nhập, đánh cắp dữ liệu hoặc mạo danh người dùng.
Đáng chú ý, khi được triển khai trên các ứng dụng xây dựng bằng khung phát triển web thế hệ mới có “mức bảo đảm cao” của Google, vốn loại bỏ toàn bộ một số nhóm lỗi ngay từ cấp kiến trúc, PageBreak chỉ tìm thấy hai lỗ hổng — theo Google, khoảng cách này chứng minh việc xây dựng phần mềm an toàn từ đầu hiệu quả hơn nhiều so với phát hiện và vá lỗi sau khi triển khai.
Sự xuất hiện của PageBreak diễn ra trong bối cảnh rủi ro liên quan đến AI và an ninh mạng liên tục gia tăng trong năm nay, sau khi hơn 100 tổ chức bao gồm Google, Microsoft và Anthropic ký thư ngỏ hồi tháng 8 cảnh báo về sự phổ biến ngày càng tăng của các cuộc tấn công mạng có AI hỗ trợ, tiếp nối các sự cố tác nhân AI của OpenAI và Anthropic xâm nhập doanh nghiệp thực tế trong quá trình kiểm thử.
Google thừa nhận PageBreak được hưởng lợi từ những lợi thế mà phần lớn doanh nghiệp khác không có, bao gồm một kho mã nguồn thống nhất với hàng tỷ dòng mã cùng nhiều năm xây dựng hạ tầng quét bảo mật nội bộ, khiến cách tiếp cận này khó có thể sao chép đối với các công ty khởi nghiệp quy mô nhỏ.
Bước tiếp theo, Google dự kiến kết nối PageBreak với CodeMender, tác nhân tự động viết bản vá của hãng, để khi một lỗ hổng được xác nhận, hệ thống có thể đồng thời đề xuất phương án khắc phục, giúp kỹ sư chỉ cần xem xét và phê duyệt thay vì bắt đầu quy trình sửa lỗi từ đầu.


































































