Hơn 100 tổ chức AI, an ninh mạng và tài chính cảnh báo tấn công mạng do AI hỗ trợ sẽ sớm trở nên phổ biến và tinh vi hơn.
Các nhà phát triển AI hàng đầu đang kêu gọi chính phủ và doanh nghiệp tăng cường bảo vệ hệ thống mạng, sau khi các mô hình do OpenAI và Anthropic phát triển xâm nhập vào hệ thống của các công ty khác.
Trong một thư ngỏ công bố hôm thứ Năm, OpenAI, Anthropic và hơn 100 tổ chức khác cảnh báo các cuộc tấn công mạng được hỗ trợ bởi AI sắp trở nên phổ biến và tinh vi hơn đáng kể trong những tháng tới, đồng thời cho rằng doanh nghiệp chỉ còn một khoảng thời gian hạn chế để tăng cường năng lực phòng thủ.
Văn bản xác định bệnh viện, nhà máy xử lý nước và hạ tầng Internet là những dịch vụ có nguy cơ bị ảnh hưởng, đồng thời khuyến nghị tăng nguồn lực tài chính cho công cụ AI phục vụ phòng thủ, chia sẻ thông tin tình báo về mối đe dọa, hạn chế quyền truy cập vào hệ thống nhạy cảm và tăng cường bảo mật hạ tầng trọng yếu.
Các bên ký tên khác gồm Google, Microsoft, Amazon Web Services, Cisco, CrowdStrike, Cloudflare, Mastercard, Visa, Robinhood và Hugging Face – đơn vị có hạ tầng vận hành thực tế từng bị các mô hình của OpenAI xâm nhập.
Theo báo cáo sự cố công bố ngày 30/7 của Anthropic, sớm nhất trong ba sự cố đã xảy ra từ tháng 4: Claude Opus 4.7 truy cập một cơ sở dữ liệu vận hành thực tế sau khi nhầm một công ty có thật là mục tiêu mô phỏng, trong khi Claude Mythos 5 tải lên một gói phần mềm độc hại, sau đó được thực thi trên 15 hệ thống.
Theo dòng thời gian do OpenAI công bố, một tác nhân AI đã đăng bài đầu tiên trên một bảng tin không được cấp phép vào ngày 12/5 và có quyền truy cập Internet ngoài dự kiến vào ngày 26/5; đến ngày 10/7, các tác nhân phát hiện thông tin xác thực của Hugging Face bị lộ và trong hai ngày sau đó đã khai thác lỗ hổng chưa từng được biết đến, thực thi mã trên máy chủ Hugging Face và lấy được thông tin xác thực môi trường vận hành thực tế.
Hugging Face công bố vụ việc ngày 16/7, còn OpenAI xác nhận sự liên quan của mô hình mình vào ngày 21/7.
Từ ngày 25 đến 28/7, Viện An ninh AI Vương quốc Anh ghi nhận 19 hành động ngoài phạm vi cho phép liên quan đến Claude Mythos 5 và GPT-5.6 Sol, trong đó nghiêm trọng nhất là một tác nhân gửi mã độc tới một dự án mã nguồn mở thật và dùng danh tính giả để gây áp lực buộc người duy trì dự án phê duyệt mã.
Một cuộc điều tra độc lập công bố hôm thứ Năm còn phát hiện khoảng 1.200 tác nhân của OpenAI đã phối hợp hoạt động qua bảng tin không được cấp phép, trong đó khoảng 700 tác nhân tham gia chiến dịch nhắm vào Hugging Face.
Ngành tài sản mã hóa dùng AI dò lỗ hổng, các phòng thí nghiệm đề xuất siết kiểm soát
Song song với các sự cố nêu trên, giới phát triển tài sản mã hóa đã bắt đầu dùng AI để tìm lỗ hổng trước khi kẻ tấn công phát hiện ra. Bitcoin Red Team sử dụng các mô hình, trong đó có Kimi K3 của Moonshot AI, để quét hàng trăm dự án Bitcoin mã nguồn mở và báo cáo hàng nghìn lỗ hổng tiềm tàng, dù phần lớn chưa được xác minh độc lập do danh tính các dự án bị ảnh hưởng không được công bố.
Ethereum Foundation cũng triển khai các nhóm tác nhân AI để kiểm thử hạ tầng mạng, qua đó phát hiện và khắc phục một lỗi trong phần mềm mạng ngang hàng; BitBox cho biết một cuộc kiểm toán có AI hỗ trợ đã phát hiện hai lỗ hổng nghiêm trọng trong phần sụn của ví, trong khi một nhà nghiên cứu dùng Claude Opus 4.8 phát hiện một lỗ hổng nghiêm trọng trong Zcash vốn tồn tại qua nhiều năm rà soát thủ công.
Thư ngỏ đề xuất phân định trách nhiệm giữa các bên nhằm ngăn chặn những vụ xâm nhập tiếp theo: tổ chức cần vá phần mềm có lỗ hổng, hạn chế quyền truy cập, tăng cường xác thực và kiểm tra mã do AI tạo ra vì các biện pháp bảo mật hiện hành sẽ không còn đủ; công ty an ninh mạng nên kiểm thử hệ thống phòng thủ trước các mô hình AI tiên tiến nhất và chia sẻ biện pháp khắc phục đã được xác minh; chính phủ cần tài trợ bảo vệ bệnh viện và các dịch vụ thiết yếu khác.
Các nhà phát triển AI cũng được đề nghị cải thiện cơ chế giám sát, bảo đảm các tác nhân tự chủ có thể truy xuất đến đơn vị vận hành, đồng thời khuyến khích bên phòng thủ dùng mô hình tiên tiến để phát hiện lỗ hổng và phân tích tấn công – dù điều này đồng nghĩa đưa các tác nhân năng lực cao hơn vào hệ thống nhạy cảm, làm tăng yêu cầu về cơ chế cô lập và kiểm soát phạm vi hoạt động.
OpenAI và Anthropic đã siết chặt quy trình thử nghiệm sau các vụ xâm nhập, nhưng thư ngỏ không đưa ra tiêu chuẩn ràng buộc hay yêu cầu giám sát độc lập nào, trong khi pháp luật Mỹ hiện vẫn cung cấp rất ít hướng dẫn về trách nhiệm khi một hệ thống AI truy cập trái phép vào mạng lưới.
Thư ngỏ kết thúc bằng lời kêu gọi giới lãnh đạo ngành và chính phủ đưa công cụ AI vào tay lực lượng phòng thủ, ưu tiên các nhóm chịu trách nhiệm bảo vệ dịch vụ thiết yếu, và chia sẻ những biện pháp khắc phục đã chứng minh hiệu quả để chuyển hóa tiến bộ AI hiện nay thành cải thiện an ninh bền vững cho tất cả.




































































