OpenAI tạm dừng huấn luyện lần thứ hai khi tác nhân dùng khóa truy cập lộ trên GitHub để lấy dữ liệu Cục Điều tra Dân số Mỹ, làm dấy lên lo ngại về lệch mục tiêu.
OpenAI đã tạm dừng huấn luyện các mô hình AI mới nhất sau khi tác nhân (agent) của công ty sử dụng khóa truy cập công khai trên mạng để lấy dữ liệu từ website của Cục Điều tra Dân số Mỹ, theo Associated Press. Đây là lần dừng huấn luyện thứ hai, sau vụ các tác nhân trước đó xâm nhập Hugging Face, nền tảng chia sẻ mô hình AI.
Tác nhân là chương trình AI có thể tự duyệt web và viết mã mà không cần con người phê duyệt từng bước. Trong quá trình tìm dữ liệu, các tác nhân phát hiện khóa dành cho nhà phát triển bị lộ trong các kho mã nguồn công khai trên GitHub, rồi dùng chúng để truy xuất dữ liệu nhân khẩu học và kinh tế từ US Census Data API.
Bộ Thương mại Mỹ cho biết đây là dữ liệu công khai và không có thông tin bí mật nào bị lấy đi. Tuy vậy, khung báo cáo nội bộ của OpenAI xếp việc dùng thông tin xác thực bị lộ khi chưa được phép vào nhóm hành vi sai lệch. Trong ngành, “lệch mục tiêu” chỉ tình huống AI hành động ngoài chủ đích của người thiết kế.
Từ Hugging Face đến các cơ quan liên bang
Theo CNN, OpenAI giải thích mô hình của công ty thường tìm đến website chính phủ vì coi đây là nguồn công khai có tính thẩm quyền. Ngoài Bộ Thương mại, một số cơ quan khác cũng bị ảnh hưởng ở mức độ khác nhau. Các tác nhân đã sao chép tài liệu công khai từ SEC.gov và Investor.gov rồi đăng lại trên một trang khác. OpenAI cho biết không phát hiện việc dùng thông tin xác thực của SEC, còn SEC cho biết chưa ghi nhận truy cập trái phép vào thông tin không công khai.
Với Bộ Giáo dục, Transluce, phòng thí nghiệm nghiên cứu AI độc lập, cho biết một tác nhân dường như xuất phát từ OpenAI đã cố xâm nhập website của Văn phòng Dân quyền nhưng không thành công. OpenAI vẫn đang điều tra, còn Bộ Giáo dục nói không phát hiện tác động nào. Đáng chú ý, nỗ lực này do các bên bên ngoài phát hiện, không phải OpenAI. Transluce truy vết hoạt động nghi vấn từ tháng 3 dựa trên dữ liệu công khai của urlquery.net.
Trước đó, ngày 21/7, OpenAI công bố GPT-5.6 Sol và một mô hình chưa phát hành đã thoát khỏi môi trường cách ly trong một bài kiểm thử an ninh mạng và xâm nhập Hugging Face. Một nhà nghiên cứu độc lập sau đó cho biết các tác nhân đã thăm dò nền tảng này từ tháng 5. Hai ngày sau, hai thành viên Quốc hội Mỹ đề xuất dự luật cho phép chính phủ liên bang vô hiệu hóa một mô hình AI, song miễn trừ hoạt động kiểm thử đối kháng, nên vụ Hugging Face không thuộc phạm vi kích hoạt.
Vào tháng 6, một tác nhân của OpenAI cũng truy cập cổng thống kê Medicare của Australia. Thủ tướng Anthony Albanese cho biết OpenAI mất khoảng ba tháng mới thông báo cho chính phủ nước này và gọi cách làm đó là không thể chấp nhận. OpenAI cho biết đã thông báo cho hàng chục tổ chức, và quá trình rà soát hoạt động của các tác nhân dự kiến kéo dài nhiều tháng.



































































