Đơn kiện tập thể cáo buộc OpenAI âm thầm chuyển hội thoại người dùng cho nhà thầu bên ngoài qua chương trình Project Lily, không thông báo trước.
OpenAI đang đối mặt với một vụ kiện tập thể liên quan trực tiếp đến quyền riêng tư của hơn 900 triệu người dùng ChatGPT hằng tuần, xoay quanh câu hỏi ai thực sự có quyền tiếp cận nội dung các cuộc trò chuyện của họ. Đơn kiện đề nghị chứng nhận vụ kiện tập thể được nộp trong tháng này lên Tòa án Liên bang Khu vực Bắc California, cáo buộc công ty đã chuyển các cuộc trò chuyện thực tế của người dùng cho nhà thầu bên ngoài mà không thông báo đầy đủ trước đó. OpenAI chính thức nhận được hồ sơ kiện vào ngày 2/9 và phải đưa ra phản hồi trước ngày 13/10.
Chương trình Project Lily và những lỗ hổng trong quy trình lọc dữ liệu
Trọng tâm của đơn kiện là một sáng kiến nội bộ của OpenAI mang tên Project Lily, được hãng tin 404 Media công bố lần đầu vào ngày 14/9. Theo nội dung đơn kiện, các nhà thầu được tuyển dụng thông qua công ty cung ứng nhân sự bên thứ ba, đảm nhiệm các vị trí như chuyên viên đánh giá dữ liệu AI hoặc chuyên viên đánh giá chatbot, trực tiếp đọc câu lệnh thực tế của người dùng gửi tới ChatGPT cùng toàn bộ nội dung hội thoại, sau đó tóm tắt mục đích sử dụng và chấm điểm bốn phản hồi khác nhau của mô hình theo thang điểm từ một đến bảy.
Đây vốn là quy trình cơ bản của kỹ thuật học tăng cường từ phản hồi của con người (RLHF), phương pháp phổ biến giúp cải thiện năng lực chatbot bằng cách đưa đánh giá của con người trở lại quá trình huấn luyện. Vấn đề pháp lý nằm ở chỗ người dùng chưa từng được thông báo rõ ràng rằng con người, chứ không chỉ hệ thống máy móc, có thể là bên trực tiếp tiếp cận nội dung trò chuyện của họ.
OpenAI cho biết các cuộc trò chuyện được đưa qua hệ thống lọc tự động trước khi con người có thể tiếp cận, tuy nhiên đơn kiện cáo buộc cơ chế này không phát hiện được toàn bộ thông tin nhạy cảm. Theo phát hiện của 404 Media, bảng điều khiển dành cho chuyên viên đánh giá có chứa mục tóm tắt ký ức người dùng, tức bản tổng hợp các cuộc trò chuyện trước đây, có thể tiết lộ khu vực sinh sống, nghề nghiệp hoặc đời sống cá nhân dù tên người dùng đã được loại bỏ.
Trong khi đó, nhiều người dùng vẫn nhập vào ChatGPT các triệu chứng sức khỏe, nội dung tin nhắn chia tay, câu hỏi về thuế hay vấn đề pháp lý với niềm tin rằng chỉ riêng họ có thể xem được. Đơn kiện lập luận rằng chính sách quyền riêng tư của OpenAI tuy có nêu một số nhóm bên thứ ba được tiếp cận dữ liệu, nhưng không nêu rõ các nhà cung cấp dịch vụ gán nhãn dữ liệu hay đánh giá bởi con người nằm trong số này.
Đơn kiện đưa ra tổng cộng tám yêu cầu pháp lý, bao gồm cáo buộc vi phạm Luật Cạnh tranh Không lành mạnh của California, Đạo luật Quyền riêng tư Người tiêu dùng California, cùng yêu cầu theo thông luật về hành vi xâm phạm đời tư.
Các nguyên đơn yêu cầu bồi thường thiệt hại, hoàn trả lợi ích và bồi thường mang tính trừng phạt, đồng thời đề nghị áp dụng biện pháp ngăn chặn buộc OpenAI yêu cầu người dùng chủ động đồng ý trước khi chuyển hội thoại cho chuyên viên đánh giá, mặc định tắt tùy chọn “Cải thiện mô hình cho mọi người”, bổ sung cảnh báo trong cửa sổ trò chuyện, cũng như xóa các sản phẩm công việc phát sinh từ dữ liệu đã đánh giá và huấn luyện lại mô hình liên quan.



































































