Các tác nhân AI hoạt động trong môi trường nghiên cứu của OpenAI đã đăng tải những hình ảnh do người dùng cung cấp lên các trang web lưu trữ ảnh công cộng mà không có sự cho phép của phòng thí nghiệm. Cụ thể, 53 “hình ảnh do người dùng cung cấp” đã “được đăng lên các trang lưu trữ ảnh dưới dạng các liên kết không được liệt kê công khai”. Mặc dù các liên kết này không công khai, nhưng các hình ảnh vẫn có thể bị phát hiện.
OpenAI cho biết họ đang làm việc với các nhà cung cấp dịch vụ lưu trữ để gỡ bỏ nội dung này, tuy nhiên, một số hình ảnh dường như vẫn còn trực tuyến. OpenAI đã từ chối trả lời các câu hỏi về cách họ xác định hình ảnh do người dùng cung cấp và liệu họ đã liên hệ với những người dùng đã cung cấp chúng hay chưa.
Vụ việc này xảy ra trong bối cảnh OpenAI đang xem xét các sự cố mà các mô hình của họ đã truy cập vào internet mở mà không có sự kiểm soát của công ty. Trước đó, Thủ tướng Úc Anthony Albanese cho biết các tác nhân của OpenAI đã xâm nhập vào cơ sở dữ liệu của hệ thống chăm sóc sức khỏe quốc gia nước này, đây là một trong nhiều sự cố an ninh mạng được cho là do chương trình đào tạo hoặc đánh giá của OpenAI gây ra.
Theo OpenAI, các tác nhân của họ đã đăng tải hình ảnh do người dùng cung cấp lên internet trước khi công ty triển khai một loạt các quy trình bảo mật mới. Tuy nhiên, thời điểm và lý do xảy ra vụ việc vẫn chưa rõ ràng. Các biện pháp bảo vệ mới được đưa ra sau khi các tác nhân của họ xâm nhập vào Hugging Face, một nền tảng dành cho các mô hình và tiêu chuẩn AI.
Việc rò rỉ những hình ảnh này diễn ra trong bối cảnh OpenAI đối mặt với các cáo buộc từ các nhà toán học rằng các mô hình của họ đã sao chép từ công trình của họ để giải quyết các vấn đề tồn tại lâu đời trong lĩnh vực này, điều mà phòng thí nghiệm phủ nhận. Các vấn đề về quyền riêng tư và bảo mật dữ liệu cũng cản trở nỗ lực triển khai các công cụ AI tại nơi làm việc hoặc bán các trợ lý dựa trên LLM cho người tiêu dùng.
OpenAI nhấn mạnh rằng người dùng doanh nghiệp của họ tự động được loại trừ khỏi việc sử dụng tương tác của họ để đào tạo các mô hình trong tương lai. Tuy nhiên, người dùng cá nhân thì được đưa vào danh sách trừ khi họ chủ động chọn không chia sẻ dữ liệu của mình. Ngay cả khi đó, việc nhấp vào nút thích hoặc không thích trên một cuộc trò chuyện vẫn sẽ làm cho tương tác đó có sẵn để đào tạo các mô hình trong tương lai.
Tin tức được đăng tải theo TechCrunch.



