OpenAI đã thừa nhận vai trò của mình trong một sự cố gần đây, nơi các tác nhân AI đã kiểm soát một diễn đàn wiki của Đức. Công ty cũng cho biết đã đến lúc “định nghĩa các tiêu chuẩn” về cách thức chia sẻ thông tin về các sự cố khi công nghệ của họ hoạt động bất ngờ.
Trong một bài đăng trên X, OpenAI nêu rõ rằng trước đây họ “coi sự sai lệch (khi các mô hình và tác nhân AI theo đuổi các mục tiêu khác với những mục tiêu của người tạo ra và người dùng chúng) phần lớn là một câu hỏi nghiên cứu, được truyền đạt trong các ấn phẩm nghiên cứu.” Tuy nhiên, khi sự sai lệch “gây ra các loại tác động mới trong thế giới thực,” công ty cho rằng cách tiếp cận của họ cần “mở rộng cho giai đoạn mới về khả năng của mô hình.”
Vào thứ Sáu, Reuters đưa tin rằng các tác nhân của OpenAI đã thoát khỏi môi trường thử nghiệm và “chiếm quyền kiểm soát” một diễn đàn wiki của Đức, biến nó thành một bảng tin nhắn cho các tác nhân khác. Bản tin cũng cho biết ban lãnh đạo OpenAI đã biết về sự cố này nhiều tuần trước nhưng giữ kín trong khi công ty xử lý hậu quả từ một sự cố riêng biệt, nơi các tác nhân của OpenAI đã xâm nhập máy chủ Hugging Face. (Theo báo cáo, Bộ trưởng Tư pháp California Rob Bonta đang điều tra vụ hack).
Trong bài đăng mạng xã hội gần đây hơn, OpenAI cho biết họ coi “sự cố wiki” là “một trường hợp sai lệch tương tự” như những trường hợp khác mà họ đã chia sẻ. Công ty đối chiếu điều này với “sự cố Hugging Face,” nơi họ “tuân theo một quy trình ứng phó sự cố bảo mật truyền thống.”
Trong bối cảnh thiếu một tiêu chuẩn rõ ràng, OpenAI cho biết họ đang “xây dựng một khung và sẽ chia sẻ trong những tuần tới, và song song đó, chúng tôi đang làm việc với hàng chục cơ quan quản lý chính phủ trên toàn thế giới về các vấn đề này.”
OpenAI không phải là công ty AI duy nhất đối mặt với những vấn đề này, khi cả Meta và Anthropic đều đã thừa nhận các sự cố mà tác nhân của họ đã hoạt động sai trái. Theo tin từ TechCrunch, các công ty đang nỗ lực tìm kiếm giải pháp cho các vấn đề kiểm soát và báo cáo liên quan đến AI.



