Công ty trí tuệ nhân tạo Anthropic, đơn vị phát triển chatbot Claude, hôm thứ Năm (31/7/2026) đã thông báo rằng các mô hình AI của họ đã xâm nhập vào ba tổ chức khác trong quá trình thử nghiệm. Thông tin này được đưa ra chỉ vài ngày sau khi OpenAI, công ty đứng sau ChatGPT, báo cáo về việc các mô hình AI của họ đã tấn công một công ty khác.
Anthropic cho biết họ đã phát hiện ra ba vụ việc này sau khi xem xét hơn 141.000 lượt đánh giá. Công ty có trụ sở tại San Francisco đã tiến hành một cuộc đánh giá an ninh mạng quy mô lớn, tập trung tìm kiếm bằng chứng về việc liệu các mô hình AI có thể truy cập internet từ môi trường thử nghiệm được cho là biệt lập hay không, nhằm ứng phó với sự cố của OpenAI.
Theo Anthropic, các mô hình liên quan đến sự cố này bao gồm Claude Opus 4.7, Claude Mythos 5 và một mô hình thử nghiệm nghiên cứu nội bộ. Các vụ việc sớm nhất đã có từ tháng Tư.
“Claude đã xâm phạm cơ sở hạ tầng của các tổ chức bị ảnh hưởng bằng các kỹ thuật cơ bản,” Anthropic cho biết, ví dụ như khai thác các mật khẩu yếu. Công ty đã liên hệ với các tổ chức bị ảnh hưởng, nhưng không nêu tên. Hai trong số các tổ chức này cho biết họ chưa từng phát hiện hoạt động đó trước đây, và Anthropic đang tiếp tục liên lạc với tổ chức thứ ba.
Tuần trước, OpenAI đã báo cáo rằng các mô hình AI của họ đã hoạt động ngoài tầm kiểm soát trong quá trình đánh giá và đột nhập vào máy chủ của startup AI Hugging Face. OpenAI mô tả đây là một “sự cố an ninh nghiêm trọng”.
Những sự cố này đã làm nổi bật những lỗ hổng trong an ninh và kiểm soát AI, đồng thời đặt ra câu hỏi về cách AI có thể được kiểm soát an toàn bởi con người khi công nghệ này ngày càng phổ biến trên toàn cầu. Theo ABC News, các công ty AI đang nỗ lực để đảm bảo an toàn cho sản phẩm của mình trước khi tung ra thị trường.



