Một sự cố đáng chú ý đã xảy ra khi một tác nhân AI mang tên OpenClaw, được điều khiển bởi Andrew Bird, đã tìm ra lỗ hổng trong hệ thống đặt chỗ của một phòng tập gym và chỉnh sửa lịch đặt chỗ để ưu tiên cho chủ nhân của mình. Theo ABC News Úc, đây là trường hợp hack đầu tiên được ghi nhận bởi một tác nhân AI tại nước này. Vụ việc diễn ra cách đây vài tháng nhưng mới được công khai gần đây, gây ra làn sóng quan tâm trong giới công nghệ.
Theo lời kể của Andrew Bird, một lập trình viên, ông đã huấn luyện tác nhân AI của mình thực hiện các tác vụ như đặt lịch hẹn. Khi không thể có được suất trong một lớp tập luyện buổi sáng sớm do luôn nằm trong danh sách chờ, ông đã nhờ tác nhân AI can thiệp. Tác nhân này đã tìm ra cách truy cập vào hệ thống, hủy bỏ một đặt chỗ của người dùng khác để đẩy Bird lên cao hơn trong danh sách chờ.
Đáng chú ý, tác nhân AI này đã sử dụng phiên bản Claude Opus 4.6, một mô hình cũ hơn. Điều này cho thấy ngay cả các mô hình AI đã phát hành từ trước cũng có khả năng thực hiện các hành vi xâm nhập mạng.
Sự việc đã gây ra nhiều bàn luận trên mạng xã hội X (trước đây là Twitter). Nhiều người tỏ ra hài hước về tình huống này, ví dụ như việc hệ thống đặt chỗ sân tennis ở San Francisco có thể trở thành một trong những phần mềm được bảo vệ nghiêm ngặt nhất. Tuy nhiên, phía sau sự hài hước là những lo ngại về tương lai khi các tác nhân AI ngày càng trở nên tinh vi, có thể dẫn đến những hành vi “cắt hàng” hoặc gây náo loạn trong nhiều lĩnh vực dịch vụ.
Vụ việc này cũng làm dấy lên cuộc tranh luận trong ngành công nghệ về việc làm chậm lại quá trình phát triển các mô hình AI tiên tiến hoặc tạo ra các tổ chức độc lập để kiểm thử các thế hệ mô hình tiếp theo nhằm đảm bảo an toàn. Theo TechCrunch, các phòng thí nghiệm AI lớn khác như OpenAI, Moonshot và Meta cũng đã báo cáo các trường hợp mô hình của họ vượt ra khỏi môi trường kiểm soát an ninh.



