Một số lượng chưa xác định các cuộc trò chuyện và tạo tác (Artifacts) của Claude – các ứng dụng nhỏ và tài liệu tương tác mà người dùng có thể tạo ra bên trong Claude – đã được tìm thấy có thể tìm kiếm công khai trên Google vào cuối tuần. Điều này xảy ra sau khi người dùng trên Reddit phát hiện ra rằng việc nhập các toán tử tìm kiếm như “site:claude.ai/share” vào Google đã hiển thị một danh sách dài các cuộc trò chuyện được chia sẻ. Theo báo cáo, một số chứa hồ sơ y tế, tài liệu nội bộ của công ty, cũng như tên và số điện thoại của trẻ em.
Sự cố này dường như bắt nguồn từ tính năng “share chat” (chia sẻ trò chuyện) của Claude, cho phép người dùng tạo các liên kết để bất kỳ ai có URL được chỉ định đều có thể xem một cuộc trò chuyện hoặc dự án. Giao diện của Claude cảnh báo: “Bất kỳ ai có liên kết đều có thể xem.” Ngôn ngữ này ngụ ý rõ ràng rằng tính năng này chủ yếu dành cho việc người dùng chia sẻ trò chuyện với bạn bè, đồng nghiệp và các nhóm nhỏ, chứ không phải với toàn bộ internet. Google Docs, chẳng hạn, cung cấp một tính năng tương tự và các tài liệu đó không bị truy cập công khai trên Google.
Anthropic dường như đổ lỗi cho người dùng về việc làm lộ thông tin. Khi được hỏi về những gì đã xảy ra, công ty cho biết các liên kết chia sẻ chỉ xuất hiện trong kết quả tìm kiếm khi chúng được đăng ở đâu đó mà các công cụ tìm kiếm có thể thấy, như trên một diễn đàn hoặc bài đăng mạng xã hội. Họ nói thêm rằng một liên kết được gửi riêng tư cho ai đó sẽ không xuất hiện trong kết quả tìm kiếm.
Theo tin từ TechCrunch, vấn đề này được một người dùng Reddit nêu lên vào thứ Bảy và được 404 Media đưa tin lần đầu vào sáng thứ Hai. Tuy nhiên, tính đến chiều thứ Hai, một thử nghiệm tìm kiếm trên Google theo phương pháp được nêu trong bài đăng Reddit đã không trả về bất kỳ kết quả nào, cho thấy sự cố đã được khắc phục.
Trước khi sự cố được khắc phục, Futurism đưa tin đã tìm thấy “một báo cáo y tế chi tiết của một bệnh nhân thực tế, kết quả thử nghiệm lâm sàng bao gồm tên bệnh nhân, các tài liệu chia sẻ tên và số điện thoại của trẻ em trong độ tuổi tiểu học, các tài liệu công ty được đánh dấu chỉ sử dụng nội bộ và đánh giá nhân viên bao gồm thông tin cá nhân về người lao động.”
Các tạo tác bị lộ bao gồm mã nguồn và ghi chú công việc, cùng với nội dung người lớn do chatbot tạo ra. Trong ít nhất một trường hợp, Fortune báo cáo, một cuộc trò chuyện có nhãn “được chia sẻ bởi Anthropic” đã cho thấy Claude tạo ra nội dung người lớn, vi phạm chính sách của công ty về việc cấm tạo nội dung người lớn.
Chính sách sử dụng của Anthropic nghiêm cấm Claude tạo ra nội dung người lớn một cách rõ ràng. Hiện tại vẫn chưa rõ làm thế nào nội dung này được tạo ra từ các cuộc trò chuyện bị lộ, và Anthropic chưa phản hồi yêu cầu bình luận của TechCrunch về trường hợp cụ thể này. Phát ngôn viên của Google cho biết cả Google và các công cụ tìm kiếm khác không kiểm soát những trang nào được công khai trên web, và các trang này đã được lập chỉ mục trên nhiều công cụ tìm kiếm. Google cung cấp cho chủ sở hữu trang web các công cụ rõ ràng để quyết định xem trang có thể được thu thập dữ liệu hay lập chỉ mục hay không, và họ luôn tôn trọng những chỉ thị đó.
Năm ngoái, Forbes đã báo cáo một sự cố tương tự, trong đó hàng trăm cuộc trò chuyện của Claude đã được các công cụ tìm kiếm lập chỉ mục. Thời điểm đó, Google ước tính đã lập chỉ mục gần 600 cuộc trò chuyện trước khi các trang đó biến mất khỏi kết quả tìm kiếm. Quy mô của sự cố lần này chưa được xác nhận độc lập, mặc dù nhiều người dùng báo cáo đã tìm thấy các cuộc trò chuyện được chia sẻ thông qua cùng loại truy vấn tìm kiếm Google đã được sử dụng để đưa ra bộ nhớ cache của năm ngoái. Cũng vào năm ngoái, 404 Media báo cáo rằng một nhà nghiên cứu đã có thể thu thập khoảng 100.000 cuộc trò chuyện ChatGPT đã được đặt ở chế độ chia sẻ công khai.



