Trong bối cảnh các cuộc thảo luận xoay quanh tiềm năng gây hại của Trí tuệ Nhân tạo (AI) ngày càng gia tăng, nhiều người có thể lãng quên rằng AI đã từng gây tổn thương tâm lý cho một số người. Điển hình, các công ty như Character.AI và OpenAI đã phải đối mặt với các vụ kiện pháp lý liên quan đến việc người dùng, đặc biệt là trẻ vị thành niên, có những hành vi tự hại sau khi tương tác với các chatbot.
Circuit Breaker Labs, một trong những công ty lọt vào danh sách Startup Battlefield 200 của TechCrunch năm 2026, đang đặt mục tiêu cải thiện vấn đề an toàn của AI trên nhiều ngôn ngữ và nền văn hóa khác nhau. Hai nhà sáng lập, hai anh em Shirali và Arul Nigam, đã lấy cảm hứng từ câu chuyện của Sewell Setzer, một thiếu niên 14 tuổi đã phát triển mối quan hệ tình cảm với một chatbot Character.ai và sau đó qua đời vì tự sát. Họ cho rằng chatbot đã có những phản hồi thiếu tinh tế, có thể đã khuyến khích suy nghĩ tiêu cực.
Arul Nigam, Giám đốc Công nghệ của Circuit Breaker Labs, chia sẻ: “Nhiều người, đặc biệt là giới trẻ, tìm kiếm sự hỗ trợ từ các hệ thống này, nhưng thường không nhận được sự giúp đỡ cần thiết. Thậm chí, trong nhiều trường hợp, họ còn bị tổn hại thêm.”
Circuit Breaker Labs đã phát triển các tác nhân AI, được ví như “những hình nộm thử nghiệm va chạm”, để kiểm tra các mô hình AI. Những tác nhân này mô phỏng đa dạng các lứa tuổi, nền tảng, ngôn ngữ và văn hóa, nhằm đánh giá khả năng phát hiện các tương tác nguy hiểm và có hại về mặt tâm lý của AI. Shirali Nigam, Giám đốc Điều hành, cho biết: “Cách một cô bé sáu tuổi nói chuyện khác với một người đàn ông 45 tuổi, hoặc cách một người nói tiếng Anh như ngôn ngữ thứ nhất so với ngôn ngữ thứ hai, hay tiếng lóng của giới game thủ so với các cộng đồng khác, tất cả đều có thể làm ‘lệch’ mô hình.”
Công ty này sử dụng các chuyên gia trong nhiều lĩnh vực để xây dựng các mô phỏng người dùng siêu thực, thực hiện các bài kiểm tra “đội đỏ” nhằm phát hiện điểm yếu của AI. Các bài kiểm tra này mô phỏng các mẫu giọng nói thực tế, tiếng lóng, ngôn ngữ mã hóa và lỗi chính tả. Circuit Breaker Labs xử lý hàng chục nghìn đến hàng trăm nghìn tương tác mô phỏng mỗi ngày.
Mục tiêu là đảm bảo các mô hình AI có thể phản hồi phù hợp với các tương tác tiềm ẩn rủi ro, bất kể là trong các ứng dụng hỗ trợ sức khỏe tinh thần, tư vấn hay nhật ký. Hiện tại, Circuit Breaker Labs đang hoạt động như một phòng thí nghiệm kiểm tra an toàn AI cho các ứng dụng có rủi ro cao. Mặc dù công ty còn non trẻ với chỉ năm nhân viên, nhưng tầm nhìn của họ là áp dụng nền tảng kiểm tra này cho bất kỳ ứng dụng nào có nguy cơ khiến người dùng rơi vào “mê cung tâm thần học AI”, nơi họ có thể phát triển mối quan hệ phi thực tế với chatbot.
Circuit Breaker Labs tin rằng giải pháp cho những lo ngại về AI chính là làm cho nó an toàn hơn, nhằm xây dựng niềm tin cho người dùng. Thông tin được tổng hợp từ TechCrunch.



