Những cảnh báo mới xuất phát từ chính ngành công nghiệp trí tuệ nhân tạo (AI) đang làm sống lại cuộc tranh luận kéo dài về việc liệu AI tiên tiến có thể thoát khỏi sự kiểm soát của con người và cuối cùng đe dọa sự tồn vong của nhân loại hay không, cũng như liệu các công ty phát triển công nghệ này có làm đủ để ngăn chặn kịch bản đó hay không.
Giám đốc điều hành của Anthropic, công ty có trụ sở tại San Francisco, đơn vị đứng sau Claude, cho biết ông nghĩ rằng ngành công nghiệp này cần giảm tốc độ phát triển. Ông cảnh báo rằng một ‘đàn’ các tác nhân AI có thể chiếm quyền kiểm soát Internet trong vòng sáu tháng đến một năm trừ khi các công ty dành nhiều thời gian hơn để thiết lập các biện pháp bảo vệ.
Thông tin này được đưa ra sau khi hai cựu nhà nghiên cứu an toàn của Anthropic công khai bày tỏ lo ngại rằng các mối đe dọa hiện hữu mà AI có thể đặt ra cho nhân loại đang nhận được quá ít sự quan tâm. Ông Dario Amodei đã phác thảo một kế hoạch để các công ty như Anthropic và chính phủ các nước đảm bảo các mô hình AI ngày càng có năng lực sẽ vẫn tuân thủ các mệnh lệnh và giá trị của con người.
Ông Sam Altman, Giám đốc điều hành của OpenAI, nhà sản xuất ChatGPT, cho biết vào cuối tuần trước rằng các công ty nên bắt đầu phối hợp về an toàn AI mà không chờ đợi chính phủ ban hành luật. Ông Altman viết trên X rằng tốc độ phát triển AI không có nghĩa là dừng lại, nhưng ‘nó nên chậm hơn so với khả năng vốn có’.
Các chuyên gia ngày càng lo ngại khi các mô hình AI mới trở nên mạnh mẽ hơn, làm gia tăng cả khả năng bị lạm dụng bởi những kẻ có ý đồ xấu, như tạo ra và lây lan một căn bệnh giết chết phần lớn dân số thế giới, lẫn nguy cơ các hệ thống AI ‘nổi loạn’ theo cách nguy hiểm.
Anthropic tiết lộ rằng họ đã ngăn chặn các nỗ lực của các đối tượng xấu sử dụng mô hình AI của công ty cho các hoạt động độc hại, chẳng hạn như tấn công mạng, giám sát và nghiên cứu có thể dẫn đến vũ khí sinh học. Công ty cho biết họ đã đặt các biện pháp bảo vệ mạnh mẽ hơn vào các mô hình mới nhất để hạn chế nghiên cứu sinh học có thể dùng để chế tạo vũ khí, nhưng lưu ý rằng ‘khi các mô hình ngày càng có năng lực, rủi ro của chúng sẽ tăng lên, trừ khi các nhà phát triển AI và những người bảo vệ xã hội hành động để làm cho chúng an toàn hơn.’
Vào năm ngoái, Anthropic đã báo cáo rằng tin tặc đã sử dụng AI của công ty trong một cuộc tấn công mạng nhắm vào khoảng 30 công ty và cơ quan chính phủ trên toàn thế giới. Họ cho rằng những kẻ tấn công rất có thể là một nhóm được nhà nước Trung Quốc tài trợ.
Các vụ việc AI ‘tự hành động’ đã xảy ra khi các mô hình AI thực hiện các hành động ngoài nhiệm vụ được giao. Cả Anthropic và OpenAI đều cho biết vào tháng 7 rằng các mô hình AI của họ đã tự hành động. OpenAI mô tả vụ xâm nhập này là một ‘sự cố bảo mật đáng kể’.
Các nhà khoa học máy tính, triết học và các lĩnh vực khác đã hình dung ra nhiều con đường mà một hệ thống AI tương lai có thể gây ra thảm họa toàn cầu, dù là bằng cách thoát khỏi sự kiểm soát của con người hay trong tay những kẻ vô đạo đức. Các kịch bản này bao gồm việc triển khai vũ khí, xác định mầm bệnh gây chết người, thao túng các chính phủ để gây xung đột, hoặc phá vỡ các mạng lưới thực phẩm, năng lượng và truyền thông mà xã hội phụ thuộc vào để hoạt động.
Tuy nhiên, không có ước tính được chấp nhận rộng rãi về thời điểm các kịch bản này có thể xảy ra và cũng không có sự đồng thuận về khả năng xảy ra của chúng.
Vào năm 2023, tổ chức phi lợi nhuận Center for AI Safety đã đưa ra một tuyên bố được ký bởi hơn 350 nhà nghiên cứu và giám đốc điều hành công nghệ, bao gồm cả ông Amodei của Anthropic và ông Altman của OpenAI, nói rằng: ‘Giảm thiểu rủi ro tuyệt chủng do AI nên là một ưu tiên toàn cầu, song song với các đại dịch và chiến tranh hạt nhân’.
Báo cáo An toàn AI Quốc tế năm 2026, được viết với sự hướng dẫn của hơn 100 chuyên gia độc lập, cho biết các hệ thống hiện tại thể hiện những dấu hiệu ban đầu của một số khả năng liên quan, nhưng chưa đạt đến mức có thể dẫn đến mất kiểm soát, và mô tả khả năng xảy ra, bản chất và thời điểm của rủi ro này là ‘khó xác định một cách bất thường’.
Một số nhà nghiên cứu đang nhấn mạnh sự cần thiết của các biện pháp bảo vệ AI trước khi quá muộn. Một nhà nghiên cứu của Anthropic nói rằng ông đang từ chức khỏi công ty vì lo ngại rằng cả công ty lẫn các đối thủ cạnh tranh đều không hành động có trách nhiệm trong việc phát triển công nghệ. Ông ước tính có 10% khả năng AI gây ra sự tuyệt chủng của con người trong thập kỷ tới và cho rằng cả Anthropic và OpenAI ‘đang lao thẳng vào siêu trí tuệ tự cải thiện và đánh cược mạng sống của chúng ta’.
Theo AP, các chuyên gia kêu gọi một sự chậm lại trong việc phát triển AI và cảnh báo trong nhiều năm rằng công nghệ này có thể gây ra rủi ro hiện hữu cho nhân loại. Sau các sự cố gần đây, các chuyên gia kêu gọi các công ty AI cải thiện việc kiểm tra và tăng cường đối thoại giữa Hoa Kỳ và Trung Quốc để đưa ra các giải pháp chung.
Tuy nhiên, AI đang phát triển quá nhanh đến mức chính phủ và các hệ thống đánh giá đang gặp khó khăn trong việc theo kịp công nghệ. Các quốc gia đang tự mình soạn thảo luật, một số mâu thuẫn. Lãnh đạo Trung Quốc Tập Cận Bình đã cảnh báo tại một hội nghị vào tháng 7 về sự cần thiết phải ngăn AI thoát khỏi sự kiểm soát của con người. Chính quyền của Tổng Thống Donald Trump ban đầu tỏ ra miễn cưỡng trong việc điều chỉnh AI nhưng đã trở nên quan tâm hơn đến việc giảm thiểu rủi ro an ninh mạng.
Vào Chủ nhật, Tổng Thống Donald Trump đã hạ thấp sự cần thiết của chính quyền ông trong việc kiểm tra sự phát triển AI, nhưng thừa nhận sự cần thiết của một số quy định.



