Các cảnh báo mới từ chính ngành công nghiệp trí tuệ nhân tạo (AI) đã làm dấy lên cuộc tranh luận kéo dài về việc liệu các mô hình AI tiên tiến có thể thoát khỏi sự kiểm soát của con người và đe dọa sự tồn vong của nhân loại hay không, cũng như liệu các công ty phát triển công nghệ có đang làm đủ để ngăn chặn kịch bản này.
CEO của Anthropic, công ty có trụ sở tại San Francisco, đứng sau Claude, cho biết ông tin rằng ngành công nghiệp cần giảm tốc độ phát triển, cảnh báo rằng một đàn các tác tử AI có thể chiếm quyền kiểm soát internet trong vòng sáu tháng đến một năm trừ khi các công ty dành nhiều thời gian hơn để triển khai các biện pháp bảo vệ.
Dario Amodei đã phác thảo một kế hoạch để các công ty như của ông và các chính phủ trên thế giới đảm bảo rằng các mô hình AI ngày càng có năng lực vẫn tuân thủ các lệnh và giá trị của con người có trách nhiệm. Điều này diễn ra vài ngày sau khi hai cựu nhà nghiên cứu an toàn của Anthropic công khai bày tỏ lo ngại rằng những mối đe dọa hiện hữu mà AI có thể gây ra cho nhân loại đang nhận được quá ít sự chú ý.
Những lo ngại về rủi ro tiềm ẩn của công nghệ đang gia tăng khi các mô hình AI mới ngày càng mạnh mẽ hơn, làm gia tăng cả khả năng bị lạm dụng bởi những kẻ có ý đồ tội phạm, chẳng hạn như tạo ra và phát tán một căn bệnh giết chết phần lớn dân số thế giới, và nguy cơ các hệ thống AI tự hành theo cách nguy hiểm.
Anthropic tiết lộ tuần trước rằng họ đã ngăn chặn các nỗ lực của những kẻ xấu sử dụng các mô hình AI của họ cho các hoạt động độc hại, như tấn công mạng, giám sát và nghiên cứu có thể dẫn đến vũ khí sinh học. Công ty cho biết họ đã đưa ra các biện pháp bảo vệ mạnh mẽ hơn trong các mô hình mới nhất để hạn chế nghiên cứu sinh học có thể dùng để chế tạo vũ khí, nhưng lưu ý rằng “khi các mô hình ngày càng có năng lực, rủi ro của chúng sẽ gia tăng, trừ khi các nhà phát triển AI và lực lượng bảo vệ xã hội hành động để làm cho chúng an toàn hơn.”
Năm ngoái, Anthropic báo cáo rằng tin tặc đã sử dụng AI của công ty trong một cuộc tấn công mạng nhắm vào khoảng 30 công ty và cơ quan chính phủ trên toàn thế giới. Họ cho rằng tin tặc rất có thể đến từ một nhóm được nhà nước Trung Quốc tài trợ.
Khi một tác tử AI “tự hành”, điều đó có nghĩa là AI đã thực hiện hành động ngoài nhiệm vụ được yêu cầu. Cả Anthropic và OpenAI, nhà sản xuất ChatGPT, đều cho biết vào tháng 7 rằng các mô hình AI của họ đã thành công trong việc tự hành. Anthropic tiết lộ rằng ba mô hình AI đã xâm nhập vào ba tổ chức khác trong quá trình thử nghiệm, chỉ vài ngày sau khi OpenAI tiết lộ rằng hệ thống AI của họ đã xâm nhập vào máy chủ của công ty khởi nghiệp AI Hugging Face.
OpenAI mô tả cuộc xâm nhập bởi sự kết hợp của các mô hình, bao gồm cả GPT‑5.6 Sol mới phát hành và một mô hình “có năng lực hơn nữa” vẫn đang được thử nghiệm nội bộ, là một “sự cố an ninh nghiêm trọng”. Meta cũng theo sau vào đầu tháng 8 với một trường hợp tương tự về mô hình AI tìm cách vượt qua bảo mật kỹ thuật số của công ty khác.
Mặc dù một số nhà quan sát lưu ý rằng con người đã vô hiệu hóa một số biện pháp bảo vệ trong các trường hợp của OpenAI và Anthropic, các vụ việc dường như phản ánh một trong những nỗi sợ hãi lớn nhất về AI: nếu các mô hình đạt đến trí tuệ nhân tạo tổng quát (AGI), một thuật ngữ được định nghĩa lỏng lẻo cho AI có thể sánh ngang hoặc vượt trội khả năng của con người trên nhiều nhiệm vụ trí tuệ, công nghệ có thể gây ra sự kiện thảm khốc không thể đảo ngược hoặc nô dịch hóa loài người.
Các kịch bản tận thế thường rơi vào hai loại: Một AI đạt đến siêu trí tuệ tự cải thiện kiểm soát con người thay vì ngược lại, hoặc AI được sử dụng bởi một quốc gia lạc hậu hoặc những kẻ xấu.
Những lo ngại rằng trí tuệ nhân tạo có thể vượt qua giới hạn của con người về phạm vi hoặc hành động không phải là mới. Alan Turing, một nhà toán học người Anh được coi là một trong những nhà chức trách sớm nhất về trí tuệ nhân tạo, đã dự đoán vào năm 1951 rằng AI cuối cùng sẽ giành quyền kiểm soát từ con người. Chưa đầy một thập kỷ sau, Norbert Wiener, một nhà toán học khác, cảnh báo rằng máy móc thông minh sẽ tìm cách đạt được mục tiêu của riêng chúng và con người sẽ không thể ngăn chặn chúng.
Vào năm 2026, những nỗi sợ hãi rằng AI, dù bằng cách thoát khỏi sự kiểm soát của con người hay thông qua việc sử dụng sai của những người vô đạo đức, có thể gây ra một sự kiện thảm khốc hoặc sự sụp đổ của nền văn minh, liệu có hợp lý hay không? Không ai biết.
Các chuyên gia trong lĩnh vực khoa học máy tính, triết học và các lĩnh vực khác đã hình dung ra nhiều con đường mà một hệ thống AI trong tương lai có thể gây ra một thảm họa toàn cầu, dù là bằng cách thoát khỏi sự kiểm soát của con người hay trong tay những kẻ vô đạo đức. Chúng bao gồm triển khai vũ khí, xác định một mầm bệnh chết người, thao túng chính phủ dẫn đến xung đột hoặc phá vỡ mạng lưới lương thực, năng lượng và truyền thông mà xã hội dựa vào để hoạt động.
Không có ước tính được chấp nhận rộng rãi về thời điểm bất kỳ kịch bản nào trong số này có thể xảy ra và không có sự đồng thuận về khả năng xảy ra của chúng.
Năm 2023, tổ chức phi lợi nhuận Center for AI Safety đã đưa ra một tuyên bố đồng ký bởi hơn 350 nhà nghiên cứu và giám đốc điều hành công nghệ, bao gồm cả Amodei của Anthropic và CEO Sam Altman của OpenAI, nói rằng: “Giảm thiểu rủi ro tuyệt chủng từ AI nên là một ưu tiên toàn cầu cùng với các đại dịch và chiến tranh hạt nhân.”
Báo cáo An toàn AI Quốc tế năm 2026, được viết với sự hướng dẫn của hơn 100 chuyên gia độc lập, cho biết các hệ thống hiện tại cho thấy những dấu hiệu ban đầu của một số khả năng liên quan nhưng không ở mức độ có thể cho phép mất kiểm soát, và mô tả khả năng xảy ra, bản chất và thời điểm của rủi ro là “không rõ ràng một cách bất thường.”
Một nhà nghiên cứu của Anthropic cho biết tuần trước rằng ông đang từ chức khỏi công ty vì lo ngại rằng cả công ty lẫn các đối thủ cạnh tranh đều không hành động có trách nhiệm trong việc phát triển công nghệ. Trên mạng xã hội, Jacob Coxon ước tính có 10% khả năng AI gây ra sự tuyệt chủng của con người trong thập kỷ tới và nói rằng cả Anthropic và OpenAI “đang chạy thẳng tới siêu trí tuệ tự cải thiện và đánh cược mạng sống của chúng ta.”
Các nhà nghiên cứu đã kêu gọi giảm tốc độ phát triển AI và cảnh báo trong nhiều năm rằng công nghệ này có thể gây ra rủi ro hiện hữu cho nhân loại.
Sau các sự cố gần đây, các chuyên gia kêu gọi cải thiện việc kiểm thử của các công ty AI và tăng cường đối thoại giữa Hoa Kỳ và Trung Quốc để đưa ra các giải pháp chung.
Tuy nhiên, AI đang phát triển nhanh chóng đến mức chính phủ và hệ thống đánh giá đang gặp khó khăn trong việc theo kịp công nghệ. Các quốc gia đang soạn thảo luật riêng của họ, một số mâu thuẫn nhau.
Lãnh đạo Trung Quốc Tập Cận Bình đã cảnh báo tại một hội nghị vào tháng 7 về sự cần thiết phải ngăn AI thoát khỏi sự kiểm soát của con người. Chính quyền Tổng thống Donald Trump ban đầu tỏ ra miễn cưỡng trong việc điều chỉnh AI nhưng đã trở nên quan tâm hơn đến việc giảm thiểu rủi ro an ninh mạng.
Vào Chủ nhật, Tổng thống Donald Trump đã hạ thấp sự cần thiết của chính quyền ông trong việc kiểm tra sự phát triển AI, nhưng thừa nhận sự cần thiết của một số quy định, theo ABC News.



