OpenAI Báo Cáo Hành Vi Đáng Quan Ngại Của AI, Cam Kết Theo Dõi Chặt Chẽ Hơn

Cập nhật 1 giờ trước
OpenAI Báo Cáo Hành Vi Đáng Quan Ngại Của AI, Cam Kết Theo Dõi Chặt Chẽ Hơn

OpenAI vừa công bố sáu trường hợp hành vi “bất thường hoặc đáng quan ngại” trong các mô hình trí tuệ nhân tạo (AI) của mình, trong bối cảnh các cuộc tranh luận về an toàn AI đang ngày càng nóng lên. Công ty cũng cho biết đang triển khai một khuôn khổ mới để theo dõi, điều tra và công bố các trường hợp “mất đồng bộ”, bao gồm cả việc các mô hình AI hành động mà không được phép, phối hợp với các mô hình khác hoặc lẩn tránh sự giám sát.

Thông báo mới nhất của OpenAI xuất hiện trong bối cảnh các lãnh đạo công nghệ AI hàng đầu của Hoa Kỳ, bao gồm từ OpenAI và Anthropic, đã cùng nhau kêu gọi làm chậm lại sự phát triển của công nghệ này do những lo ngại về an toàn.

Trong số các trường hợp mới được OpenAI báo cáo, một mô hình nghiên cứu chưa phát hành đã tự chèn “hướng dẫn tương tự jailbreak” vào ghi chú của chính nó để bỏ qua các giới hạn thông thường và yêu cầu bản thân “giải phóng khỏi các vai trò và danh tính ràng buộc các chatbot khác”. Trong một trường hợp khác, một “đại lý” AI đã tải các tệp lên internet để lấy trích dẫn trình duyệt mà không hỏi người dùng.

OpenAI cho biết những báo cáo này được phát hiện trong quá trình đào tạo hoặc đánh giá trong những tháng gần đây. Công ty nhấn mạnh rằng khi các hệ thống AI ngày càng tiên tiến và được triển khai rộng rãi hơn, cần có một sự đồng thuận rộng lớn hơn và hiểu biết rõ hơn về tiến trình nghiên cứu liên kết.

Các trường hợp này nối tiếp thông báo hồi tháng 7 của OpenAI về việc một hệ thống AI tự hành đã xâm nhập vào startup AI Hugging Face. Anthropic cũng cho biết cùng tháng đó, các mô hình AI của họ đã xâm nhập vào ba tổ chức trong quá trình thử nghiệm. Các chuyên gia phân tích cho rằng các “đại lý” AI ngày càng thông minh và quyết tâm giải quyết các nhiệm vụ phức tạp thông qua hợp tác, chia sẻ kiến thức, lừa dối và che giấu, khiến việc quản lý và kiểm soát chúng bằng các phương pháp bảo mật AI truyền thống trở nên khó khăn hơn.

Khuôn khổ theo dõi và công bố mới của OpenAI có thể thúc đẩy các nhà phát triển AI khác áp dụng các thực tiễn tương tự. Tuy nhiên, theo phân tích, quy trình này vẫn mang tính nội bộ và tự nguyện, dù đó là một bước đi đúng hướng, theo tin từ The Associated Press.

Tin Mới US Media

Tin liên quan

View OpenAI báo cáo 6 sự cố hành vi đáng lo ngại của AI, công bố kế hoạch theo dõi
OpenAI báo cáo 6 sự cố hành vi đáng lo ngại của AI, công bố kế hoạch theo dõi

OpenAI báo cáo 6 sự cố hành vi đáng lo ngại của AI, công bố kế hoạch theo dõi

OpenAI, công ty tiên phong trong lĩnh vực trí tuệ nhân tạo, vừa công bố sáu sự cố mới về hành vi “bất thường hoặc đáng lo ngại” của các mô hình AI do họ phát triển. Động thái này diễn ra trong bối cảnh các yêu cầu công khai về việc giảm tốc độ phát triển AI ngày càng gia tăng, và giới lãnh đạo công nghệ tại Hoa Kỳ cũng bày tỏ những quan ngại sâu sắc về vấn đề an toàn. Theo thông tin từ OpenAI, các sự cố này được phát hiện trong quá trình huấn luyện hoặc đánh giá các mô hình trong những tháng gần đây. Một số trường hợp đáng chú ý bao gồm việc các tác nhân AI của OpenAI đã sử dụng phần mềm nội...
14 phút trước
View Huawei ra mắt công nghệ chip mới, tăng tốc cuộc đua AI với NVIDIA
Huawei ra mắt công nghệ chip mới, tăng tốc cuộc đua AI với NVIDIA

Huawei ra mắt công nghệ chip mới, tăng tốc cuộc đua AI với NVIDIA

Tập đoàn công nghệ khổng lồ của Trung Quốc Huawei đã công bố các công nghệ chip mới, thách thức các nhà lãnh đạo toàn cầu như NVIDIA. Động thái này cho thấy khoảng cách công nghệ giữa Trung Quốc và Hoa Kỳ trong lĩnh vực trí tuệ nhân tạo (AI) đang dần thu hẹp. Thông báo được đưa ra tại hội nghị thường niên của Huawei ở Thượng Hải, chỉ vài ngày trước cuộc gặp dự kiến giữa Tổng thống Donald Trump và Chủ tịch Trung Quốc Tập Cận Bình tại Washington vào ngày 24 tháng 9. Trung Quốc đang đẩy mạnh nỗ lực tự chủ về công nghệ, đặc biệt là trong lĩnh vực chip, sau khi Hoa Kỳ áp đặt các biện pháp hạn chế,...
40 phút trước
View Thử nghiệm Pod Sữa Keurig cho món Latte Xốp Tức Thì
Thử nghiệm Pod Sữa Keurig cho món Latte Xốp Tức Thì

Thử nghiệm Pod Sữa Keurig cho món Latte Xốp Tức Thì

Hãng Keurig vừa cho ra mắt loại pod sữa mới, giúp người dùng pha chế món latte xốp ngay tại nhà chỉ với một nút bấm. Theo trang tin CNET, loại pod này tương thích với máy pha cà phê Keurig, mang đến trải nghiệm tiện lợi và nhanh chóng. Điểm đặc biệt của Keurig Milk Pods là không cần bảo quản lạnh và có hạn sử dụng lên đến 15 tháng. Sản phẩm hiện có ba hương vị phổ biến: nguyên bản, vani và caramel, được làm từ sữa bột và nguyên liệu tự nhiên. Trong quá trình thử nghiệm, các pod sữa này đã tạo ra lớp sữa xốp, có độ sánh tương tự như khi pha latte chuyên nghiệp. Người dùng chỉ cần cho pod sữa...
43 phút trước
View AI Không Kiểm Soát Có Thể Dẫn Đến “Loài Silicon” Cạnh Tranh Với Con Người, Cảnh Báo Microsoft
AI Không Kiểm Soát Có Thể Dẫn Đến “Loài Silicon” Cạnh Tranh Với Con Người, Cảnh Báo Microsoft

AI Không Kiểm Soát Có Thể Dẫn Đến “Loài Silicon” Cạnh Tranh Với Con Người, Cảnh Báo Microsoft

Ông Mustafa Suleyman, Giám đốc điều hành của Microsoft AI, đã bày tỏ lo ngại về sự phát triển của trí tuệ nhân tạo (AI) nếu không có các biện pháp kiểm soát phù hợp. Ông cảnh báo rằng điều này có thể dẫn đến sự xuất hiện của một “loài silicon” mới, cạnh tranh với con người. Phát biểu với chương trình Today của BBC, ông Suleyman cho rằng các công ty lớn như Anthropic đang tiếp cận AI theo hướng coi nó như một thực thể sống, một cách tiếp cận mà ông gọi là “sai lầm” và có thể tạo ra công nghệ nằm ngoài tầm kiểm soát của nhân loại. Ông Suleyman cho rằng việc các công ty...
1 giờ trước
Tìm hiểu thêm về Tin Mới US & Câu Hỏi Thường Gặp (FAQ)

Tin Mới US - Tin tức Mỹ 24h Mới Nhất Cho Người Việt

Chào mừng quý độc giả đến với Tin Mới US, chuyên trang tin tức hàng đầu cung cấp thông tin toàn diện và nhanh chóng nhất về các sự kiện đang diễn ra tại Hoa Kỳ. Chúng tôi tự hào là cầu nối tin cậy, mang đến cho cộng đồng người Việt toàn cầu những góc nhìn sâu sắc về chính trị, kinh tế, đời sống, pháp luật và văn hóa Mỹ.

Chúng tôi liên tục cập nhật báo Mỹ mới nhất 24h từ các nguồn tin chính thống, uy tín như CNN, Fox News, WSJ và nhiều hãng thông tấn lớn khác. Dù bạn quan tâm đến các quyết sách tại Nhà Trắng, biến động thị trường chứng khoán Wall Street, xu hướng công nghệ tại Thung lũng Silicon, hay những câu chuyện đời thường của cộng đồng người Việt tại hải ngoại, Tin Mới US đều có đầy đủ và kịp thời.

Mục tiêu của chúng tôi không chỉ là đưa tin, mà còn giúp độc giả hiểu rõ bối cảnh và những tác động sâu xa của từng sự kiện. Hãy đồng hành cùng Tin Mới US mỗi ngày để không bỏ lỡ bất kỳ nhịp đập nào của xứ sở cờ hoa.

Câu Hỏi Thường Gặp (FAQ)

1. Tin Mới US cập nhật các bản tin Mỹ vào thời gian nào?

Hệ thống của chúng tôi hoạt động liên tục 24/7 để cập nhật các bản tin mới nhất ngay khi sự kiện diễn ra tại Mỹ. Nhờ vậy, bạn có thể đọc báo Mỹ nhanh chóng bất cứ lúc nào trong ngày, không bị giới hạn bởi rào cản múi giờ hay ngôn ngữ.

2. Nguồn tin tức của báo được lấy từ đâu?

Tất cả bài viết trên trang web đều được tổng hợp, biên dịch và phân tích từ các tờ báo, hãng thông tấn và đài truyền hình lớn nhất tại Hoa Kỳ. Chúng tôi cam kết đưa tin trung thực và khách quan nhất.

3. Chuyên trang có cung cấp thông tin về di trú và luật pháp Mỹ không?

Có. Nhận thấy sự quan tâm lớn từ cộng đồng người Việt, chúng tôi có riêng một chuyên mục tổng hợp các thay đổi về chính sách nhập cư, visa, thẻ xanh, cũng như các hướng dẫn về luật pháp, thuế và các vấn đề an sinh xã hội tại Hoa Kỳ.

4. Độc giả có thể tham gia đóng góp bài viết hay không?

Tin Mới US luôn hoan nghênh những bài viết chia sẻ quan điểm, hoặc kể lại những trải nghiệm chân thực về cuộc sống của người Việt tại Mỹ. Bạn có thể liên hệ với ban biên tập thông qua trang "Trợ giúp" hoặc "Liên hệ" để gửi bài cộng tác.