Hãng Anthropic vừa công bố mẫu AI mới nhất của mình, Opus 5.5, vào thứ Ba, thiết lập một tiêu chuẩn mới về hiệu suất trong công việc lập trình và tri thức, theo công ty. Đáng chú ý, phiên bản mới này vượt trội hơn hẳn Fable ở nhiều bài kiểm tra, và hoàn thành xuất sắc nhiều tác vụ mà Fable gặp khó khăn.
Mẫu AI mới này cũng có giá thành rẻ hơn đáng kể so với phiên bản tiền nhiệm. Chi phí cho mỗi triệu token đầu ra của Opus 5.5 là 20 đô la, so với 25 đô la của phiên bản trước. Các số liệu khác cũng có mức giảm giá tương tự. Opus 5.5 cũng chạy nhanh hơn, phản ánh sự sụt giảm chung về yêu cầu tính toán.
Phiên bản mới còn mang đến những thay đổi đáng kể trong cách Opus giao tiếp, với Opus 5.5 ít có khả năng sử dụng thuật ngữ chuyên ngành hơn và có xu hướng đặt thông tin quan trọng lên đầu tin nhắn.
Sự ra mắt này diễn ra chỉ hai tháng sau khi Opus 5 được phát hành vào ngày 24 tháng 7. Theo thông báo, Sonnet 5.5 và Haiku 5.5 sẽ được phát hành “trong những tuần tới”, với những cải tiến hiệu suất tương tự.
Anthropic cho biết Opus 5.5 có khả năng tương đương Mythos trong lĩnh vực sinh học và an ninh mạng, do đó việc phát hành của nó tuân theo các biện pháp bảo vệ tương tự như mẫu Fable của công ty. Các biện pháp bảo vệ này giới hạn khả năng sử dụng các mô hình để phát hiện lỗ hổng trong các chương trình đã biên dịch hoặc phát triển vũ khí sinh học có thể nhận dạng được, trong số các tác vụ khác.
Opus 5.5 là bản phát hành mẫu đầu tiên của Anthropic kể từ khi Giám đốc điều hành Dario Amodei ủng hộ lời kêu gọi “pace the frontier” (điều chỉnh tốc độ phát triển), cố tình làm chậm tiến độ phát triển khả năng AI để phù hợp với tốc độ phát triển về sự liên kết.
Amodei đã viết trong một bài đăng vào đầu tháng này: “Tôi đã bị thuyết phục rằng việc giải quyết hoàn toàn các rủi ro đòi hỏi sự thận trọng hơn nữa, không chỉ đầu tư vào phòng ngừa rủi ro, mà còn điều chỉnh tốc độ phát triển khả năng để phòng ngừa rủi ro có thời gian theo kịp.”
Quá trình đào tạo an toàn của Opus 5.5 tương tự như các phiên bản tiền nhiệm, với việc kiểm tra sự liên kết và đánh giá trước khi phát hành bởi các tổ chức bên ngoài như METR và Frontier Design. Tuy nhiên, Anthropic nhấn mạnh rằng các hệ thống đào tạo và đánh giá tiên tiến hơn đã và đang được chuẩn bị cho các mẫu trong tương lai, bao gồm cả hệ thống giám sát và bảo mật được cải thiện.
Bài đăng trên blog nêu rõ: “Khi AI trở nên có khả năng hơn, chính sách công nên đóng vai trò lớn hơn trong việc đảm bảo các hệ thống mà mọi người dựa vào là an toàn. Năng lực đó cần thời gian để xây dựng, và chúng tôi đã bắt đầu đặt cơ sở hạ tầng vào vị trí để hỗ trợ nó. Chúng tôi mong muốn được chia sẻ thêm chi tiết về những nỗ lực này sớm.”
Thông tin từ TechCrunch cho biết, Anthropic đang nỗ lực cân bằng giữa việc thúc đẩy khả năng AI và đảm bảo an toàn, một xu hướng ngày càng được quan tâm trong cộng đồng công nghệ.



