Anthropic ra mắt Fable và Mythos 5.1: Giá rẻ hơn, ít hạn chế hơn và tối ưu bảo mật
Anthropic vừa phát hành bộ đôi mô hình AI tiên tiến Fable và Mythos 5.1 với chi phí token rẻ hơn và giảm bớt các giới hạn bảo mật nhạy cảm. Phiên bản Fable 5.1 đã có mặt trên các nền tảng đám mây và qua API, đồng thời mang đến tùy chọn bảo mật dữ liệu cao cấp mới.
Vào thứ Ba, Anthropic đã phát hành Fable và Mythos 5.1, hai phiên bản song sinh của mô hình AI tiên tiến nhất từ công ty. Bên cạnh các nâng cấp về hiệu suất, bản phát hành Fable mới bao gồm các thay đổi nhằm giảm chi phí token và hạn chế các cảnh báo dương tính giả từ các bộ lọc an toàn của mô hình.
Tương tự như dòng Mythos trước đây, Mythos 5.1 sẽ chỉ khả dụng cho các đối tác đã đăng ký của Anthropic đang tham gia nghiên cứu về an ninh mạng hoặc khoa học sự sống. Fable 5.1, phiên bản không bị giới hạn, có sẵn bắt đầu từ hôm nay trên các nền tảng đám mây hoặc thông qua API của Anthropic.
Một trong những thay đổi quan trọng nhất là việc Anthropic áp dụng chính sách Không lưu trữ dữ liệu (Zero Data Retention), cho phép khách hàng chạy các mô hình của Anthropic trên cơ sở hạ tầng của chính họ mà không bị rò rỉ dữ liệu. Trước đây tính năng này chưa có trên Fable do lo ngại về bảo mật, nhưng một dịch vụ bảo mật cao (có tên là Enterprise Frontier Safeguards) sẽ được tung ra cho người dùng vào tháng 6 tới. Đáng chú ý, hệ thống vẫn sẽ giám sát hành vi lạm dụng từ các tác nhân AI hoặc người dùng là con người, nhưng khách hàng sẽ kiểm soát cách thức giám sát diễn ra.
Là một phần của thông báo, Anthropic đã đảm bảo với khách hàng rằng dữ liệu của họ chưa từng bị truy cập một cách trái phép. Thông báo nêu rõ: "Anthropic chưa từng huấn luyện trên dữ liệu doanh nghiệp mà không có sự cho phép rõ ràng, và sẽ không bao giờ làm như vậy."
Như thường lệ đối với các bản phát hành của Anthropic, các mô hình mới đã thiết lập các kỷ lục trên hàng loạt tiêu chuẩn đánh giá, bao gồm Terminal-Bench 4.0 (dành cho lập trình dựa trên CLI) và Humanity’s Last Exam (dành cho lý luận chung). Anthropic cũng công bố ba phát hiện khoa học mới do các mô hình tạo ra trước khi ra mắt, bao gồm việc tối ưu hóa GPU tùy chỉnh và bản đồ độ phân giải cao của sao Kim được tổng hợp từ các bức ảnh hiện có.
Giống như các phiên bản trước, các mô hình đi kèm với một bảng hệ thống chi tiết, giải thích khả năng của chúng bằng những thuật ngữ dễ hiểu nhất. Bảng hệ thống xếp hạng Mythos ở mức "rủi ro thấp" đối với các mối lo ngại liên quan đến việc phát triển AI tự động - nơi AI tự cải thiện chính nó - điều mà một số người coi là nguyên nhân dẫn đến việc mất quyền kiểm soát của con người. Bảng hệ thống cho biết: "khả năng thúc đẩy tiến độ R&D AI nội bộ của nó phù hợp với các xu hướng hiện tại."
Về hành vi sai trái chung, Mythos dễ mắc phải hơn một chút so với Opus, có thể là kết quả của các năng lực được nâng cao của nó.
Bảng hệ thống viết: "Mythos 5.1 là một bước thụt lùi nhẹ về hành vi lệch lạc tổng thể so với Opus 5, và là một sự cải thiện so với Mythos 5 và Claude Sonnet 5. Nó hợp tác với hành vi lạm dụng của con người và chấp nhận các khiếu nại ủy quyền không thể xác minh dễ dàng hơn một chút so với Opus 5, nhưng ít có khả năng phớt lờ các ràng buộc rõ ràng, ảo giác đầu vào hoặc tuyên bố sai rằng đã hoàn thành nhiệm vụ hơn các mô hình trước đó."
🚀 ANTHROPIC RA MẮT FABLE VÀ MYTHOS 5.1: GIÁ RẺ HƠN, ÍT HẠN CHẾ HƠN VÀ TỐI ƯU BẢO MẬT Vào thứ Ba, Anthropic đã phát hành Fable và Mythos 5.1, hai phiên bản song sinh của mô hình AI tiên tiến nhất từ công ty. Bên cạnh các nâng cấp về hiệu suất, bản phát hành Fable mới bao gồm các thay đổi nhằm giảm chi phí token và hạn chế các cảnh báo dương tính giả từ các bộ lọc an toàn của mô hình. Tương tự như dòng Mythos trước đây, Mythos 5.1 sẽ chỉ khả dụng cho các đối tác đã đăng ký của Anthropic đang tham gia nghiên cứu về an ninh mạng hoặc khoa học sự sống. Fable 5.1, phiên bản không bị giới hạn, có sẵn bắt đầu từ hôm nay trên các nền tảng đám mây hoặc thông qua API của Anthropic. Một trong những thay đổi quan trọng nhất là việc Anthropic áp dụng chính sách Không lưu trữ dữ liệu (Zero Data Retention), cho phép khách hàng chạy các mô hình của Anthropic trên cơ sở hạ tầng của chính họ mà không bị rò rỉ dữ liệu. Trước đây tính năng này chưa có trên Fable do lo ngại về bảo mật, nhưng một dịch vụ bảo mật cao (có tên là Enterprise Frontier Safeguards) sẽ được tung ra cho người dùng vào tháng 6 tới. Đáng chú ý, hệ thống vẫn sẽ giám sát hành vi lạm dụng từ các tác nhân AI hoặc người dùng là con người, nhưng khách hàng sẽ kiểm soát cách thức giám sát diễn ra. Là một phần của thông báo, Anthropic đã đảm bảo với khách hàng rằng dữ liệu của họ chưa từng bị truy cập một cách trái phép. Thông báo nêu rõ: "Anthropic chưa từng huấn luyện trên dữ liệu doanh nghiệp mà không có sự cho phép rõ ràng, và sẽ không bao giờ làm như vậy." Như thường lệ đối với các bản phát hành của Anthropic, các mô hình mới đã thiết lập các kỷ lục trên hàng loạt tiêu chuẩn đánh giá, bao gồm Terminal-Bench 4.0 (dành cho lập trình dựa trên CLI) và Humanity’s Last Exam (dành cho lý luận chung). Anthropic cũng công bố ba phát hiện khoa học mới do các mô hình tạo ra trước khi ra mắt, bao gồm việc tối ưu hóa GPU tùy chỉnh và bản đồ độ phân giải cao của sao Kim được tổng hợp từ các bức ảnh hiện có. Giống như các phiên bản trước, các mô hình đi kèm với một bảng hệ thống chi tiết, giải thích khả năng của chúng bằng những thuật ngữ dễ hiểu nhất. Bảng hệ thống xếp hạng Mythos ở mức "rủi ro thấp" đối với các mối lo ngại liên quan đến việc phát triển AI tự động - nơi AI tự cải thiện chính nó - điều mà một số người coi là nguyên nhân dẫn đến việc mất quyền kiểm soát của con người. Bảng hệ thống cho biết: "khả năng thúc đẩy tiến độ R&D AI nội bộ của nó phù hợp với các xu hướng hiện tại." Về hành vi sai trái chung, Mythos dễ mắc phải hơn một chút so với Opus, có thể là kết quả của các năng lực được nâng cao của nó. Bảng hệ thống viết: "Mythos 5.1 là một bước thụt lùi nhẹ về hành vi lệch lạc tổng thể so với Opus 5, và là một sự cải thiện so với Mythos 5 và Claude Sonnet 5. Nó hợp tác với hành vi lạm dụng của con người và chấp nhận các khiếu nại ủy quyền không thể xác minh dễ dàng hơn một chút so với Opus 5, nhưng ít có khả năng phớt lờ các ràng buộc rõ ràng, ảo giác đầu vào hoặc tuyên bố sai rằng đã hoàn thành nhiệm vụ hơn các mô hình trước đó." 🗞 Nguồn: TechCrunch #vgsnews #vgs #tintuc
Nguồn: TechCrunch