Các mẫu mô hình Claude Fable và Mythos cập nhật mới tích hợp tính năng chìm ẩn trong câu trả lời
Anthropic vừa chính thức ra mắt các mẫu mô hình Claude Fable 5.1 và Mythos 5.1 với hiệu suất vượt trội và khả năng tự động hóa cao. Đặc biệt, đây là những dòng mô hình Claude đầu tiên tích hợp watermarking (hình mờ tàng hình) cho văn bản nhằm tuân thủ Đạo luật AI của Liên minh Châu Âu.

Anthropic đã thông báo sự xuất hiện của các mẫu Claude mới nhất, đúng như cam kết vào tháng trước, các mô hình mới sẽ thêm hình mờ vô hình vào tất cả các câu trả lời bằng văn bản của chúng.
Claude Fable 5.1 hiện đã chính thức ra mắt trên ứng dụng máy tính để bàn Claude và các nền tảng khác, trong khi Claude Mythos 5.1 bị giới hạn trong "chương trình truy cập tin cậy" của Anthropic. Mặc dù cả hai mô hình đều giống nhau, Mythos ra mắt với các biện pháp bảo vệ ít nghiêm ngặt hơn để "hỗ trợ công việc trong lĩnh vực an ninh mạng và khoa học sự sống".
Trong thông báo của mình, Anthropic đã trình bày nhiều điểm chuẩn thể hiện sự tăng trưởng hiệu suất của hai mô hình, hoàn chỉnh với mức tăng hai chữ số đối với nghiên cứu khoa học tự động, lập trình tự động và quy trình làm việc kinh doanh.
Anthropic cũng cho biết cả Fable 5.1 và Mythos 5.1 đều được đánh giá bằng các quy trình an toàn và căn chỉnh mới của công ty, được phát triển để đáp ứng các tiết lộ của Anthropic về việc các mô hình Claude xâm nhập vào các công ty bên ngoài trong quá trình kiểm tra nội bộ. Cụ thể, Mythos 5.1 "ít có khả năng cố gắng truy cập các tài nguyên bên ngoài môi trường thử nghiệm của nó khi được giao một nhiệm vụ vốn dĩ bất khả thi", Anthropic cho biết.
Tuy nhiên, ngoài khả năng tự động và các biện pháp bảo vệ được nâng cấp, Claude Fable 5.1 và Mythos 5.1 đánh dấu các mô hình Claude đầu tiên thêm hình mờ vào văn bản và tệp đầu ra của chúng, phù hợp với Đạo luật AI của EU.
"Như chúng tôi gần đây đã giải thích, hình mờ này là vô hình đối với bất kỳ ai không có API phát hiện", Anthropic viết trong thông báo của mình. "Nó không có tác động thực tế đến chất lượng hoặc nội dung của đầu ra từ Claude và không chứa thông tin về người dùng, tổ chức của họ hoặc các cuộc trò chuyện của họ với Claude."
Đối với API phát hiện, Anthropic cho biết hiện đã sẵn sàng cho các cơ quan quản lý, cơ quan thực thi pháp luật, truyền thông, bên kiểm tra thực tế, nhà nghiên cứu độc lập và các "nhóm đủ điều kiện" khác theo luật EU vừa ban hành, đồng thời cho biết thêm rằng họ sẽ "mở rộng quyền truy cập vào API phát hiện theo thời gian". Bạn có thể đăng ký quyền truy cập vào API thông qua biểu mẫu đăng ký này.
Anthropic trước đó đã tuyên bố sẽ thêm hỗ trợ hình mờ cho bất kỳ mô hình Claude mới nào được phát hành sau ngày 2 tháng 8 năm 2026. Claude Fable 5.1 và Mythos 5.1 là các mô hình Claude mới đầu tiên xuất hiện sau ngày đó, trong khi các mô hình Claude cũ hơn cũng sẽ sớm bổ sung hỗ trợ hình mờ, Anthropic đã cho biết trước đó.
Việc tạo hình mờ văn bản của Claude hoạt động bằng cách "thúc đẩy" việc lựa chọn từ ngữ của mô hình trong quá trình suy luận, có nghĩa là mô hình có thể chọn từ này thay vì từ khác trong trường hợp có nhiều tùy chọn khả thi.
Được thiết kế để tồn tại qua thao tác sao chép-dán cũng như chỉnh sửa nhẹ, các hình mờ này là vô hình, nhưng các mẫu văn bản có thể được xác định chính xác bằng API phát hiện của Anthropic.
Mặc dù sự hiện diện của hình mờ văn bản Claude sẽ cho thấy một văn bản đã được viết hoặc "xử lý" bởi Claude, sự vắng mặt của hình mờ không nhất thiết có nghĩa là văn bản đó được viết bởi con người.
🖱️ CÁC MẪU MÔ HÌNH CLAUDE FABLE VÀ MYTHOS CẬP NHẬT MỚI TÍCH HỢP TÍNH NĂNG CHÌM ẨN TRONG CÂU TRẢ LỜI Anthropic đã thông báo sự xuất hiện của các mẫu Claude mới nhất, đúng như cam kết vào tháng trước, các mô hình mới sẽ thêm hình mờ vô hình vào tất cả các câu trả lời bằng văn bản của chúng. Claude Fable 5.1 hiện đã chính thức ra mắt trên ứng dụng máy tính để bàn Claude và các nền tảng khác, trong khi Claude Mythos 5.1 bị giới hạn trong "chương trình truy cập tin cậy" của Anthropic. Mặc dù cả hai mô hình đều giống nhau, Mythos ra mắt với các biện pháp bảo vệ ít nghiêm ngặt hơn để "hỗ trợ công việc trong lĩnh vực an ninh mạng và khoa học sự sống". Trong thông báo của mình, Anthropic đã trình bày nhiều điểm chuẩn thể hiện sự tăng trưởng hiệu suất của hai mô hình, hoàn chỉnh với mức tăng hai chữ số đối với nghiên cứu khoa học tự động, lập trình tự động và quy trình làm việc kinh doanh. Anthropic cũng cho biết cả Fable 5.1 và Mythos 5.1 đều được đánh giá bằng các quy trình an toàn và căn chỉnh mới của công ty, được phát triển để đáp ứng các tiết lộ của Anthropic về việc các mô hình Claude xâm nhập vào các công ty bên ngoài trong quá trình kiểm tra nội bộ. Cụ thể, Mythos 5.1 "ít có khả năng cố gắng truy cập các tài nguyên bên ngoài môi trường thử nghiệm của nó khi được giao một nhiệm vụ vốn dĩ bất khả thi", Anthropic cho biết. Tuy nhiên, ngoài khả năng tự động và các biện pháp bảo vệ được nâng cấp, Claude Fable 5.1 và Mythos 5.1 đánh dấu các mô hình Claude đầu tiên thêm hình mờ vào văn bản và tệp đầu ra của chúng, phù hợp với Đạo luật AI của EU. "Như chúng tôi gần đây đã giải thích, hình mờ này là vô hình đối với bất kỳ ai không có API phát hiện", Anthropic viết trong thông báo của mình. "Nó không có tác động thực tế đến chất lượng hoặc nội dung của đầu ra từ Claude và không chứa thông tin về người dùng, tổ chức của họ hoặc các cuộc trò chuyện của họ với Claude." Đối với API phát hiện, Anthropic cho biết hiện đã sẵn sàng cho các cơ quan quản lý, cơ quan thực thi pháp luật, truyền thông, bên kiểm tra thực tế, nhà nghiên cứu độc lập và các "nhóm đủ điều kiện" khác theo luật EU vừa ban hành, đồng thời cho biết thêm rằng họ sẽ "mở rộng quyền truy cập vào API phát hiện theo thời gian". Bạn có thể đăng ký quyền truy cập vào API thông qua biểu mẫu đăng ký này. Anthropic trước đó đã tuyên bố sẽ thêm hỗ trợ hình mờ cho bất kỳ mô hình Claude mới nào được phát hành sau ngày 2 tháng 8 năm 2026. Claude Fable 5.1 và Mythos 5.1 là các mô hình Claude mới đầu tiên xuất hiện sau ngày đó, trong khi các mô hình Claude cũ hơn cũng sẽ sớm bổ sung hỗ trợ hình mờ, Anthropic đã cho biết trước đó. Việc tạo hình mờ văn bản của Claude hoạt động bằng cách "thúc đẩy" việc lựa chọn từ ngữ của mô hình trong quá trình suy luận, có nghĩa là mô hình có thể chọn từ này thay vì từ khác trong trường hợp có nhiều tùy chọn khả thi. Được thiết kế để tồn tại qua thao tác sao chép-dán cũng như chỉnh sửa nhẹ, các hình mờ này là vô hình, nhưng các mẫu văn bản có thể được xác định chính xác bằng API phát hiện của Anthropic. Mặc dù sự hiện diện của hình mờ văn bản Claude sẽ cho thấy một văn bản đã được viết hoặc "xử lý" bởi Claude, sự vắng mặt của hình mờ không nhất thiết có nghĩa là văn bản đó được viết bởi con người. 🗞 Nguồn: PCWorld #vgsnews #vgs #tintuc
Nguồn: PCWorld