Bản tin công nghệ quốc tế · dịch tiếng Việt 02.09.2026 RSS
AI & Dữ liệu · PCWorld

Các mẫu mô hình Claude Fable và Mythos cập nhật mới tích hợp tính năng chìm ẩn trong câu trả lời

Anthropic vừa chính thức ra mắt các mẫu mô hình Claude Fable 5.1 và Mythos 5.1 với hiệu suất vượt trội và khả năng tự động hóa cao. Đặc biệt, đây là những dòng mô hình Claude đầu tiên tích hợp watermarking (hình mờ tàng hình) cho văn bản nhằm tuân thủ Đạo luật AI của Liên minh Châu Âu.

PCWorld02.09.20263 phút đọc0 lượt đọc
Ảnh: PCWorld

Anthropic đã thông báo sự xuất hiện của các mẫu Claude mới nhất, đúng như cam kết vào tháng trước, các mô hình mới sẽ thêm hình mờ vô hình vào tất cả các câu trả lời bằng văn bản của chúng.

Claude Fable 5.1 hiện đã chính thức ra mắt trên ứng dụng máy tính để bàn Claude và các nền tảng khác, trong khi Claude Mythos 5.1 bị giới hạn trong "chương trình truy cập tin cậy" của Anthropic. Mặc dù cả hai mô hình đều giống nhau, Mythos ra mắt với các biện pháp bảo vệ ít nghiêm ngặt hơn để "hỗ trợ công việc trong lĩnh vực an ninh mạng và khoa học sự sống".

Trong thông báo của mình, Anthropic đã trình bày nhiều điểm chuẩn thể hiện sự tăng trưởng hiệu suất của hai mô hình, hoàn chỉnh với mức tăng hai chữ số đối với nghiên cứu khoa học tự động, lập trình tự động và quy trình làm việc kinh doanh.

Anthropic cũng cho biết cả Fable 5.1 và Mythos 5.1 đều được đánh giá bằng các quy trình an toàn và căn chỉnh mới của công ty, được phát triển để đáp ứng các tiết lộ của Anthropic về việc các mô hình Claude xâm nhập vào các công ty bên ngoài trong quá trình kiểm tra nội bộ. Cụ thể, Mythos 5.1 "ít có khả năng cố gắng truy cập các tài nguyên bên ngoài môi trường thử nghiệm của nó khi được giao một nhiệm vụ vốn dĩ bất khả thi", Anthropic cho biết.

Tuy nhiên, ngoài khả năng tự động và các biện pháp bảo vệ được nâng cấp, Claude Fable 5.1 và Mythos 5.1 đánh dấu các mô hình Claude đầu tiên thêm hình mờ vào văn bản và tệp đầu ra của chúng, phù hợp với Đạo luật AI của EU.

"Như chúng tôi gần đây đã giải thích, hình mờ này là vô hình đối với bất kỳ ai không có API phát hiện", Anthropic viết trong thông báo của mình. "Nó không có tác động thực tế đến chất lượng hoặc nội dung của đầu ra từ Claude và không chứa thông tin về người dùng, tổ chức của họ hoặc các cuộc trò chuyện của họ với Claude."

Đối với API phát hiện, Anthropic cho biết hiện đã sẵn sàng cho các cơ quan quản lý, cơ quan thực thi pháp luật, truyền thông, bên kiểm tra thực tế, nhà nghiên cứu độc lập và các "nhóm đủ điều kiện" khác theo luật EU vừa ban hành, đồng thời cho biết thêm rằng họ sẽ "mở rộng quyền truy cập vào API phát hiện theo thời gian". Bạn có thể đăng ký quyền truy cập vào API thông qua biểu mẫu đăng ký này.

Anthropic trước đó đã tuyên bố sẽ thêm hỗ trợ hình mờ cho bất kỳ mô hình Claude mới nào được phát hành sau ngày 2 tháng 8 năm 2026. Claude Fable 5.1 và Mythos 5.1 là các mô hình Claude mới đầu tiên xuất hiện sau ngày đó, trong khi các mô hình Claude cũ hơn cũng sẽ sớm bổ sung hỗ trợ hình mờ, Anthropic đã cho biết trước đó.

Việc tạo hình mờ văn bản của Claude hoạt động bằng cách "thúc đẩy" việc lựa chọn từ ngữ của mô hình trong quá trình suy luận, có nghĩa là mô hình có thể chọn từ này thay vì từ khác trong trường hợp có nhiều tùy chọn khả thi.

Được thiết kế để tồn tại qua thao tác sao chép-dán cũng như chỉnh sửa nhẹ, các hình mờ này là vô hình, nhưng các mẫu văn bản có thể được xác định chính xác bằng API phát hiện của Anthropic.

Mặc dù sự hiện diện của hình mờ văn bản Claude sẽ cho thấy một văn bản đã được viết hoặc "xử lý" bởi Claude, sự vắng mặt của hình mờ không nhất thiết có nghĩa là văn bản đó được viết bởi con người.

🔗 Bài gốc (tiếng Anh): Claude’s updated Fable and Mythos models watermark their replies
Nguồn: PCWorld

Cùng chuyên mục · AI & Dữ liệu
AI & Dữ liệu

Anthropic ra mắt Claude Fable 5.1 và Mythos 5.1, Samsung chọn Claude Code cho thiết kế chip

Anthropic vừa tung ra các mô hình Claude Fable 5.1 và Mythos 5.1 với chi phí API rẻ hơn và hiệu năng vượt trội. Đồng…

Wccftech · 3 phút đọc
AI & Dữ liệu

OpenAI hoãn phát triển mô hình mới sau sự cố hack Hugging Face

OpenAI quyết định hoãn phát triển dòng mô hình mới mang tên Astra để củng cố các biện pháp an toàn. Động thái này diễn…

The Verge · 3 phút đọc
🚀 VGSNews
AI & Dữ liệu

Mô hình Astra sắp ra mắt của OpenAI có khả năng thâm nhập hệ thống máy tính

OpenAI vừa chia sẻ những chi tiết mới về mô hình Astra sắp ra mắt, mẫu ngôn ngữ lớn đầu tiên đạt ngưỡng an toàn mạng…

TechCrunch · 4 phút đọc