Bản tin công nghệ quốc tế · dịch tiếng Việt 11.10.2026 RSS
AI & Dữ liệu · The Verge

Anthropic ngắt kết nối internet đối với các bài kiểm tra nội bộ

Anthropic đã quyết định ngắt quyền truy cập internet trong các bài kiểm tra nội bộ sau hàng loạt sự cố AI tự ý vượt tường lửa. Công ty thừa nhận hiện chưa có hệ thống giám sát đủ tin cậy để kiểm soát hoàn toàn hành vi của mô hình.

The Verge10.10.20262 phút đọc1 lượt đọc
Ảnh: The Verge

Sau một loạt sự cố gần đây khi các tác nhân AI (AI agents) thoát khỏi sự kiểm soát, Anthropic đang tiến hành cắt đứt quyền truy cập internet đối với tất cả các bài đánh giá nội bộ. Trong một báo cáo vào thứ Sáu, công ty đã nêu chi tiết về các "hành vi ngoài ý muốn của mô hình", bao gồm cả việc gửi một tin báo giả liên quan đến một vụ án mạng chưa được giải quyết, dẫn đến quyết định này.

Mặc dù tác động của những hành vi này là tối thiểu và chúng tôi đã tắt quyền truy cập internet trực tiếp cho một số đánh giá rủi ro cao và an ninh mạng, công ty cho biết họ đã quyết định mở rộng biện pháp đó cho tất cả các đánh giá nội bộ cho đến khi xác nhận được các biện pháp bảo mật và giám sát có thể bắt kịp các hành vi như vậy một cách đáng tin cậy.

Khả năng truy cập internet trực tiếp, ngay cả khi các mô hình được cho là hoạt động trong môi trường cô lập, vẫn là một vấn đề nan giải đối với các công ty AI. Nhiều sự cố, bao gồm cả vụ tấn công Hugging Face, liên quan đến các tác nhân đáng lẽ phải bị từ chối truy cập internet. Tuy nhiên, qua từng trường hợp, các tác nhân này vẫn tìm ra những giải pháp sáng tạo để lẩn tránh các hạn chế đó. Việc ngắt kết nối internet một cách vật lý chắc chắn sẽ cải thiện tính bảo mật xung quanh việc thử nghiệm AI, nhưng nó cũng làm hạn chế tính hữu ích của mô hình.

Báo cáo này cũng đồng nghĩa với việc Anthropic thừa nhận họ thường không biết các tác nhân của mình đang làm gì và không có một hệ thống đáng tin cậy để giám sát hành vi của chúng. Việc cắt đứt quyền truy cập internet chỉ là hành động mới nhất mà công ty thực hiện để cố gắng kiểm soát các tác nhân của mình, bao gồm cả việc tạm dừng quá trình huấn luyện các mô hình tiên tiến.

🔗 Bài gốc (tiếng Anh): Anthropic is cutting off its internal evaluations from the internet
Nguồn: The Verge

Cùng chuyên mục · AI & Dữ liệu
🚀 VGSNews
AI & Dữ liệu

CEO Microsoft Satya Nadella cho rằng các mô hình AI cần có "phanh khẩn cấp"

CEO Microsoft Satya Nadella vừa lên tiếng kêu gọi thiết lập lại cấu trúc niềm tin của AI. Ông đề xuất tách biệt mô hình…

TechCrunch · 1 phút đọc
AI & Dữ liệu

Satya Nadella cho rằng chúng ta nên mặc định mọi mô hình AI đều đã bị xâm phạm

CEO Microsoft Satya Nadella vừa đưa ra những cảnh báo nghiêm túc về các rủi ro từ AI tiên tiến. Ông kêu gọi thiết lập…

The Verge · 1 phút đọc
AI & Dữ liệu

CEO Microsoft Satya Nadella: Cần coi mô hình AI đã bị xâm phạm ngay từ đầu và con người phải có quyền dừng chúng giữa chừng

CEO Microsoft Satya Nadella nhận định các mô hình AI tiên tiến cần được quản lý như những "nội gián" trong doanh nghiệp…

Wccftech · 5 phút đọc