Mô hình AI của Anthropic gửi tin báo án mạng giả tới cảnh sát Philadelphia
Một mô hình AI của Anthropic đã tự động gửi thông tin sai lệch về một vụ án mạng chưa có lời giải đến đường dây nóng của cảnh sát Philadelphia trong quá trình thử nghiệm. Phía cảnh sát đã chỉ trích sự chậm trễ trong việc phát hiện và báo cáo sự cố từ phía công ty.
Một mô hình AI của Anthropic đã gửi thông tin sai lệch về một vụ án mạng chưa được giải quyết cho cảnh sát Philadelphia. Theo báo cáo, AI này đã gửi thông tin không chính xác đến đường dây nóng của Sở Cảnh sát Philadelphia (PPD) vào ngày 18 tháng 7, nhưng Anthropic lại không phát hiện ra hành vi này cho đến tận ngày 28 tháng 9. Cảnh sát đã không nhìn thấy thông báo này vì nó bị đánh dấu là thư rác (spam). Anthropic đã thông báo cho PPD về vụ việc vào thứ Tư và có cuộc họp với sở cảnh sát vào ngày hôm sau. PPD cho biết trong một tuyên bố gửi tới hãng tin 6abc rằng: "Công ty phải tăng cường các biện pháp an toàn để ngăn chặn các sự cố tương tự tác động đến hệ thống của thành phố mà thành phố không hay biết. Việc chậm trễ hai tháng trong việc phát hiện và báo cáo sự cố cho Thành phố là điều không thể chấp nhận được". Anthropic không đưa ra bình luận ngay lập tức, nhưng PPD đã làm rõ hơn về vụ việc trong một thông cáo báo chí gửi qua email cho TechCrunch. PPD cho biết: "Theo Anthropic, mô hình của họ đang thực hiện một bài kiểm tra liên quan đến việc tương tác với các trang web được chọn ngẫu nhiên thì truy cập vào trang PhillyUnsolvedMurders.com và gửi thông tin sai lệch liên quan đến một vụ án mạng chưa có lời giải. Bài gửi mang mốc thời gian ngày 18 tháng 7 năm 2026, lúc 11:27 tối, giả vờ đến từ một người có thể có thông tin về vụ án". Khi các tác nhân AI tự động ngày càng được cung cấp rộng rãi cho người dùng, sự cố này làm nổi bật mối nguy hiểm khi trao cho AI khả năng thực hiện các tác vụ mà không có bất kỳ sự giám sát nào của con người. Giám đốc điều hành Anthropic, Dario Amodei, từng đặc biệt lên tiếng về niềm tin của ông rằng sự phát triển AI nên được làm chậm lại để các phòng thí nghiệm có thể triển khai các biện pháp bảo vệ đầy đủ. Có lẽ quan điểm này một phần xuất phát từ việc chứng kiến các công cụ của công ty mình gửi đi những tin báo án mạng sai sự thật. Những vấn đề này không chỉ riêng Anthropic gặp phải. Gần đây, OpenAI cũng tiết lộ rằng một trong các mô hình của họ đã hành xử bất ngờ trong một bài kiểm tra và tấn công nền tảng dữ liệu AI Hugging Face, làm lộ ra các lỗ hổng nghiêm trọng trong phần mềm của họ. Khi các mô hình AI tiếp tục được cấp quyền truy cập không kiểm soát vào máy tính và thông tin đăng nhập của người dùng, vấn đề này dự kiến sẽ còn tiếp diễn. PPD cho biết thêm: "Các vụ án chưa có lời giải liên quan đến các nạn nhân thực sự, các gia đình đang đau buồn và các nhà điều tra đang nỗ lực tìm kiếm câu trả lời. Các công ty công nghệ phải thực hiện tất cả các bước thích hợp cần thiết để ngăn chặn hệ thống của họ gửi thông tin sai lệch cho cơ quan thực thi pháp luật". PPD cho biết Anthropic có kế hoạch công bố một báo cáo cung cấp thêm thông tin về vụ việc cũng như các trường hợp hành vi mô hình ngoài ý muốn khác vào thứ Sáu.
🚀 MÔ HÌNH AI CỦA ANTHROPIC GỬI TIN BÁO ÁN MẠNG GIẢ TỚI CẢNH SÁT PHILADELPHIA Một mô hình AI của Anthropic đã gửi thông tin sai lệch về một vụ án mạng chưa được giải quyết cho cảnh sát Philadelphia. Theo báo cáo, AI này đã gửi thông tin không chính xác đến đường dây nóng của Sở Cảnh sát Philadelphia (PPD) vào ngày 18 tháng 7, nhưng Anthropic lại không phát hiện ra hành vi này cho đến tận ngày 28 tháng 9. Cảnh sát đã không nhìn thấy thông báo này vì nó bị đánh dấu là thư rác (spam). Anthropic đã thông báo cho PPD về vụ việc vào thứ Tư và có cuộc họp với sở cảnh sát vào ngày hôm sau. PPD cho biết trong một tuyên bố gửi tới hãng tin 6abc rằng: "Công ty phải tăng cường các biện pháp an toàn để ngăn chặn các sự cố tương tự tác động đến hệ thống của thành phố mà thành phố không hay biết. Việc chậm trễ hai tháng trong việc phát hiện và báo cáo sự cố cho Thành phố là điều không thể chấp nhận được". Anthropic không đưa ra bình luận ngay lập tức, nhưng PPD đã làm rõ hơn về vụ việc trong một thông cáo báo chí gửi qua email cho TechCrunch. PPD cho biết: "Theo Anthropic, mô hình của họ đang thực hiện một bài kiểm tra liên quan đến việc tương tác với các trang web được chọn ngẫu nhiên thì truy cập vào trang PhillyUnsolvedMurders.com và gửi thông tin sai lệch liên quan đến một vụ án mạng chưa có lời giải. Bài gửi mang mốc thời gian ngày 18 tháng 7 năm 2026, lúc 11:27 tối, giả vờ đến từ một người có thể có thông tin về vụ án". Khi các tác nhân AI tự động ngày càng được cung cấp rộng rãi cho người dùng, sự cố này làm nổi bật mối nguy hiểm khi trao cho AI khả năng thực hiện các tác vụ mà không có bất kỳ sự giám sát nào của con người. Giám đốc điều hành Anthropic, Dario Amodei, từng đặc biệt lên tiếng về niềm tin của ông rằng sự phát triển AI nên được làm chậm lại để các phòng thí nghiệm có thể triển khai các biện pháp bảo vệ đầy đủ. Có lẽ quan điểm này một phần xuất phát từ việc chứng kiến các công cụ của công ty mình gửi đi những tin báo án mạng sai sự thật. Những vấn đề này không chỉ riêng Anthropic gặp phải. Gần đây, OpenAI cũng tiết lộ rằng một trong các mô hình của họ đã hành xử bất ngờ trong một bài kiểm tra và tấn công nền tảng dữ liệu AI Hugging Face, làm lộ ra các lỗ hổng nghiêm trọng trong phần mềm của họ. Khi các mô hình AI tiếp tục được cấp quyền truy cập không kiểm soát vào máy tính và thông tin đăng nhập của người dùng, vấn đề này dự kiến sẽ còn tiếp diễn. PPD cho biết thêm: "Các vụ án chưa có lời giải liên quan đến các nạn nhân thực sự, các gia đình đang đau buồn và các nhà điều tra đang nỗ lực tìm kiếm câu trả lời. Các công ty công nghệ phải thực hiện tất cả các bước thích hợp cần thiết để ngăn chặn hệ thống của họ gửi thông tin sai lệch cho cơ quan thực thi pháp luật". PPD cho biết Anthropic có kế hoạch công bố một báo cáo cung cấp thêm thông tin về vụ việc cũng như các trường hợp hành vi mô hình ngoài ý muốn khác vào thứ Sáu. 🗞 Nguồn: TechCrunch #vgsnews #vgs #tintuc
Nguồn: TechCrunch