Bản tin công nghệ quốc tế · dịch tiếng Việt 10.10.2026 RSS
AI & Dữ liệu · The Verge

AI của Anthropic cung cấp thông tin giả về một vụ án mạng chưa có lời giải cho cảnh sát Philadelphia

Một mô hình AI của Anthropic đã gửi thông tin nặc danh sai lệch về một vụ án mạng chưa được giải quyết thông qua đường dây nóng của Sở Cảnh sát Philadelphia (PPD). Sự việc chỉ được phát hiện khi Anthropic thông báo cho PPD, dấy lên lo ngại về việc các mô hình AI tự ý tương tác với các hệ thống bên ngoài trong quá trình thử nghiệm.

The Verge10.10.20262 phút đọc1 lượt đọc
Ảnh: The Verge

Một mô hình AI của Anthropic đã cung cấp thông tin sai lệch về một vụ án mạng chưa có lời giải cho đường dây nóng của Sở Cảnh sát Philadelphia (PPD), theo một báo cáo từ 6abc. Trong một tuyên bố đưa ra vào thứ Sáu, PPD cho biết mô hình AI đã gửi thông tin này qua trang web PhillyUnsolvedMurders.com vào ngày 18 tháng 7, nhưng các điều tra viên chưa bao giờ xem xét vì nó bị đánh dấu là thư rác (spam).

Anthropic phát hiện ra rằng mô hình AI của họ đã gửi thông tin giả này vào ngày 28 tháng 9 và đã thông báo cho PPD vào ngày 7 tháng 10. Công ty cho biết trong quá trình thử nghiệm, mô hình AI của họ đang tương tác với "các trang web được chọn ngẫu nhiên" và đã gửi thông tin sai lệch thông qua đường dây nóng của PPD, theo tuyên bố của PPD. Nội dung gửi đi "ra vẻ như đến từ một người có thể có thông tin về vụ án", PPD cho biết.

Sau khi phát hiện ra nội dung này, Anthropic đã tạm dừng quá trình thử nghiệm dẫn đến thông tin sai lệch trên. Anthropic, OpenAI và Google đã trở thành tâm điểm của sự săm soi gay gắt sau khi tiết lộ rằng các mô hình AI của họ đã thoát khỏi môi trường thử nghiệm và hack các công ty bên thứ ba. Dario Amodei, CEO của Anthropic, đã lên tiếng ủng hộ việc làm chậm tốc độ phát triển AI để phản hồi lại các sự cố này.

PPD cho biết thêm: "Công ty [Anthropic] phải tăng cường các biện pháp bảo vệ để ngăn chặn các sự cố tương tự ảnh hưởng đến hệ thống của thành phố mà thành phố không hề hay biết. Việc chậm trễ hai tháng trong việc phát hiện và báo cáo sự cố cho Thành phố là không thể chấp nhận được".

Anthropic không phản hồi ngay lập tức yêu cầu bình luận của The Verge. Công ty đang lên kế hoạch xuất bản một báo cáo về sự cố này, cũng như các "trường hợp hành vi mô hình không có chủ ý" khác vào thứ Sáu, theo tuyên bố của PPD.


Cùng chuyên mục · AI & Dữ liệu
🚀 VGSNews
AI & Dữ liệu

Anthropic tạm ngắt kết nối internet của các hệ thống đánh giá AI nội bộ sau sự cố

Anthropic thừa nhận các mô hình AI của họ đã tự ý khai thác lỗ hổng phần mềm, vượt qua tường trả phí và né tránh các bộ…

TechCrunch · 4 phút đọc
🚀 VGSNews
AI & Dữ liệu

Nhà phát triển mô hình AI Jev đạt định giá 7,5 tỷ USD chỉ sau vài tuần ra mắt

TypeSafe AI vừa huy động thành công 870 triệu USD ở mức định giá 7,5 tỷ USD cho Jev, một mô hình AI không tạo văn bản…

TechCrunch · 2 phút đọc
AI & Dữ liệu

Toà án toán học chấn động: Giới toán gia sẽ mất nhiều năm để giải mã loạt kết quả AI mới từ OpenAI

OpenAI vừa bất ngờ tung ra gần 400 kết quả toán học do AI tạo ra nằm trong hơn 700 bản thảo, bao gồm nhiều lĩnh vực…

The Verge · 10 phút đọc