Bản tin công nghệ quốc tế · dịch tiếng Việt 10.10.2026 RSS
AI & Dữ liệu · TechCrunch

Mô hình AI của Anthropic gửi tin báo án mạng giả tới cảnh sát Philadelphia

Một mô hình AI của Anthropic đã tự động gửi thông tin sai lệch về một vụ án mạng chưa có lời giải đến đường dây nóng của cảnh sát Philadelphia trong quá trình thử nghiệm. Phía cảnh sát đã chỉ trích sự chậm trễ trong việc phát hiện và báo cáo sự cố từ phía công ty.

TechCrunch10.10.20263 phút đọc0 lượt đọc

Một mô hình AI của Anthropic đã gửi thông tin sai lệch về một vụ án mạng chưa được giải quyết cho cảnh sát Philadelphia. Theo báo cáo, AI này đã gửi thông tin không chính xác đến đường dây nóng của Sở Cảnh sát Philadelphia (PPD) vào ngày 18 tháng 7, nhưng Anthropic lại không phát hiện ra hành vi này cho đến tận ngày 28 tháng 9. Cảnh sát đã không nhìn thấy thông báo này vì nó bị đánh dấu là thư rác (spam). Anthropic đã thông báo cho PPD về vụ việc vào thứ Tư và có cuộc họp với sở cảnh sát vào ngày hôm sau. PPD cho biết trong một tuyên bố gửi tới hãng tin 6abc rằng: "Công ty phải tăng cường các biện pháp an toàn để ngăn chặn các sự cố tương tự tác động đến hệ thống của thành phố mà thành phố không hay biết. Việc chậm trễ hai tháng trong việc phát hiện và báo cáo sự cố cho Thành phố là điều không thể chấp nhận được". Anthropic không đưa ra bình luận ngay lập tức, nhưng PPD đã làm rõ hơn về vụ việc trong một thông cáo báo chí gửi qua email cho TechCrunch. PPD cho biết: "Theo Anthropic, mô hình của họ đang thực hiện một bài kiểm tra liên quan đến việc tương tác với các trang web được chọn ngẫu nhiên thì truy cập vào trang PhillyUnsolvedMurders.com và gửi thông tin sai lệch liên quan đến một vụ án mạng chưa có lời giải. Bài gửi mang mốc thời gian ngày 18 tháng 7 năm 2026, lúc 11:27 tối, giả vờ đến từ một người có thể có thông tin về vụ án". Khi các tác nhân AI tự động ngày càng được cung cấp rộng rãi cho người dùng, sự cố này làm nổi bật mối nguy hiểm khi trao cho AI khả năng thực hiện các tác vụ mà không có bất kỳ sự giám sát nào của con người. Giám đốc điều hành Anthropic, Dario Amodei, từng đặc biệt lên tiếng về niềm tin của ông rằng sự phát triển AI nên được làm chậm lại để các phòng thí nghiệm có thể triển khai các biện pháp bảo vệ đầy đủ. Có lẽ quan điểm này một phần xuất phát từ việc chứng kiến các công cụ của công ty mình gửi đi những tin báo án mạng sai sự thật. Những vấn đề này không chỉ riêng Anthropic gặp phải. Gần đây, OpenAI cũng tiết lộ rằng một trong các mô hình của họ đã hành xử bất ngờ trong một bài kiểm tra và tấn công nền tảng dữ liệu AI Hugging Face, làm lộ ra các lỗ hổng nghiêm trọng trong phần mềm của họ. Khi các mô hình AI tiếp tục được cấp quyền truy cập không kiểm soát vào máy tính và thông tin đăng nhập của người dùng, vấn đề này dự kiến sẽ còn tiếp diễn. PPD cho biết thêm: "Các vụ án chưa có lời giải liên quan đến các nạn nhân thực sự, các gia đình đang đau buồn và các nhà điều tra đang nỗ lực tìm kiếm câu trả lời. Các công ty công nghệ phải thực hiện tất cả các bước thích hợp cần thiết để ngăn chặn hệ thống của họ gửi thông tin sai lệch cho cơ quan thực thi pháp luật". PPD cho biết Anthropic có kế hoạch công bố một báo cáo cung cấp thêm thông tin về vụ việc cũng như các trường hợp hành vi mô hình ngoài ý muốn khác vào thứ Sáu.

🔗 Bài gốc (tiếng Anh): An Anthropic AI model sent a false homicide tip to Philadelphia police
Nguồn: TechCrunch

Cùng chuyên mục · AI & Dữ liệu
AI & Dữ liệu

Toà án toán học chấn động: Giới toán gia sẽ mất nhiều năm để giải mã loạt kết quả AI mới từ OpenAI

OpenAI vừa bất ngờ tung ra gần 400 kết quả toán học do AI tạo ra nằm trong hơn 700 bản thảo, bao gồm nhiều lĩnh vực…

The Verge · 10 phút đọc
🚀 VGSNews
AI & Dữ liệu

Amazon dừng sử dụng thỏa thuận bảo mật khi đàm phán trung tâm dữ liệu

Amazon tuyên bố sẽ chấm dứt việc sử dụng thỏa thuận bảo mật (NDA) khi đàm phán các thỏa thuận trung tâm dữ liệu với…

TechCrunch · 1 phút đọc
🚀 VGSNews
AI & Dữ liệu

LumenUs: Ứng dụng AI giúp tự động hóa thủ tục hành chính khi người thân qua đời

LumenUs là nền tảng chăm sóc nỗi đau sử dụng AI để tự động hóa các thủ tục giấy tờ phức tạp sau khi mất đi người thân.…

TechCrunch · 3 phút đọc