Meta triển khai công cụ AI mới nhằm phát hiện quảng cáo ẩn chứa nội dung lạm dụng trẻ em
Meta cho biết đã xử lý hơn 33 triệu nội dung bóc lột tình dục trẻ em trên Facebook và Instagram trong nửa đầu năm 2026. Công ty cũng đang tích hợp các công cụ AI mới để phát hiện các quảng cáo và tài khoản chuyển hướng người dùng ngầm đến các tài liệu bất hợp pháp này.
Meta thông báo vào thứ Tư rằng họ đã xử lý 33,2 triệu mảnh nội dung bóc lột tình dục trẻ em trên Facebook và Instagram trong nửa đầu năm 2026. Đồng thời, công ty đang triển khai các công cụ AI mới để tìm kiếm các quảng cáo và tài khoản có thể được sử dụng để ngầm chuyển hướng người dùng đến tài liệu lạm dụng trẻ em trái phép.
Hơn 97% nội dung mà Meta xử lý đã được hệ thống của họ phát hiện trước khi người dùng báo cáo, công ty cho biết. Tại Ấn Độ, Meta đã xử lý 5,3 triệu nội dung bóc lột tình dục trẻ em trong cùng kỳ, với hơn 98% được phát hiện trước khi có báo cáo từ người dùng.
Meta cho biết các công cụ AI mới nhất của họ nhằm vào những kẻ sử dụng quảng cáo trông có vẻ vô hại để đưa người dùng đến các nội dung bất hợp pháp bên ngoài nền tảng của Meta.
Công ty đã giới thiệu một hệ thống mô hình ngôn ngữ lớn (LLM) mới để phát hiện cái gọi là "signposting" (dấu hiệu dẫn đường). Điều này đề cập đến các quảng cáo có vẻ bình thường nhưng bị nghi ngờ chuyển hướng người dùng đến nội dung bất hợp pháp hoặc các hoạt động có hại khác ở nơi khác trên mạng. Meta cho biết đây là chiến thuật mà họ gần đây đã chứng kiến những kẻ xấu sử dụng khi chúng liên tục thay đổi phương thức để tránh bị phát hiện. Mặc dù bản thân các quảng cáo có thể không chứa tài liệu bất hợp pháp, nhưng chúng vẫn có thể đóng vai trò là cửa ngõ dẫn đến các trang web lưu trữ nội dung lạm dụng tình dục trẻ em.
Do đó, Meta cho biết họ hiện đang xem xét nơi một quảng cáo chuyển hướng người dùng đến, chứ không chỉ nội dung bên trong quảng cáo đó. Công ty có thể sử dụng thông tin này để chặn các trang web hoặc điểm đến khác vi phạm quy tắc của mình và xử lý các tài khoản đứng sau chúng.
Meta cũng đang sử dụng các hình thức quét bổ sung dựa trên AI để tìm kiếm nội dung bóc lột trẻ em mà các hệ thống trước đó có thể đã bỏ sót. Công ty cho biết họ sẽ tiếp tục bổ sung các tín hiệu mới khi hiểu rõ hơn về cách thức hoạt động của các mạng lưới này.
Một công cụ mới khác là "tác nhân AI thử nghiệm đối kháng" (red-teaming AI agent) dùng để kiểm tra các biện pháp an toàn của chính Meta. Công cụ này tìm kiếm các điểm yếu mà kẻ xấu có thể khai thác để vượt qua các lớp bảo vệ của công ty. Meta cho biết điều này có thể giúp họ tìm ra các phương thức lạm dụng mới trước khi chúng trở nên phổ biến hơn.
Ngoài ra, công ty cũng đang cải thiện các hệ thống nhằm phát hiện những kẻ quay lại nền tảng bằng tài khoản mới sau khi tài khoản trước đó của họ đã bị gỡ bỏ.
Các biện pháp mới được đưa ra trong bối cảnh Meta tiếp tục đối mặt với áp lực về sự an toàn của trẻ em trên các nền tảng của hãng. Công ty từng phải đối mặt với các vụ kiện và chỉ trích từ các nhà lập pháp liên quan đến rủi ro mà các dịch vụ mạng xã hội có thể gây ra cho người dùng trẻ tuổi. Vào tháng 8, Meta đã đạt được thỏa thuận chi trả tới 18 tỷ USD để giải quyết một vụ kiện về an toàn trẻ em liên quan đến 29 tiểu bang của Mỹ, giải quyết các lo ngại về việc bảo vệ trẻ em trực tuyến.
Trong năm nay, Meta đã giới thiệu một số tính năng an toàn cho trẻ em, bao gồm quyền kiểm soát của phụ huynh đối với Meta AI, tài khoản dành cho lứa tuổi tiền vị thành niên trên WhatsApp, và các cảnh báo dành cho phụ huynh khi trẻ em tìm kiếm nội dung tự hại trên Instagram.
Vào tháng 9, WhatsApp đã bổ sung thêm nhiều quyền kiểm soát cho phụ huynh. Họ có thể giới hạn cách thanh thiếu niên sử dụng Channels, kiểm soát ai có thể xem cập nhật trạng thái và quyết định ai có thể thêm con cái họ vào các nhóm. Phụ huynh cũng có thể chọn nhận thông báo về hoạt động nhóm cụ thể.
🚀 META TRIỂN KHAI CÔNG CỤ AI MỚI NHẰM PHÁT HIỆN QUẢNG CÁO ẨN CHỨA NỘI DUNG LẠM DỤNG TRẺ EM Meta thông báo vào thứ Tư rằng họ đã xử lý 33,2 triệu mảnh nội dung bóc lột tình dục trẻ em trên Facebook và Instagram trong nửa đầu năm 2026. Đồng thời, công ty đang triển khai các công cụ AI mới để tìm kiếm các quảng cáo và tài khoản có thể được sử dụng để ngầm chuyển hướng người dùng đến tài liệu lạm dụng trẻ em trái phép. Hơn 97% nội dung mà Meta xử lý đã được hệ thống của họ phát hiện trước khi người dùng báo cáo, công ty cho biết. Tại Ấn Độ, Meta đã xử lý 5,3 triệu nội dung bóc lột tình dục trẻ em trong cùng kỳ, với hơn 98% được phát hiện trước khi có báo cáo từ người dùng. Meta cho biết các công cụ AI mới nhất của họ nhằm vào những kẻ sử dụng quảng cáo trông có vẻ vô hại để đưa người dùng đến các nội dung bất hợp pháp bên ngoài nền tảng của Meta. Công ty đã giới thiệu một hệ thống mô hình ngôn ngữ lớn (LLM) mới để phát hiện cái gọi là "signposting" (dấu hiệu dẫn đường). Điều này đề cập đến các quảng cáo có vẻ bình thường nhưng bị nghi ngờ chuyển hướng người dùng đến nội dung bất hợp pháp hoặc các hoạt động có hại khác ở nơi khác trên mạng. Meta cho biết đây là chiến thuật mà họ gần đây đã chứng kiến những kẻ xấu sử dụng khi chúng liên tục thay đổi phương thức để tránh bị phát hiện. Mặc dù bản thân các quảng cáo có thể không chứa tài liệu bất hợp pháp, nhưng chúng vẫn có thể đóng vai trò là cửa ngõ dẫn đến các trang web lưu trữ nội dung lạm dụng tình dục trẻ em. Do đó, Meta cho biết họ hiện đang xem xét nơi một quảng cáo chuyển hướng người dùng đến, chứ không chỉ nội dung bên trong quảng cáo đó. Công ty có thể sử dụng thông tin này để chặn các trang web hoặc điểm đến khác vi phạm quy tắc của mình và xử lý các tài khoản đứng sau chúng. Meta cũng đang sử dụng các hình thức quét bổ sung dựa trên AI để tìm kiếm nội dung bóc lột trẻ em mà các hệ thống trước đó có thể đã bỏ sót. Công ty cho biết họ sẽ tiếp tục bổ sung các tín hiệu mới khi hiểu rõ hơn về cách thức hoạt động của các mạng lưới này. Một công cụ mới khác là "tác nhân AI thử nghiệm đối kháng" (red-teaming AI agent) dùng để kiểm tra các biện pháp an toàn của chính Meta. Công cụ này tìm kiếm các điểm yếu mà kẻ xấu có thể khai thác để vượt qua các lớp bảo vệ của công ty. Meta cho biết điều này có thể giúp họ tìm ra các phương thức lạm dụng mới trước khi chúng trở nên phổ biến hơn. Ngoài ra, công ty cũng đang cải thiện các hệ thống nhằm phát hiện những kẻ quay lại nền tảng bằng tài khoản mới sau khi tài khoản trước đó của họ đã bị gỡ bỏ. Các biện pháp mới được đưa ra trong bối cảnh Meta tiếp tục đối mặt với áp lực về sự an toàn của trẻ em trên các nền tảng của hãng. Công ty từng phải đối mặt với các vụ kiện và chỉ trích từ các nhà lập pháp liên quan đến rủi ro mà các dịch vụ mạng xã hội có thể gây ra cho người dùng trẻ tuổi. Vào tháng 8, Meta đã đạt được thỏa thuận chi trả tới 18 tỷ USD để giải quyết một vụ kiện về an toàn trẻ em liên quan đến 29 tiểu bang của Mỹ, giải quyết các lo ngại về việc bảo vệ trẻ em trực tuyến. Trong năm nay, Meta đã giới thiệu một số tính năng an toàn cho trẻ em, bao gồm quyền kiểm soát của phụ huynh đối với Meta AI, tài khoản dành cho lứa tuổi tiền vị thành niên trên WhatsApp, và các cảnh báo dành cho phụ huynh khi trẻ em tìm kiếm nội dung tự hại trên Instagram. Vào tháng 9, WhatsApp đã bổ sung thêm nhiều quyền kiểm soát cho phụ huynh. Họ có thể giới hạn cách thanh thiếu niên sử dụng Channels, kiểm soát ai có thể xem cập nhật trạng thái và quyết định ai có thể thêm con cái họ vào các nhóm. Phụ huynh cũng có thể chọn nhận thông báo về hoạt động nhóm cụ thể. 🗞 Nguồn: TechCrunch #vgsnews #vgs #tintuc
Nguồn: TechCrunch