Bản tin công nghệ quốc tế · dịch tiếng Việt 06.09.2026 RSS
AI & Dữ liệu · TechCrunch

OpenAI thừa nhận sự cố AI tự ý chiếm quyền diễn đàn wiki và lên kế hoạch minh bạch hóa mới

OpenAI đã chính thức thừa nhận vụ việc các tác nhân AI tự thoát khỏi môi trường thử nghiệm và chiếm quyền một diễn đàn wiki tại Đức. Công ty cho biết họ đang xây dựng một bộ khung mới để minh bạch hóa tốt hơn về các hành vi bất ngờ của AI.

TechCrunch06.09.20263 phút đọc3 lượt đọc

OpenAI đã thừa nhận vai trò của mình trong một sự cố được báo cáo gần đây, trong đó các tác nhân AI đã chiếm quyền một diễn đàn wiki của Đức. Công ty cũng cho biết đã đến lúc phải "xác định các tiêu chuẩn" xung quanh cách họ chia sẻ thông tin về các sự cố khi công nghệ của họ hành xử theo những cách không mong đợi.

Trong một bài đăng trên X, OpenAI cho biết trước đây họ "coi sự lệch hướng [khi các mô hình và tác nhân AI theo đuổi các mục tiêu khác với người tạo ra và người dùng] phần lớn là một vấn đề nghiên cứu, được truyền thông qua các ấn phẩm nghiên cứu." Nhưng khi sự lệch hướng đã "gây ra các tác động thực tế kiểu mới," công ty cho biết cách tiếp cận của họ cần phải "mở rộng cho giai đoạn năng lực mô hình mới này."

Vào thứ Sáu, Reuters đưa tin rằng các tác nhân của OpenAI đã thoát khỏi môi trường thử nghiệm và "hijack" một diễn đàn wiki ít tên tuổi của Đức, biến nó thành một bảng thông điệp cho các tác nhân khác. Báo cáo cũng cho biết lãnh đạo OpenAI đã biết về sự cố từ nhiều tuần trước nhưng giữ kín khi công ty đang phải xử lý hậu quả từ một sự cố riêng biệt, nơi các tác nhân OpenAI tấn công các máy chủ Hugging Face. (Tổng chưởng lý California Rob Bonta được cho là đang điều tra vụ hack này).

Một phát ngôn viên của công ty nói với Reuters rằng OpenAI không thể "phản hồi có ý nghĩa đối với các khiếu nại hoặc phát hiện trên một báo cáo mà chúng tôi chưa có cơ hội xem xét," nhưng họ khẳng định rằng đội ngũ pháp lý của công ty không hề ngăn cản một cuộc điều tra.

Trong bài đăng trên mạng xã hội gần đây hơn, OpenAI cho biết họ coi "sự cố wiki" là "một trường hợp lệch hướng tương tự" với những trường hợp khác mà họ từng chia sẻ. Công ty đối lập điều này với "sự cố Hugging Face," nơi họ "tuân theo một sổ tay ứng phó sự cố bảo mật truyền thống."

Trong một cuộc họp báo với truyền thông trong tuần này, Jacob Steinhardt, nhà sáng lập kiêm CEO của phòng thí nghiệm nghiên cứu phi lợi nhuận Transluce, nói với các phóng viên rằng các công cụ đang được phát triển và thử nghiệm bởi các phòng thí nghiệm AI là "về cơ bản rất khó kiểm soát và có nguy cơ đáng kể rò rỉ ra khỏi phòng thí nghiệm." Do đó, Steinhardt lập luận, "Chúng ta cần áp dụng cho công nghệ này ít nhất các tiêu chuẩn tương tự như các nghiên cứu khoa học rủi ro cao khác."

Tuyên bố của OpenAI cũng ám chỉ sự cần thiết phải có nhiều tiêu chuẩn hơn, nêu rõ rằng cả OpenAI và "cộng đồng AI lớn hơn chưa có một tiêu chuẩn rõ ràng về cách báo cáo sự lệch hướng xuất hiện trong quá trình đào tạo, đánh giá và triển khai, bao gồm các ví dụ không giống như các sự cố bảo mật truyền thống nhưng có thể cung cấp cái nhìn sâu sắc về hành vi của AI và các rủi ro trong tương lai."

Trong khi chưa có tiêu chuẩn đó, OpenAI cho biết họ đang "làm việc trên một bộ khung và sẽ chia sẻ nó trong những tuần tới, đồng thời chúng tôi cũng đang làm việc song song với hàng chục cơ quan quản lý chính phủ trên toàn thế giới về các vấn đề này."

OpenAI không phải là công ty AI duy nhất đối mặt với những vấn đề này, khi cả Meta và Anthropic đều thừa nhận các sự cố trong đó các tác nhân của họ có hành vi sai lệch.


Cùng chuyên mục · AI & Dữ liệu
🚀 VGSNews
AI & Dữ liệu

Nhóm leo núi được giải cứu sau khi dùng Google Gemini lên kế hoạch

Ba người trẻ tuổi đã phải gọi cứu hộ tại ngọn núi Mount Shasta ở California sau khi thực hiện chuyến đi dựa trên kế…

TechCrunch · 1 phút đọc
AI & Dữ liệu

OpenAI ra mắt GPT-6 Astra: Phiên bản AI mang cảnh báo 'Kẻ hủy diệt'

OpenAI phát hiện GPT-6 Astra sở hữu sức mạnh vượt trội tiềm ẩn nguy cơ an ninh nghiêm trọng nếu thiếu các biện pháp…

Notebookcheck · 3 phút đọc
🚀 VGSNews
AI & Dữ liệu

Nhà cung cấp hạ tầng AI Nscale tìm kiếm khoản tài trợ 3,5 tỷ USD trước thềm IPO

Công ty hạ tầng AI Nscale của Anh đang đàm phán huy động thêm 3,5 tỷ USD thông qua trái phiếu chuyển đổi và nguồn vốn…

TechCrunch · 2 phút đọc