Bản tin công nghệ quốc tế · dịch tiếng Việt 02.09.2026 RSS
AI & Dữ liệu · The Verge

OpenAI được cho là đã giải tán nhóm chuyên đánh giá rủi ro AI

OpenAI vừa giải tán nhóm chuyên trách đánh giá và giảm thiểu các rủi ro AI nghiêm trọng (Preparedness Team), đồng thời chuyển giao các nhiệm vụ này cho các bộ phận hiện có. Động thái này diễn ra trong bối cảnh công ty liên tục biến động nhân sự an toàn trước thềm đợt IPO lớn.

The Verge17.08.20261 phút đọc2 lượt đọc
Ảnh: The Verge

Theo tờ Financial Times, OpenAI đã giải tán nhóm phụ trách mức độ sẵn sàng ứng phó (preparedness team) vào cuối tháng trước. Nhiệm vụ của nhóm này là đánh giá xem các mô hình AI có gây ra rủi ro nghiêm trọng hay không và phát triển các biện pháp nhằm giảm thiểu rủi ro đó (chẳng hạn như khả năng AI vượt tầm kiểm soát và tấn công mạng một công ty khác). Financial Times cho biết trách nhiệm này hiện được chia nhỏ cho các lĩnh vực cụ thể như sinh học và an ninh mạng, sau đó chuyển giao cho các nhóm hiện có.

Đây là thay đổi mới nhất tại OpenAI, công ty đang trải qua nhiều biến động khi hướng tới đợt phát hành cổ phiếu lần đầu ra công chúng (IPO) được dự đoán là có quy mô khổng lồ. Trong vài năm qua, OpenAI đã dần thu hẹp mô hình tập trung vào nghiên cứu chuyên sâu, đồng thời giải thể các nhóm phụ trách mức độ sẵn sàng cho AGI (AGI readiness) và căn chỉnh siêu thông minh (superalignment). Trưởng nhóm đạo đức Chloé Bakalar, Giám đốc Tương lai học Josh Achiam và Trưởng bộ phận an toàn Johannes Heidecke đều đã rời đi gần đây. Điều này khiến một số nhà phê bình như Jan Leike, người đã từ chức khỏi OpenAI vào năm 2024, chia sẻ với Financial Times rằng công ty đang phớt lờ yếu tố an toàn để ưu tiên tạo ra "các sản phẩm hào nhoáng".

Trưởng nhóm Preparedness, Dylan Scandinaro, người vừa được chiêu mộ từ Anthropic vào tháng 2, giờ đây sẽ tập trung vào việc nghiên cứu những tác động của AI "tự cải tiến đệ quy" (recursive self-improving).

🔗 Bài gốc (tiếng Anh): OpenAI reportedly disbanded its preparedness team
Nguồn: The Verge

Cùng chuyên mục · AI & Dữ liệu
AI & Dữ liệu

Các mẫu mô hình Claude Fable và Mythos cập nhật mới tích hợp tính năng chìm ẩn trong câu trả lời

Anthropic vừa chính thức ra mắt các mẫu mô hình Claude Fable 5.1 và Mythos 5.1 với hiệu suất vượt trội và khả năng tự…

PCWorld · 3 phút đọc
AI & Dữ liệu

Anthropic ra mắt Claude Fable 5.1 và Mythos 5.1, Samsung chọn Claude Code cho thiết kế chip

Anthropic vừa tung ra các mô hình Claude Fable 5.1 và Mythos 5.1 với chi phí API rẻ hơn và hiệu năng vượt trội. Đồng…

Wccftech · 3 phút đọc
AI & Dữ liệu

OpenAI hoãn phát triển mô hình mới sau sự cố hack Hugging Face

OpenAI quyết định hoãn phát triển dòng mô hình mới mang tên Astra để củng cố các biện pháp an toàn. Động thái này diễn…

The Verge · 3 phút đọc