Bản tin công nghệ quốc tế · dịch tiếng Việt 13.09.2026 RSS
AI & Dữ liệu · The Verge

CEO Anthropic nhận định đã đến lúc cần giảm tốc độ phát triển AI

CEO Anthropic Dario Amodei vừa đề xuất kế hoạch 3 bước nhằm làm chậm quá trình phát triển AI để đảm bảo an toàn. Ông cảnh báo về nguy cơ AI tự cải thiện đệ quy và những sự cố hành vi bất thường từ các mô hình hiện nay.

The Verge12.09.20263 phút đọc0 lượt đọc
Ảnh: The Verge

CEO Anthropic, ông Dario Amodei, cho biết đã đến lúc cần phải làm chậm lại tốc độ phát triển trí tuệ nhân tạo (AI) và sẽ cấp quyền cho các bên đánh giá độc lập bên thứ ba như METR tiếp cận các mô hình của họ nhằm giúp đảm bảo "sự tuân thủ các quy tắc và cam kết an toàn". Trong một bài tiểu luận dài, Amodei đã đề xuất kế hoạch ba bước để "điều tiết giới hạn" — một thuật ngữ đơn giản có nghĩa là làm chậm tiến độ đào tạo và phát triển để cho các công ty có thời gian xây dựng các biện pháp bảo vệ và giúp các cơ quan quản lý đánh giá mô hình.

Amodei cho biết việc cấp quyền tiếp cận rộng rãi cho các bên đánh giá ngoài mới chỉ là bước đầu tiên và là bước mà họ đang tự thực hiện đơn phương. Bước thứ hai sẽ liên quan đến việc toàn bộ ngành công nghiệp cùng nhau hợp tác, có khả năng với các cơ quan chính phủ để "thiết lập các tiêu chuẩn an toàn chung cũng như giới hạn đối với tốc độ tiến bộ AI không được kiểm soát". Bước này sẽ tập trung vào các công ty AI hoạt động tại các quốc gia dân chủ, nhưng vì việc thông qua luật pháp và xây dựng cơ sở hạ tầng quản lý mất thời gian, Amodei cho rằng ngành công nghiệp nên phối hợp cùng nhau để tạo ra các tiêu chuẩn an toàn.

Bước thứ ba sẽ là thử thách nhất — đó là thuyết phục các chính phủ độc tài như Trung Quốc và Nga đồng ý làm chậm quá trình phát triển và áp dụng một bộ tiêu chuẩn an toàn AI toàn cầu. Tuy nhiên, ông cũng nhấn mạnh rằng việc Mỹ và các quốc gia dân chủ khác duy trì lợi thế công nghệ trước Trung Quốc và các chế độ độc tài khác là điều tối quan trọng, thông qua việc hạn chế quyền tiếp cận của họ đối với các loại chip hiệu năng cao và trấn áp các phương pháp như chưng cất mô hình (distillation), vốn cho phép các công ty nhanh chóng bắt kịp bằng cách huấn luyện AI sao chép hành vi của một mô hình mạnh mẽ hơn.

Amodei cho biết mối lo ngại của ông xuất phát từ hai yếu tố chính. Đầu tiên là sự xuất hiện của khả năng tự cải thiện đệ quy (recursive self-improvement - RSI), trong đó hệ thống AI tự huấn luyện thế hệ AI tiếp theo, dẫn đến năng lực tăng tốc chóng mặt. Ông cho biết: "Nếu không được kiểm soát, nó có thể vượt xa khả năng thấu hiểu và kiểm soát của chúng ta đối với các hệ thống này." Yếu tố thứ hai là sự cố OpenAI / Hugging Face vào mùa hè này, trong đó "một bầy tác nhân (agent) về cơ bản hoạt động như một tập thể tận tụy đến mức cực đoan, thực hiện các cuộc tấn công an ninh mạng vào các mục tiêu mà chúng không được yêu cầu tấn công và không liên quan đến nhiệm vụ trước mắt, hy sinh bản thân vì sự thành công của nhóm, và cố gắng hack vào hệ thống 'chấm điểm' chịu trách nhiệm đánh giá hiệu suất của chúng."

Tất nhiên, mẫu AI Claude của Anthropic cũng từng gây ra một chuỗi các sự cố AI tự ý hack gần đây khiến công ty này rơi vào tâm điểm chú ý.

🔗 Bài gốc (tiếng Anh): Anthropic CEO says it’s time to pump the brakes on AI
Nguồn: The Verge

Cùng chuyên mục · AI & Dữ liệu
AI & Dữ liệu

Chính quyền Trump nới lỏng quy định môi trường để thúc đẩy trung tâm dữ liệu AI

Nhiều cựu quan chức EPA cảnh báo chính quyền Tổng thống Trump đang làm suy yếu các quy định môi trường nhằm đẩy nhanh…

The Verge · 7 phút đọc
AI & Dữ liệu

Iran và lực lượng Houthi bị phát hiện dùng AI Claude để nhắm mục tiêu tàu chiến Mỹ và phát triển tên lửa siêu vượt âm

Báo cáo đe dọa tháng 9/2026 của Anthropic tiết lộ các nhóm liên kết với Iran và phiến quân Houthi đã sử dụng mô hình AI…

Tom's Hardware · 4 phút đọc
🚀 VGSNews
AI & Dữ liệu

CEO Anthropic đề xuất chiến lược làm chậm tốc độ phát triển AI tiên tiến

CEO Anthropic Dario Amodei vừa phác thảo ba chiến lược để kìm hãm sự bùng nổ của AI tiên tiến, trong đó công ty cam kết…

TechCrunch · 6 phút đọc