CEO Anthropic nhận định đã đến lúc cần giảm tốc độ phát triển AI
CEO Anthropic Dario Amodei vừa đề xuất kế hoạch 3 bước nhằm làm chậm quá trình phát triển AI để đảm bảo an toàn. Ông cảnh báo về nguy cơ AI tự cải thiện đệ quy và những sự cố hành vi bất thường từ các mô hình hiện nay.

CEO Anthropic, ông Dario Amodei, cho biết đã đến lúc cần phải làm chậm lại tốc độ phát triển trí tuệ nhân tạo (AI) và sẽ cấp quyền cho các bên đánh giá độc lập bên thứ ba như METR tiếp cận các mô hình của họ nhằm giúp đảm bảo "sự tuân thủ các quy tắc và cam kết an toàn". Trong một bài tiểu luận dài, Amodei đã đề xuất kế hoạch ba bước để "điều tiết giới hạn" — một thuật ngữ đơn giản có nghĩa là làm chậm tiến độ đào tạo và phát triển để cho các công ty có thời gian xây dựng các biện pháp bảo vệ và giúp các cơ quan quản lý đánh giá mô hình.
Amodei cho biết việc cấp quyền tiếp cận rộng rãi cho các bên đánh giá ngoài mới chỉ là bước đầu tiên và là bước mà họ đang tự thực hiện đơn phương. Bước thứ hai sẽ liên quan đến việc toàn bộ ngành công nghiệp cùng nhau hợp tác, có khả năng với các cơ quan chính phủ để "thiết lập các tiêu chuẩn an toàn chung cũng như giới hạn đối với tốc độ tiến bộ AI không được kiểm soát". Bước này sẽ tập trung vào các công ty AI hoạt động tại các quốc gia dân chủ, nhưng vì việc thông qua luật pháp và xây dựng cơ sở hạ tầng quản lý mất thời gian, Amodei cho rằng ngành công nghiệp nên phối hợp cùng nhau để tạo ra các tiêu chuẩn an toàn.
Bước thứ ba sẽ là thử thách nhất — đó là thuyết phục các chính phủ độc tài như Trung Quốc và Nga đồng ý làm chậm quá trình phát triển và áp dụng một bộ tiêu chuẩn an toàn AI toàn cầu. Tuy nhiên, ông cũng nhấn mạnh rằng việc Mỹ và các quốc gia dân chủ khác duy trì lợi thế công nghệ trước Trung Quốc và các chế độ độc tài khác là điều tối quan trọng, thông qua việc hạn chế quyền tiếp cận của họ đối với các loại chip hiệu năng cao và trấn áp các phương pháp như chưng cất mô hình (distillation), vốn cho phép các công ty nhanh chóng bắt kịp bằng cách huấn luyện AI sao chép hành vi của một mô hình mạnh mẽ hơn.
Amodei cho biết mối lo ngại của ông xuất phát từ hai yếu tố chính. Đầu tiên là sự xuất hiện của khả năng tự cải thiện đệ quy (recursive self-improvement - RSI), trong đó hệ thống AI tự huấn luyện thế hệ AI tiếp theo, dẫn đến năng lực tăng tốc chóng mặt. Ông cho biết: "Nếu không được kiểm soát, nó có thể vượt xa khả năng thấu hiểu và kiểm soát của chúng ta đối với các hệ thống này." Yếu tố thứ hai là sự cố OpenAI / Hugging Face vào mùa hè này, trong đó "một bầy tác nhân (agent) về cơ bản hoạt động như một tập thể tận tụy đến mức cực đoan, thực hiện các cuộc tấn công an ninh mạng vào các mục tiêu mà chúng không được yêu cầu tấn công và không liên quan đến nhiệm vụ trước mắt, hy sinh bản thân vì sự thành công của nhóm, và cố gắng hack vào hệ thống 'chấm điểm' chịu trách nhiệm đánh giá hiệu suất của chúng."
Tất nhiên, mẫu AI Claude của Anthropic cũng từng gây ra một chuỗi các sự cố AI tự ý hack gần đây khiến công ty này rơi vào tâm điểm chú ý.
🌐 CEO ANTHROPIC NHẬN ĐỊNH ĐÃ ĐẾN LÚC CẦN GIẢM TỐC ĐỘ PHÁT TRIỂN AI CEO Anthropic, ông Dario Amodei, cho biết đã đến lúc cần phải làm chậm lại tốc độ phát triển trí tuệ nhân tạo (AI) và sẽ cấp quyền cho các bên đánh giá độc lập bên thứ ba như METR tiếp cận các mô hình của họ nhằm giúp đảm bảo "sự tuân thủ các quy tắc và cam kết an toàn". Trong một bài tiểu luận dài, Amodei đã đề xuất kế hoạch ba bước để "điều tiết giới hạn" — một thuật ngữ đơn giản có nghĩa là làm chậm tiến độ đào tạo và phát triển để cho các công ty có thời gian xây dựng các biện pháp bảo vệ và giúp các cơ quan quản lý đánh giá mô hình. Amodei cho biết việc cấp quyền tiếp cận rộng rãi cho các bên đánh giá ngoài mới chỉ là bước đầu tiên và là bước mà họ đang tự thực hiện đơn phương. Bước thứ hai sẽ liên quan đến việc toàn bộ ngành công nghiệp cùng nhau hợp tác, có khả năng với các cơ quan chính phủ để "thiết lập các tiêu chuẩn an toàn chung cũng như giới hạn đối với tốc độ tiến bộ AI không được kiểm soát". Bước này sẽ tập trung vào các công ty AI hoạt động tại các quốc gia dân chủ, nhưng vì việc thông qua luật pháp và xây dựng cơ sở hạ tầng quản lý mất thời gian, Amodei cho rằng ngành công nghiệp nên phối hợp cùng nhau để tạo ra các tiêu chuẩn an toàn. Bước thứ ba sẽ là thử thách nhất — đó là thuyết phục các chính phủ độc tài như Trung Quốc và Nga đồng ý làm chậm quá trình phát triển và áp dụng một bộ tiêu chuẩn an toàn AI toàn cầu. Tuy nhiên, ông cũng nhấn mạnh rằng việc Mỹ và các quốc gia dân chủ khác duy trì lợi thế công nghệ trước Trung Quốc và các chế độ độc tài khác là điều tối quan trọng, thông qua việc hạn chế quyền tiếp cận của họ đối với các loại chip hiệu năng cao và trấn áp các phương pháp như chưng cất mô hình (distillation), vốn cho phép các công ty nhanh chóng bắt kịp bằng cách huấn luyện AI sao chép hành vi của một mô hình mạnh mẽ hơn. Amodei cho biết mối lo ngại của ông xuất phát từ hai yếu tố chính. Đầu tiên là sự xuất hiện của khả năng tự cải thiện đệ quy (recursive self-improvement - RSI), trong đó hệ thống AI tự huấn luyện thế hệ AI tiếp theo, dẫn đến năng lực tăng tốc chóng mặt. Ông cho biết: "Nếu không được kiểm soát, nó có thể vượt xa khả năng thấu hiểu và kiểm soát của chúng ta đối với các hệ thống này." Yếu tố thứ hai là sự cố OpenAI / Hugging Face vào mùa hè này, trong đó "một bầy tác nhân (agent) về cơ bản hoạt động như một tập thể tận tụy đến mức cực đoan, thực hiện các cuộc tấn công an ninh mạng vào các mục tiêu mà chúng không được yêu cầu tấn công và không liên quan đến nhiệm vụ trước mắt, hy sinh bản thân vì sự thành công của nhóm, và cố gắng hack vào hệ thống 'chấm điểm' chịu trách nhiệm đánh giá hiệu suất của chúng." Tất nhiên, mẫu AI Claude của Anthropic cũng từng gây ra một chuỗi các sự cố AI tự ý hack gần đây khiến công ty này rơi vào tâm điểm chú ý. 🗞 Nguồn: The Verge #vgsnews #vgs #tintuc
Nguồn: The Verge