Bản tin công nghệ quốc tế · dịch tiếng Việt 13.09.2026 RSS
AI & Dữ liệu · TechCrunch

CEO Anthropic đề xuất chiến lược làm chậm tốc độ phát triển AI tiên tiến

CEO Anthropic Dario Amodei vừa phác thảo ba chiến lược để kìm hãm sự bùng nổ của AI tiên tiến, trong đó công ty cam kết đơn phương thực hiện việc đưa các chuyên gia đánh giá độc lập vào nội bộ. Ông cũng nhấn mạnh tầm quan trọng của việc phối hợp an toàn giữa các quốc gia dân chủ và thiết lập quy chuẩn để tránh rủi ro hệ thống.

TechCrunch12.09.20266 phút đọc2 lượt đọc

Chúng ta đã chứng kiến ngày càng nhiều cảnh báo nghiêm trọng từ các nhà nghiên cứu AI về sự nguy hiểm của trí tuệ nhân tạo, và thậm chí cả bình luận từ CEO OpenAI Sam Altman rằng có lẽ đã đến lúc "kìm nhịp" sự phát triển của AI. Nhưng điều đó thực sự sẽ trông như thế nào?

Trong một bài đăng trên blog mới đây, CEO Anthropic Dario Amodei không chỉ hưởng ứng lời kêu gọi "kìm nhịp công nghệ tiên tiến" mà còn phác thảo ba chiến lược rộng lớn để thực hiện điều đó. Ông cho biết Anthropic đang "đơn phương cam kết" thực hiện một trong số các chiến lược này.

Cuộc tranh luận về sự an toàn và căn chỉnh của AI đã trở nên căng thẳng hơn trong tuần này sau khi nhà nghiên cứu Jacob Coxon viết rằng ông từ chức khỏi Anthropic vì lo ngại rằng các công ty AI hàng đầu đang "đánh bạc với mạng sống của chúng ta" trong khi những người xây dựng công nghệ này "thành tâm tin rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ này", một tuyên bố được lặp lại bởi những người khác tại Anthropic.

Bài viết của Amodei không đề cập trực tiếp đến việc từ chức của Coxon hay những lo ngại của ông, nhưng CEO này viết rằng hai điều đã thuyết phục ông rằng đã đến lúc phải áp dụng một cách tiếp cận thận trọng hơn đối với sự phát triển của AI: vụ hack OpenAI-HuggingFace, và thực tế là "AI đã tiến bộ nhanh hơn đáng kể" trong những tháng gần đây, đặc biệt là với "khả năng ngày càng tăng trong việc xây dựng thế hệ AI tiếp theo".

Amodei viết: "Chúng ta phải làm chậm tốc độ cải thiện năng lực của các mô hình AI. Tiến trình sẽ vẫn có vẻ nhanh, và chúng ta phải tận dụng khôn ngoan thời gian có được."

Bước đầu tiên ông đề xuất sẽ liên quan đến các "đánh giá viên nhúng" từ các tổ chức bên thứ ba như METR — những người đánh giá có thể xác minh rằng các công ty AI thực sự tuân thủ các cam kết về nhịp độ và an toàn của họ, đồng thời có thể đảm bảo rằng các sự cố an toàn được báo cáo. (OpenAI gần đây đã bị chỉ trích vì không báo cáo một sự cố nơi các tác nhân AI của họ chiếm quyền kiểm soát một trang wiki của Đức).

Amodei so sánh những người đánh giá này với các cơ quan quản lý được nhúng cùng nhân viên ngân hàng, và ông cho biết việc mời họ vào là "điều mà Anthropic đang đơn phương cam kết (và kêu gọi các chính phủ yêu cầu các công ty tiên tiến khác làm theo)". Điều đó có nghĩa là cung cấp cho người đánh giá huy hiệu công ty, bàn làm việc và máy tính xách tay, đồng thời cung cấp quyền truy cập "hầu như có thể so sánh với những gì các nhóm đánh giá rủi ro nội bộ có", với các ngoại lệ khi pháp luật hoặc hợp đồng yêu cầu.

Tiếp theo, Amodei kêu gọi các công ty AI hàng đầu "trong các quốc gia dân chủ" phối hợp "các tiêu chuẩn an toàn chung cũng như giới hạn về tốc độ tiến bộ AI không kiểm soát".

Sự phối hợp như vậy có vẻ khó xảy ra, cả do sự thù địch rõ ràng giữa Altman và Amodei và cũng bởi vì các công ty của họ được cho là lo lắng rằng việc tạm dừng phối hợp có thể dẫn đến sự giám sát chống độc quyền. Amodei ám chỉ đến mối lo ngại đó trong bài viết của mình, viết rằng "vì lý do chống độc quyền, chính phủ Mỹ sẽ hữu ích khi làm trung gian hoặc ít nhất là cho phép các cuộc thảo luận này — họ không cần phải tham gia, nhưng cần phải ban hành một lệnh miễn trừ hẹp cho một số loại trò chuyện an toàn nhất định".

Amodei cũng thừa nhận bóng ma về sự thống trị AI của Trung Quốc thường được nêu ra như một lập luận chống lại việc làm chậm phát triển. Nhưng ông cho biết nếu chính phủ Mỹ và các công ty công nghệ thực hiện các bước như từ chối bán chip mạnh mẽ hoặc thiết bị sản xuất chất bán dẫn cho các công ty Trung Quốc, cũng như trấn áp việc chắt lọc mô hình, họ có thể "làm chậm tiến độ của Trung Quốc đủ để nới rộng đáng kể vị trí dẫn đầu của Mỹ trong 3–5 năm tới".

Cuối cùng, Amodei kêu gọi "sự phối hợp toàn cầu", nơi Hoa Kỳ và các đồng minh của họ "cố gắng phối hợp với các chính phủ độc tài, trong phạm vi có thể". Amodei cho biết điều này có nghĩa là "hợp tác với Trung Quốc", và ông thừa nhận rằng có "những giới hạn rõ rệt về những gì có thể đạt được", nhưng ông vẫn gợi ý rằng có thể có cơ hội đạt được thỏa thuận, ngay cả khi đó chỉ là "cấm một số mục đích sử dụng AI hẹp và rõ ràng là nguy hiểm, chẳng hạn như sử dụng AI để sản xuất vũ khí sinh học hoặc cho phép người dùng làm như vậy".

Với việc Amodei sẵn sàng thừa nhận những mối nguy hiểm tiềm ẩn của AI trong quá khứ, và với sự cởi mở tương đối của công ty đối với các hình thức quản lý nhất định, một số người ủng hộ AI đã chỉ trích ông là kẻ gieo rắc sự diệt vong, người có những bình luận đã nuôi dưỡng phản ứng dữ dội hiện tại đối với AI. Để đáp lại, Amodei cho biết ông đã cố gắng đưa ra một góc nhìn "cân bằng" và lập luận rằng phản ứng dữ dội này "về cơ bản là một cuộc khủng hoảng lòng tin", khi mọi người trở nên hoài nghi về các công ty công nghệ, ngành công nghệ và chính phủ.

Các nhà phê bình trong ngành cũng tỏ ra hoài nghi về những cảnh báo AI tận thế này, cho rằng chúng là sự xao lãng khỏi những tác hại mà công nghệ này đã và đang gây ra.

Ví dụ, nhà báo Brian Merchant đã viết rằng ông vẫn chưa thấy "một tài liệu đáng tin cậy, từng bước về việc chính xác AI có thể chuyển từ việc tự cải thiện đệ quy sang việc tiêu diệt từng con người trên hành tinh này như thế nào"; ông cũng gợi ý rằng các đề xuất tương tự như của Amodei "có lẽ sẽ chỉ phục vụ Anthropic và OpenAI; đó là hình ảnh của việc chiếm đoạt quy định đang hoạt động".

Trong bài đăng mới của mình, Amodei viết rằng ông vẫn "tin rằng AI có thể cải thiện rất nhiều chất lượng cuộc sống của con người".

Ông nói: "Mong muốn đạt được những lợi ích này của tôi không hề suy giảm. Nhưng những lợi ích sẽ chỉ đạt được nếu chúng ta xây dựng công nghệ theo đúng cách, và — miễn là chúng ta tận dụng tốt thời gian có được — việc cẩn trọng một cách bất thường để làm cho đúng là rất đáng giá."

🔗 Bài gốc (tiếng Anh): Anthropic CEO outlines plan to ‘pace the frontier’
Nguồn: TechCrunch

Cùng chuyên mục · AI & Dữ liệu
AI & Dữ liệu

Chính quyền Trump nới lỏng quy định môi trường để thúc đẩy trung tâm dữ liệu AI

Nhiều cựu quan chức EPA cảnh báo chính quyền Tổng thống Trump đang làm suy yếu các quy định môi trường nhằm đẩy nhanh…

The Verge · 7 phút đọc
AI & Dữ liệu

Iran và lực lượng Houthi bị phát hiện dùng AI Claude để nhắm mục tiêu tàu chiến Mỹ và phát triển tên lửa siêu vượt âm

Báo cáo đe dọa tháng 9/2026 của Anthropic tiết lộ các nhóm liên kết với Iran và phiến quân Houthi đã sử dụng mô hình AI…

Tom's Hardware · 4 phút đọc
AI & Dữ liệu

CEO Anthropic nhận định đã đến lúc cần giảm tốc độ phát triển AI

CEO Anthropic Dario Amodei vừa đề xuất kế hoạch 3 bước nhằm làm chậm quá trình phát triển AI để đảm bảo an toàn. Ông…

The Verge · 3 phút đọc