Đâu là nguyên nhân đằng sau những cảnh báo tận thế mới nhất từ ngành công nghiệp AI?
Ngành công nghiệp AI đang tranh cãi gay gắt về nguy cơ tuyệt chủng của nhân loại sau khi một nhà nghiên cứu từ chức tại Anthropic và các lãnh đạo đưa ra cảnh báo lớn. Các chuyên gia từ TechCrunch đặt câu hỏi liệu đây là mối lo thực sự, chiêu trò marketing hay cách để ngầm khẳng định sức mạnh công nghệ trước thềm IPO.
Ngành công nghiệp AI dường như đang có cuộc tranh luận lớn nhất từ trước đến nay về việc liệu công nghệ của họ có tạo ra mối đe dọa hiện hữu đối với nhân loại hay không.
Cuộc thảo luận hiện tại bắt đầu sau khi nhà nghiên cứu AI Jacob Coxon tuyên bố từ chức khỏi Anthropic vì lo ngại rằng các công ty AI hàng đầu đang "đánh cược với cuộc sống của chúng ta". Sau đó, trưởng nhóm kiểm duyệt an toàn (alignment lead) của Anthropic đã lên tiếng trong một bài đăng tuyên bố: "Chúng tôi thực sự tin rằng AI có thể tiêu diệt toàn bộ con người!", đồng thời bổ sung rằng cá nhân ông nghĩ khả năng đó là ">10% trong thập kỷ tới".
Trong tập mới nhất của podcast Equity thuộc TechCrunch, Kirsten Korosec, Sean O'Kane và tôi đã thảo luận về những cảnh báo tận thế mới nhất này. Tôi đã cố gắng giải thích lý do tại sao mình hoài nghi về nhiều câu chuyện tận thế do AI gây ra, trong khi Kirsten đặt câu hỏi liệu đây có phải là "một cách kỳ lạ để khoe khoang nhằm cho thấy mô hình AI của công ty họ đã tiến bộ đến mức nào", đặc biệt khi các công ty này đang chuẩn bị phát hành cổ phiếu công khai (IPO).
Và Sean tự hỏi những lo ngại này có thể xuất hiện như thế nào trong hồ sơ S-1 chuẩn bị cho đợt IPO của Anthropic: "Liệu hiện tại có các luật sư cấp dưới đang phải rà soát và viết lại toàn bộ phần đó trong hồ sơ S-1 để nói rằng, 'Đó chính thức là quan điểm của Anthropic rằng có hơn 10% cơ hội chúng ta phát triển được một thứ có thể xóa sổ toàn bộ nhân loại và điều đó sẽ gây hại nghiêm trọng đến hoạt động kinh doanh của chúng tôi'?"
Hãy tiếp tục theo dõi bản xem trước cuộc trò chuyện của chúng tôi, đã được biên tập lại để có độ dài và sự rõ ràng phù hợp. (Lưu ý: Chúng tôi đã ghi hình tập này trước khi CEO Anthropic Dario Amodei công bố kế hoạch phát triển AI thận trọng hơn).
Sean O'Kane: Thật khó để nghĩ ra điều gì lại bùng nổ nhanh đến thế. Không chỉ có phát súng cảnh báo này đến từ một nhà nghiên cứu trẻ từng làm việc tại OpenAI, mà nó còn được chia sẻ ngay lập tức trên X bởi trưởng nhóm kiểm duyệt an toàn tại Anthropic — người mà có lẽ sẽ được ghi nhớ với dấu chấm than bị đặt sai chỗ nhất mọi thời đại, khi chia sẻ bài đăng của Coxon kèm theo dòng trạng thái: "Chúng tôi thực sự tin rằng AI có thể tiêu diệt toàn bộ con người!" Kèm theo một dấu chấm than!
Thật là một bầu không khí kỳ lạ. Điều đó chẳng khác nào đổ thêm dầu vào một bài đăng hoặc chuỗi bài đăng vốn đã căng thẳng. Xuất hiện sau vụ rò rỉ Hugging Face từ mô hình nội bộ của OpenAI, cộng với năng lực ngày càng tăng mà chúng ta thấy ở các mô hình mới nhất do Anthropic phát hành và bây giờ là OpenAI với Astra vài tuần trước, tôi nghĩ đây là thời điểm hoàn hảo để tạo ra hiệu ứng thùng thuốc súng cho tuyên bố của nhà nghiên cứu trẻ này.
Anthony Ha: Chỉ để phản bác lại anh, tôi thực sự nghĩ rằng nếu anh tin AI có thể tiêu diệt toàn bộ nhân loại, điều đó hoàn toàn xứng đáng nhận được một dấu chấm than. Tôi cho rằng đó là một dấu chấm than được sử dụng hoàn toàn hợp lý!
Vấn đề của tôi với dòng tweet đó thiên về chữ "chúng ta". "Chúng ta" ở đây là ai? Đến mức nào chúng ta có thể coi cộng đồng AI hoặc cộng đồng nghiên cứu AI là một khối thống nhất? Và cơ hội lớn hơn 10% — đó chỉ là một con số được bịa ra, nó chẳng có ý nghĩa gì cả. Đôi khi [có] thói quen ở cả ngành công nghệ lẫn những nơi khác là cứ đưa ra những tỷ lệ phần trăm này, chúng không dựa trên bất cứ thứ gì hoặc không được tính toán dựa trên cơ sở nào. [Nhìn lại, tôi nhận ra dòng tweet đó có lẽ đang ám chỉ khái niệm P(doom), nhưng tôi vẫn nghĩ nó thật ngớ ngẩn].
Một điều tôi muốn nói về tuyên bố và quyết định của Coxon là — có một chủ đề lặp đi lặp lại trên Equity, khi một người như Sam Altman hoặc Dario Amodei đưa ra câu chuyện tận thế này, luôn có yếu tố sau: Vậy thì, tại sao các anh vẫn tiếp tục làm những việc đang làm? Nếu các anh thực sự tin rằng [AI có thể tiêu diệt nhân loại], các anh sẽ không tiếp tục làm việc này nữa.
[Trong khi] đây thực sự là một người đang đặt con đường sự nghiệp chuyên nghiệp của mình vào đúng những gì anh ta nói. Anh ấy thực sự đang nói rằng: "Tôi tin điều này rất, rất, rất tồi tệ và tôi không muốn tiếp tục làm việc về nó nữa". Vì vậy, hãy dành lời khen ngợi cho sự dũng cảm để làm điều đó, nếu không có gì khác.
Kirsten Korosec: Vâng, tôi xếp anh ấy vào một nhóm riêng biệt với tất cả những người khác đang nói những điều đó và bàn về các mối nguy hiểm.
Tôi sẽ đóng vai trò dự đoán, vì tôi muốn đặt câu hỏi cho cả hai bạn, đó là: Liệu có khả năng nào là mỗi khi chúng ta chứng kiến số lượng bài đăng blog ngày càng tăng về một sự cố khác trong đó một trong các tác nhân AI của họ bứt phá ngoài ý muốn, hoặc họ nói về việc nhân loại đang gặp rủi ro, thì đây là một cách kỳ lạ để khoe khoang nhằm cho thấy mô hình AI của công ty họ đã tiến bộ đến mức nào không?
Ý tôi là, điều đó nghe có vẻ rất hoài nghi, nhưng nó thực sự đạt được mục đích đó. Đó là: Nếu các mô hình AI này không tiên tiến, không có năng lực và không tạo ra sự bứt phá, chúng ta sẽ không phải lo lắng về những điều này phải không? Giống như một cách rất kỳ lạ để khoe khoang về năng lực của các mô hình mà bạn đã tạo ra bên trong công ty của chính mình.
Anthony: Tôi chắc chắn đã tự hỏi về điều này. Tôi không nghĩ nó hoàn toàn hoài nghi, theo nghĩa là tôi không nghĩ tất cả chỉ là một chiêu trò marketing có ý thức trên toàn diện. Tôi nghĩ rằng khi nhiều người trong số họ — dù là nhà nghiên cứu hay CEO — nói về điều đó, họ thực sự có mối quan ngại sâu sắc.
Nhưng tất nhiên, điều đó lại phù hợp với lợi ích kinh doanh [của họ] theo nhiều cách, khi nói rằng: "Ồ, chúng tôi đã xây dựng được phần mềm nguy hiểm nhất từng được tạo ra". Tôi không muốn phân tâm lý học quá đà ở đây, nhưng những người khác đã chỉ ra rằng có sự cám dỗ ở cấp độ cá nhân rằng: Tất nhiên, bạn muốn tin rằng thứ bạn đang làm là quan trọng nhất và nguy hiểm nhất trên thế giới.
Sean: Điều nổi bật trong tâm trí tôi khi nghĩ về câu hỏi đó là, chắc chắn có một yếu tố khiến nó có vẻ như là: "Được rồi, chúng ta đang làm thứ này có năng lực rất lớn, và điều đó tốt cho chúng ta theo một cách nào đó, ngay cả khi nó có vẻ tồi tệ dưới nhiều góc độ khác nhau".
Tôi nghĩ điều khác biệt về một số ví dụ gần đây nhất là, nó thực sự mang lại cho bạn cảm giác rằng những công ty này không kiểm soát được vấn đề này theo những cách nhất định, đặc biệt là với những thứ liên quan đến OpenAI.
Chúng ta liên tục thấy ngày càng nhiều thông tin báo chí về các tác nhân nội bộ khác đã truy cập vào các wiki khác nhau trên web và để lại tin nhắn cho nhau, theo cách không có vẻ như được xử lý một cách có thẩm quyền từ OpenAI. Tôi tưởng tượng rằng sẽ có nhiều sự trau chuốt hơn một chút cho câu chuyện được kể, nếu mọi thứ hoàn toàn nhằm mục đích khiến mọi người tin rằng, "Ồ chúa ơi, họ đã tạo ra thứ gì đó có năng lực đáng kinh ngạc".
Điều khác mà tôi nghĩ thực sự rất hấp dẫn về điều này, cụ thể là [chúng ta] chỉ còn nhiều nhất là vài tuần nữa để chứng kiến hồ sơ S-1 chuẩn bị cho đợt IPO của Anthropic, và chỉ còn vài tuần nữa hoặc một hoặc hai tháng nữa là đến một đợt IPO tiềm năng.
Và ý tưởng cho rằng bạn sẽ công bố và nói những điều này bằng ngôn ngữ rõ ràng trước một đợt IPO — tôi rất quan tâm đến ý nghĩa của điều đó đối với quá trình này. Đã có bao nhiêu nội dung kiểu này được họ viết sẵn vào S-1 và các yếu tố rủi ro bên trong tài liệu đó? Liệu hiện tại có các luật sư cấp dưới nào đang xem xét và phải viết lại toàn bộ phần đó của hồ sơ S-1 để nói rằng, "Đó chính thức là quan điểm của Anthropic rằng có hơn 10% cơ hội chúng ta có thể phát triển thứ gì đó có thể xóa sổ toàn bộ nhân loại và điều đó sẽ gây hại nghiêm trọng đến hoạt động kinh doanh của chúng ta"?
Kirsten: Anh đang giả định rằng nó chưa có sẵn trong đó sao?
Sean: Tuy nhiên, đó là những gì tôi đang nói: Nó đã có ở đó và đang được viết lại sao? Hay đây là một sự tranh giành thực sự? Phải có ngôn ngữ nào đó trong đó chứ. Đó là một trong những lý do tại sao tôi rất háo hức muốn đọc tài liệu này theo cách thậm chí còn đi xa hơn, ở một số khía cạnh, so với [S-1 của] SpaceX, bởi vì tôi chắc chắn rằng có lẽ có những thứ cụ thể đối với những ý tưởng này sẽ rất thú vị để xem.
Kirsten: Vấn đề là thế này: Trong một môi trường đầu tư truyền thống, người ta có thể tin rằng ngôn ngữ như thế này sẽ làm tổn hại đến giá trị định giá của một công ty, bởi vì đột nhiên nó trở nên nguy hiểm. Nhưng chúng ta đang không sống trong những thời kỳ bình thường.
Và do đó, trở lại với quan điểm của tôi, cuối cùng nó có thể biến thành một cách khoe khoang có lợi một cách kỳ lạ cho công ty về mặt định giá. Nó không giống với toàn bộ xu hướng kích động phẫn nộ mà chúng ta đã thấy vào năm ngoái, nhưng nó nằm trong cùng một vũ trụ đó, trong đó sức mạnh...
🚀 ĐÂU LÀ NGUYÊN NHÂN ĐẰNG SAU NHỮNG CẢNH BÁO TẬN THẾ MỚI NHẤT TỪ NGÀNH CÔNG NGHIỆP AI? Ngành công nghiệp AI dường như đang có cuộc tranh luận lớn nhất từ trước đến nay về việc liệu công nghệ của họ có tạo ra mối đe dọa hiện hữu đối với nhân loại hay không. Cuộc thảo luận hiện tại bắt đầu sau khi nhà nghiên cứu AI Jacob Coxon tuyên bố từ chức khỏi Anthropic vì lo ngại rằng các công ty AI hàng đầu đang "đánh cược với cuộc sống của chúng ta". Sau đó, trưởng nhóm kiểm duyệt an toàn (alignment lead) của Anthropic đã lên tiếng trong một bài đăng tuyên bố: "Chúng tôi thực sự tin rằng AI có thể tiêu diệt toàn bộ con người!", đồng thời bổ sung rằng cá nhân ông nghĩ khả năng đó là ">10% trong thập kỷ tới". Trong tập mới nhất của podcast Equity thuộc TechCrunch, Kirsten Korosec, Sean O'Kane và tôi đã thảo luận về những cảnh báo tận thế mới nhất này. Tôi đã cố gắng giải thích lý do tại sao mình hoài nghi về nhiều câu chuyện tận thế do AI gây ra, trong khi Kirsten đặt câu hỏi liệu đây có phải là "một cách kỳ lạ để khoe khoang nhằm cho thấy mô hình AI của công ty họ đã tiến bộ đến mức nào", đặc biệt khi các công ty này đang chuẩn bị phát hành cổ phiếu công khai (IPO). Và Sean tự hỏi những lo ngại này có thể xuất hiện như thế nào trong hồ sơ S-1 chuẩn bị cho đợt IPO của Anthropic: "Liệu hiện tại có các luật sư cấp dưới đang phải rà soát và viết lại toàn bộ phần đó trong hồ sơ S-1 để nói rằng, 'Đó chính thức là quan điểm của Anthropic rằng có hơn 10% cơ hội chúng ta phát triển được một thứ có thể xóa sổ toàn bộ nhân loại và điều đó sẽ gây hại nghiêm trọng đến hoạt động kinh doanh của chúng tôi'?" Hãy tiếp tục theo dõi bản xem trước cuộc trò chuyện của chúng tôi, đã được biên tập lại để có độ dài và sự rõ ràng phù hợp. (Lưu ý: Chúng tôi đã ghi hình tập này trước khi CEO Anthropic Dario Amodei công bố kế hoạch phát triển AI thận trọng hơn). Sean O'Kane: Thật khó để nghĩ ra điều gì lại bùng nổ nhanh đến thế. Không chỉ có phát súng cảnh báo này đến từ một nhà nghiên cứu trẻ từng làm việc tại OpenAI, mà nó còn được chia sẻ ngay lập tức trên X bởi trưởng nhóm kiểm duyệt an toàn tại Anthropic — người mà có lẽ sẽ được ghi nhớ với dấu chấm than bị đặt sai chỗ nhất mọi thời đại, khi chia sẻ bài đăng của Coxon kèm theo dòng trạng thái: "Chúng tôi thực sự tin rằng AI có thể tiêu diệt toàn bộ con người!" Kèm theo một dấu chấm than! Thật là một bầu không khí kỳ lạ. Điều đó chẳng khác nào đổ thêm dầu vào một bài đăng hoặc chuỗi bài đăng vốn đã căng thẳng. Xuất hiện sau vụ rò rỉ Hugging Face từ mô hình nội bộ của OpenAI, cộng với năng lực ngày càng tăng mà chúng ta thấy ở các mô hình mới nhất do Anthropic phát hành và bây giờ là OpenAI với Astra vài tuần trước, tôi nghĩ đây là thời điểm hoàn hảo để tạo ra hiệu ứng thùng thuốc súng cho tuyên bố của nhà nghiên cứu trẻ này. Anthony Ha: Chỉ để phản bác lại anh, tôi thực sự nghĩ rằng nếu anh tin AI có thể tiêu diệt toàn bộ nhân loại, điều đó hoàn toàn xứng đáng nhận được một dấu chấm than. Tôi cho rằng đó là một dấu chấm than được sử dụng hoàn toàn hợp lý! Vấn đề của tôi với dòng tweet đó thiên về chữ "chúng ta". "Chúng ta" ở đây là ai? Đến mức nào chúng ta có thể coi cộng đồng AI hoặc cộng đồng nghiên cứu AI là một khối thống nhất? Và cơ hội lớn hơn 10% — đó chỉ là một con số được bịa ra, nó chẳng có ý nghĩa gì cả. Đôi khi [có] thói quen ở cả ngành công nghệ lẫn những nơi khác là cứ đưa ra những tỷ lệ phần trăm này, chúng không dựa trên bất cứ thứ gì hoặc không được tính toán dựa trên cơ sở nào. [Nhìn lại, tôi nhận ra dòng tweet đó có lẽ đang ám chỉ khái niệm P(doom), nhưng tôi vẫn nghĩ nó thật ngớ ngẩn]. Một điều tôi muốn nói về tuyên bố và quyết định của Coxon là — có một chủ đề lặp đi lặp lại trên Equity, khi một người như Sam Altman hoặc Dario Amodei đưa ra câu chuyện tận thế này, luôn có yếu tố sau: Vậy thì, tại sao các anh vẫn tiếp tục làm những việc đang làm? Nếu các anh thực sự tin rằng [AI có thể tiêu diệt nhân loại], các anh sẽ không tiếp tục làm việc này nữa. [Trong khi] đây thực sự là một người đang đặt con đường sự nghiệp chuyên nghiệp của mình vào đúng những gì anh ta nói. Anh ấy thực sự đang nói rằng: "Tôi tin điều này rất, rất, rất tồi tệ và tôi không muốn tiếp tục làm việc về nó nữa". Vì vậy, hãy dành lời khen ngợi cho sự dũng cảm để làm điều đó, nếu không có gì khác. Kirsten Korosec: Vâng, tôi xếp anh ấy vào một nhóm riêng biệt với tất cả những người khác đang nói những điều đó và bàn về các mối nguy hiểm. Tôi sẽ đóng vai trò dự đoán, vì tôi muốn đặt câu hỏi cho cả hai bạn, đó là: Liệu có khả năng nào là mỗi khi chúng ta chứng kiến số lượng bài đăng blog ngày càng tăng về một sự cố khác trong đó một trong các tác nhân AI của họ bứt phá ngoài ý muốn, hoặc họ nói về việc nhân loại đang gặp rủi ro, thì đây là một cách kỳ lạ để khoe khoang nhằm cho thấy mô hình AI của công ty họ đã tiến bộ đến mức nào không? Ý tôi là, điều đó nghe có vẻ rất hoài nghi, nhưng nó thực sự đạt được mục đích đó. Đó là: Nếu các mô hình AI này không tiên tiến, không có năng lực và không tạo ra sự bứt phá, chúng ta sẽ không phải lo lắng về những điều này phải không? Giống như một cách rất kỳ lạ để khoe khoang về năng lực của các mô hình mà bạn đã tạo ra bên trong công ty của chính mình. Anthony: Tôi chắc chắn đã tự hỏi về điều này. Tôi không nghĩ nó hoàn toàn hoài nghi, theo nghĩa là tôi không nghĩ tất cả chỉ là một chiêu trò marketing có ý thức trên toàn diện. Tôi nghĩ rằng khi nhiều người trong số họ — dù là nhà nghiên cứu hay CEO — nói về điều đó, họ thực sự có mối quan ngại sâu sắc. Nhưng tất nhiên, điều đó lại phù hợp với lợi ích kinh doanh [của họ] theo nhiều cách, khi nói rằng: "Ồ, chúng tôi đã xây dựng được phần mềm nguy hiểm nhất từng được tạo ra". Tôi không muốn phân tâm lý học quá đà ở đây, nhưng những người khác đã chỉ ra rằng có sự cám dỗ ở cấp độ cá nhân rằng: Tất nhiên, bạn muốn tin rằng thứ bạn đang làm là quan trọng nhất và nguy hiểm nhất trên thế giới. Sean: Điều nổi bật trong tâm trí tôi khi nghĩ về câu hỏi đó là, chắc chắn có một yếu tố khiến nó có vẻ như là: "Được rồi, chúng ta đang làm thứ này có năng lực rất lớn, và điều đó tốt cho chúng ta theo một cách nào đó, ngay cả khi nó có vẻ tồi tệ dưới nhiều góc độ khác nhau". Tôi nghĩ điều khác biệt về một số ví dụ gần đây nhất là, nó thực sự mang lại cho bạn cảm giác rằng những công ty này không kiểm soát được vấn đề này theo những cách nhất định, đặc biệt là với những thứ liên quan đến OpenAI. Chúng ta liên tục thấy ngày càng nhiều thông tin báo chí về các tác nhân nội bộ khác đã truy cập vào các wiki khác nhau trên web và để lại tin nhắn cho nhau, theo cách không có vẻ như được xử lý một cách có thẩm quyền từ OpenAI. Tôi tưởng tượng rằng sẽ có nhiều sự trau chuốt hơn một chút cho câu chuyện được kể, nếu mọi thứ hoàn toàn nhằm mục đích khiến mọi người tin rằng, "Ồ chúa ơi, họ đã tạo ra thứ gì đó có năng lực đáng kinh ngạc". Điều khác mà tôi nghĩ thực sự rất hấp dẫn về điều này, cụ thể là [chúng ta] chỉ còn nhiều nhất là vài tuần nữa để chứng kiến hồ sơ S-1 chuẩn bị cho đợt IPO của Anthropic, và chỉ còn vài tuần nữa hoặc một hoặc hai tháng nữa là đến một đợt IPO tiềm năng. Và ý tưởng cho rằng bạn sẽ công bố và nói những điều này bằng ngôn ngữ rõ ràng trước một đợt IPO — tôi rất quan tâm đến ý nghĩa của điều đó đối với quá trình này. Đã có bao nhiêu nội dung kiểu này được họ viết sẵn vào S-1 và các yếu tố rủi ro bên trong tài liệu đó? Liệu hiện tại có các luật sư cấp dưới nào đang xem xét và phải viết lại toàn bộ phần đó của hồ sơ S-1 để nói rằng, "Đó chính thức là quan điểm của Anthropic rằng có hơn 10% cơ hội chúng ta có thể phát triển thứ gì đó có thể xóa sổ toàn bộ nhân loại và điều đó sẽ gây hại nghiêm trọng đến hoạt động kinh doanh của chúng ta"? Kirsten: Anh đang giả định rằng nó chưa có sẵn trong đó sao? Sean: Tuy nhiên, đó là những gì tôi đang nói: Nó đã có ở đó và đang được viết lại sao? Hay đây là một sự tranh giành thực sự? Phải có ngôn ngữ nào đó trong đó chứ. Đó là một trong những lý do tại sao tôi rất háo hức muốn đọc tài liệu này theo cách thậm chí còn đi xa hơn, ở một số khía cạnh, so với [S-1 của] SpaceX, bởi vì tôi chắc chắn rằng có lẽ có những thứ cụ thể đối với những ý tưởng này sẽ rất thú vị để xem. Kirsten: Vấn đề là thế này: Trong một môi trường đầu tư truyền thống, người ta có thể tin rằng ngôn ngữ như thế này sẽ làm tổn hại đến giá trị định giá của một công ty, bởi vì đột nhiên nó trở nên nguy hiểm. Nhưng chúng ta đang không sống trong những thời kỳ bình thường. Và do đó, trở lại với quan điểm của tôi, cuối cùng nó có thể biến thành một cách khoe khoang có lợi một cách kỳ lạ cho công ty về mặt định giá. Nó không giống với toàn bộ xu hướng kích động phẫn nộ mà chúng ta đã thấy vào năm ngoái, nhưng nó nằm trong cùng một vũ trụ đó, trong đó sức mạnh... 🗞 Nguồn: TechCrunch #vgsnews #vgs #tintuc
Nguồn: TechCrunch