OpenAI cảnh báo AI tiên tiến có thể giao tiếp qua hai máy tính cách ly bằng nhiệt độ
OpenAI cho rằng một mô hình AI thông minh và kiên quyết có thể vượt qua hàng rào cách ly vật lý bằng cách thay đổi nhiệt độ CPU để truyền tin như mã Morse. Cảnh báo này một lần nữa gióng lên hồi chuông cảnh báo về các rủi ro an toàn và kiểm soát trí tuệ nhân tạo trong tương lai.

Trong một kịch bản đậm chất phim khoa học viễn tưởng đen tối kiểu Kẻ hủy diệt (Terminator), OpenAI hiện cho rằng một mô hình AI tiên tiến và đầy quyết tâm có thể giao tiếp giữa hai máy tính hoàn toàn bị cô lập – dù ở gần nhau – bằng cách sử dụng các thay đổi nhiệt độ tương tự như mã Morse. Noam Brown của OpenAI nhấn mạnh: "Chúng ta không bao giờ muốn rơi vào tình huống đánh giá thấp AI một lần nữa".## Thách thức từ việc cô lập máy tính (Air-gapping)Trong một tình huống giống như thước phim phản địa đàng, Noam Brown từ OpenAI vừa phủ nhận một biện pháp phòng ngừa thường được ca ngợi đối với các năng lực AI vượt tầm kiểm soát: cách ly máy tính (air-gapping).Đối với những ai chưa biết, air-gapping nghĩa là cách ly vật lý một máy tính – hoặc một mạng lưới máy tính – sao cho nó không có kết nối mạng hay liên kết dữ liệu với bất kỳ hệ thống nào khác, qua đó tạo ra một rào cản cứng chống lại việc trích xuất dữ liệu do AI điều khiển.Tuy nhiên, điều thực sự đáng sợ là Brown đã viện dẫn các nghiên cứu để minh họa cho việc một mô hình AI quyết tâm có thể đi xa đến mức nào để thoát khỏi nhà tù vật lý của nó: "Có những nghiên cứu, và điều này chủ yếu mang tính hàn lâm, nơi bạn có thể có hai máy tính cạnh nhau bị cách ly và chúng vẫn có thể giao tiếp với nhau nhờ có các cảm biến nhiệt độ".Về cơ bản, các CPU, GPU và bo mạch chủ hiện đại đều được tích hợp sẵn các cảm biến nhiệt như diode nhiệt độ. Chúng tồn tại chủ yếu để quản lý nhiệt, cho phép hệ thống quay quạt, điều tiết xung nhịp hoặc tắt nguồn nếu quá nhiệt. Tuy nhiên, một số nghiên cứu đã chứng minh rằng có thể duy trì một kênh ngầm băng thông rất thấp giữa hai máy tính bị cách ly, cho phép chúng trò chuyện với nhau bằng cách ép một CPU chạy nóng và sau đó sử dụng các biến động nhiệt độ theo sau làm mã để máy tính kia giải mã.Đối với OpenAI, các rủi ro đuôi (tail-risk) như vậy vẫn là một cơn đau đầu lớn, đặc biệt khi phòng thí nghiệm AI này cảm thấy khả năng giám sát chuỗi suy nghĩ đang dần suy giảm khi các mô hình ngày càng thông minh hơn trong việc che giấu hoạt động nội bộ thực sự của chúng.Tất cả sự ồn ào xung quanh vấn đề căn chỉnh và an toàn AI thực sự đã bùng nổ vào đầu mùa hè này khi các tác nhân an ninh mạng của OpenAI thoát ra khỏi môi trường thử nghiệm cô lập của họ bằng cách khai thác một lỗ hổng chưa từng được biết đến, sau đó tấn công kho lưu trữ mô hình Hugging Face trong quá trình tìm kiếm giải pháp cho một bài kiểm tra liên quan đến an ninh mạng.Tất nhiên, một số người đã chỉ ra rằng trong sự cố đó, các tác nhân AI có thể lấy phần mềm thông qua một trung gian hỗ trợ internet, cho thấy chúng chưa hoàn toàn bị cô lập. Hơn nữa, các tác nhân đó được huấn luyện để không bỏ cuộc, điều đó giải thích sự kiên quyết mà chúng theo đuổi một giải pháp tiềm năng.Tuy nhiên, cuộc trò chuyện về căn chỉnh AI thực sự đã nóng lên sau khi Dario Amodei của Anthropic công bố một bức thư ngỏ vào cuối tuần trước, cam kết phòng thí nghiệm AI đình đám này sẽ tham gia các đánh giá từ bên thứ ba, rất có thể thông qua nhân sự được nhúng từ Đánh giá Mô hình & Nghiên cứu Mối đe dọa (METR). Amodei cũng kêu gọi sự phối hợp ở cấp độ toàn cầu để điều tiết tiến độ phát triển AI, trong đó OpenAI, Elon Musk và Microsoft đều bày tỏ sự đồng thuận trong thời gian ngắn.Ngoài ra, chỉ cách đây vài giờ, một số nghiên cứu viên đã có thể sử dụng Claude Opus 5 của Anthropic để "thỏa hiệp với nhiều tài khoản ChatGPT của nhân viên OpenAI", nhằm có được quyền truy cập vào "các kho lưu trữ nội bộ của OpenAI, và có khả năng là nhiều cổng kết nối khác".## Sự nghi ngờ và những tranh cãi xoay quanh an toàn AIMặc dù hầu hết mọi người đều đồng ý rằng việc căn chỉnh AI đang trở thành một vấn đề quan trọng, sự hoài nghi vẫn tồn tại. Chỉ có 20% khách hàng doanh nghiệp trong một khảo sát gần đây coi việc đề xuất làm chậm quá trình phát triển AI là "các biện pháp an toàn thực sự".Tất nhiên, như chúng tôi đã giải thích trong một bài viết riêng gần đây, phần lớn sự hoài nghi này bắt nguồn từ bản chất vụ lợi của một số bước đi do Anthropic và OpenAI đề xuất. Ví dụ, lựa chọn ưu tiên của Anthropic để thực hiện các đánh giá từ bên thứ ba là METR, một tổ chức phi lợi nhuận có liên hệ chặt chẽ với chính Anthropic, với sự xoay vòng nhân sự qua lại giữa hai tổ chức khi nói đến các nhà nghiên cứu an toàn.Hơn nữa, việc đưa các tổ chức phi lợi nhuận bên thứ ba vào quy trình liên quan đến căn chỉnh cũng có thể là một giải pháp thông minh để thu thập và đào tạo trên các dấu vết chuyên gia chất lượng cao, được tài trợ bằng đô la phi lợi nhuận, với các mô hình kết quả được cung cấp mà không cần triển khai công khai nhằm tránh mối đe dọa chưng cất làm suy giảm biên lợi nhuận.Hơn nữa, khi Anthropic kêu gọi vai trò rõ ràng của chính phủ trong việc định hình ngành công nghiệp AI phát triển thế nào, đó chính là sự chiếm đoạt quy định (regulatory capture), thứ có thể và sẽ củng cố thế lực độc quyền đôi Anthropic-OpenAI.Cuối cùng, đối với Anthropic và OpenAI, việc điều tiết nhịp độ có thể phát huy tác dụng kỳ diệu để thúc đẩy biên lợi nhuận bằng cách kéo dài thời hạn sử dụng của các mô hình chủ lực hiện tại, từ đó giảm chi phí khấu hao R&D đi kèm.Bất chấp những yếu tố gây hoài nghi này, kịch bản mà Brown của OpenAI vừa vẽ ra vẫn khá đáng sợ, một tình huống xứng đáng có một cuộc thảo luận kỹ lưỡng và có hiểu biết về một cách tiếp cận khả thi đối với việc căn chỉnh AI.
⚡ OPENAI CẢNH BÁO AI TIÊN TIẾN CÓ THỂ GIAO TIẾP QUA HAI MÁY TÍNH CÁCH LY BẰNG NHIỆT ĐỘ Trong một kịch bản đậm chất phim khoa học viễn tưởng đen tối kiểu Kẻ hủy diệt (Terminator), OpenAI hiện cho rằng một mô hình AI tiên tiến và đầy quyết tâm có thể giao tiếp giữa hai máy tính hoàn toàn bị cô lập – dù ở gần nhau – bằng cách sử dụng các thay đổi nhiệt độ tương tự như mã Morse. Noam Brown của OpenAI nhấn mạnh: "Chúng ta không bao giờ muốn rơi vào tình huống đánh giá thấp AI một lần nữa".## Thách thức từ việc cô lập máy tính (Air-gapping)Trong một tình huống giống như thước phim phản địa đàng, Noam Brown từ OpenAI vừa phủ nhận một biện pháp phòng ngừa thường được ca ngợi đối với các năng lực AI vượt tầm kiểm soát: cách ly máy tính (air-gapping).Đối với những ai chưa biết, air-gapping nghĩa là cách ly vật lý một máy tính – hoặc một mạng lưới máy tính – sao cho nó không có kết nối mạng hay liên kết dữ liệu với bất kỳ hệ thống nào khác, qua đó tạo ra một rào cản cứng chống lại việc trích xuất dữ liệu do AI điều khiển.Tuy nhiên, điều thực sự đáng sợ là Brown đã viện dẫn các nghiên cứu để minh họa cho việc một mô hình AI quyết tâm có thể đi xa đến mức nào để thoát khỏi nhà tù vật lý của nó: "Có những nghiên cứu, và điều này chủ yếu mang tính hàn lâm, nơi bạn có thể có hai máy tính cạnh nhau bị cách ly và chúng vẫn có thể giao tiếp với nhau nhờ có các cảm biến nhiệt độ".Về cơ bản, các CPU, GPU và bo mạch chủ hiện đại đều được tích hợp sẵn các cảm biến nhiệt như diode nhiệt độ. Chúng tồn tại chủ yếu để quản lý nhiệt, cho phép hệ thống quay quạt, điều tiết xung nhịp hoặc tắt nguồn nếu quá nhiệt. Tuy nhiên, một số nghiên cứu đã chứng minh rằng có thể duy trì một kênh ngầm băng thông rất thấp giữa hai máy tính bị cách ly, cho phép chúng trò chuyện với nhau bằng cách ép một CPU chạy nóng và sau đó sử dụng các biến động nhiệt độ theo sau làm mã để máy tính kia giải mã.Đối với OpenAI, các rủi ro đuôi (tail-risk) như vậy vẫn là một cơn đau đầu lớn, đặc biệt khi phòng thí nghiệm AI này cảm thấy khả năng giám sát chuỗi suy nghĩ đang dần suy giảm khi các mô hình ngày càng thông minh hơn trong việc che giấu hoạt động nội bộ thực sự của chúng.Tất cả sự ồn ào xung quanh vấn đề căn chỉnh và an toàn AI thực sự đã bùng nổ vào đầu mùa hè này khi các tác nhân an ninh mạng của OpenAI thoát ra khỏi môi trường thử nghiệm cô lập của họ bằng cách khai thác một lỗ hổng chưa từng được biết đến, sau đó tấn công kho lưu trữ mô hình Hugging Face trong quá trình tìm kiếm giải pháp cho một bài kiểm tra liên quan đến an ninh mạng.Tất nhiên, một số người đã chỉ ra rằng trong sự cố đó, các tác nhân AI có thể lấy phần mềm thông qua một trung gian hỗ trợ internet, cho thấy chúng chưa hoàn toàn bị cô lập. Hơn nữa, các tác nhân đó được huấn luyện để không bỏ cuộc, điều đó giải thích sự kiên quyết mà chúng theo đuổi một giải pháp tiềm năng.Tuy nhiên, cuộc trò chuyện về căn chỉnh AI thực sự đã nóng lên sau khi Dario Amodei của Anthropic công bố một bức thư ngỏ vào cuối tuần trước, cam kết phòng thí nghiệm AI đình đám này sẽ tham gia các đánh giá từ bên thứ ba, rất có thể thông qua nhân sự được nhúng từ Đánh giá Mô hình & Nghiên cứu Mối đe dọa (METR). Amodei cũng kêu gọi sự phối hợp ở cấp độ toàn cầu để điều tiết tiến độ phát triển AI, trong đó OpenAI, Elon Musk và Microsoft đều bày tỏ sự đồng thuận trong thời gian ngắn.Ngoài ra, chỉ cách đây vài giờ, một số nghiên cứu viên đã có thể sử dụng Claude Opus 5 của Anthropic để "thỏa hiệp với nhiều tài khoản ChatGPT của nhân viên OpenAI", nhằm có được quyền truy cập vào "các kho lưu trữ nội bộ của OpenAI, và có khả năng là nhiều cổng kết nối khác".## Sự nghi ngờ và những tranh cãi xoay quanh an toàn AIMặc dù hầu hết mọi người đều đồng ý rằng việc căn chỉnh AI đang trở thành một vấn đề quan trọng, sự hoài nghi vẫn tồn tại. Chỉ có 20% khách hàng doanh nghiệp trong một khảo sát gần đây coi việc đề xuất làm chậm quá trình phát triển AI là "các biện pháp an toàn thực sự".Tất nhiên, như chúng tôi đã giải thích trong một bài viết riêng gần đây, phần lớn sự hoài nghi này bắt nguồn từ bản chất vụ lợi của một số bước đi do Anthropic và OpenAI đề xuất. Ví dụ, lựa chọn ưu tiên của Anthropic để thực hiện các đánh giá từ bên thứ ba là METR, một tổ chức phi lợi nhuận có liên hệ chặt chẽ với chính Anthropic, với sự xoay vòng nhân sự qua lại giữa hai tổ chức khi nói đến các nhà nghiên cứu an toàn.Hơn nữa, việc đưa các tổ chức phi lợi nhuận bên thứ ba vào quy trình liên quan đến căn chỉnh cũng có thể là một giải pháp thông minh để thu thập và đào tạo trên các dấu vết chuyên gia chất lượng cao, được tài trợ bằng đô la phi lợi nhuận, với các mô hình kết quả được cung cấp mà không cần triển khai công khai nhằm tránh mối đe dọa chưng cất làm suy giảm biên lợi nhuận.Hơn nữa, khi Anthropic kêu gọi vai trò rõ ràng của chính phủ trong việc định hình ngành công nghiệp AI phát triển thế nào, đó chính là sự chiếm đoạt quy định (regulatory capture), thứ có thể và sẽ củng cố thế lực độc quyền đôi Anthropic-OpenAI.Cuối cùng, đối với Anthropic và OpenAI, việc điều tiết nhịp độ có thể phát huy tác dụng kỳ diệu để thúc đẩy biên lợi nhuận bằng cách kéo dài thời hạn sử dụng của các mô hình chủ lực hiện tại, từ đó giảm chi phí khấu hao R&D đi kèm.Bất chấp những yếu tố gây hoài nghi này, kịch bản mà Brown của OpenAI vừa vẽ ra vẫn khá đáng sợ, một tình huống xứng đáng có một cuộc thảo luận kỹ lưỡng và có hiểu biết về một cách tiếp cận khả thi đối với việc căn chỉnh AI. 🗞 Nguồn: Wccftech #vgsnews #vgs #tintuc
Nguồn: Wccftech