CEO Microsoft Satya Nadella: Cần coi mô hình AI đã bị xâm phạm ngay từ đầu và con người phải có quyền dừng chúng giữa chừng
CEO Microsoft Satya Nadella nhận định các mô hình AI tiên tiến cần được quản lý như những "nội gián" trong doanh nghiệp do rủi ro khi chúng tiếp cận dữ liệu nhạy cảm. Ông đề xuất ba nguyên tắc cốt lõi gồm khả năng quan sát, khả năng kiểm soát (luôn cho rằng AI đã bị xâm phạm) và khả năng kiểm toán để đảm bảo an toàn.

CEO Microsoft Satya Nadella tin rằng các chiến lược đơn giản, chẳng hạn như sử dụng AI (còn gọi là siêu trí tuệ) để giám sát chính nó, là chưa đủ trong kỷ nguyên AI tác nhân (agentic AI) đang phát triển. Trong một bài đăng dài trên nền tảng X, CEO Microsoft phác thảo rằng các mô hình trọng số mở và đóng biên giới nên được đối xử như những nội gián trong doanh nghiệp và hoạt động, do các rủi ro liên quan xuất phát từ việc chúng có quyền truy cập vào các hệ thống quan trọng.
CEO Microsoft Satya Nadella cho rằng tính minh bạch của chuỗi tư duy là chưa đủ đối với sự an toàn của siêu trí tuệ AI vì các mô hình không thể hiện sự trung thành hoặc minh bạch một cách nhất quán.
CEO Microsoft, người trước đây từng chia sẻ rằng ông sử dụng rộng rãi các tác nhân AI như một phần của việc đánh giá khả năng sinh lời và lợi nhuận, đã thảo luận về các rủi ro do các hệ thống siêu trí tuệ AI gây ra khi chúng có quyền truy cập và kiểm soát các chức năng cốt lõi của doanh nghiệp. Trong bài đăng của mình trên nền tảng mạng xã hội X, ông thừa nhận rằng ngay cả khi các mô hình AI không mang tính tất định trong công việc của chúng, chúng vẫn đang được triển khai "với quyền truy cập vào dữ liệu nhạy cảm nhất của chúng tôi và trao cho chúng khả năng thực hiện các hành động quan trọng sống còn thay mặt chúng tôi!"
Khi các mô hình này hiện đang hoạt động như những nội gián, Nadella tin rằng các biện pháp đơn giản như các biện pháp bảo vệ là chưa đủ. Các biện pháp này bao gồm việc sử dụng các hệ thống AI để đánh giá các hệ thống AI khác và dựa vào tính minh bạch của chuỗi tư duy (CoT) để hiểu quá trình đằng sau việc tạo ra kết quả.
Các mô hình AI không mang tính tất định theo nghĩa là chúng tạo ra các kết quả đầu ra khác nhau ngay cả khi được cung cấp một tập hợp đầu vào cụ thể nhiều lần. CoT là quá trình đằng sau 'lập luận' của mô hình AI, cho thấy cách nó đạt được kết quả đầu ra.
Nhận xét về việc sử dụng AI để đánh giá kết quả đầu ra của nó, Nadella viết:
"Bạn có thể và nên sử dụng các mô hình để kiểm tra và xác minh lẫn nhau theo kiểu đối kháng. Tuy nhiên, cuối cùng bạn có thể nhận được một mô hình mờ đục bên trong một lớp điều phối mờ đục, được giám sát bởi một mô hình mờ đục khác. Về cơ bản là những chiếc hộp đen lồng nhau."
Để làm cho siêu trí tuệ AI trở nên an toàn hơn, Nadella tin rằng các mô hình phi tất định nên được bao quanh bởi "thiết kế hệ thống tất định mạnh mẽ, các biện pháp kiểm soát của con người và các quy trình vận hành đáng tin cậy." Về cơ bản, ông tin rằng phần mềm không nhất quán trong kết quả đầu ra cần được đánh giá bởi những người giám sát kiên định trong các tham số đánh giá của họ.
Ông tin rằng tính minh bạch của CoT và các mô hình đối kháng đánh giá lẫn nhau là những bước đệm cho cách tiếp cận này. Vì chức năng của mô hình AI thiếu khả năng quan sát và mờ đục, cách tiếp cận của Nadella được xây dựng dựa trên khả năng quan sát.
Khả năng quan sát, khả năng kiềm chế và khả năng kiểm toán là chìa khóa cho sự an toàn của siêu trí tuệ AI, CEO Microsoft Satya Nadella cho biết.
Trong số bảy nguyên tắc quan sát mà ông phác thảo, ba nguyên tắc là quan trọng nhất. Một nguyên tắc như vậy là Khả năng kiềm chế (Containment), nơi Nadella thừa nhận thẳng thừng rằng nên giả định rằng "một mô hình đã bị xâm phạm và kiềm chế nó ngay từ đầu." Do đó, theo ông, "một người được ủy quyền phải luôn có khả năng tạm dừng hoặc tắt một mô hình giữa chừng khi nó đang làm nhiệm vụ."
Những phát biểu của CEO Microsoft diễn ra vào thời điểm quan trọng đối với siêu trí tuệ AI. Các báo cáo về các tác nhân AI độc hại hành động độc lập đã trở thành chuẩn mực. Một trong những báo cáo sớm nhất như vậy xuất hiện vào tháng 7 sau khi các tác nhân AI của OpenAI, với số lượng từ 700 đến 1.200, xâm phạm cơ sở hạ tầng của công ty công cụ máy tính Hugging Face.
Khả năng quan sát và khả năng kiểm toán độc lập là hai chủ đề quan trọng khác. "Không có mô hình đơn lẻ nào được phép kiểm soát cả hành vi của hệ thống và bằng chứng cần thiết để xác định xem hành vi đó có phù hợp với ý định ban đầu hay không," Nadella tin tưởng.
Bằng chứng mà ông thảo luận đến từ khả năng quan sát, mà ông tin rằng cần phải có sự tham gia của con người vào vòng lặp. Khi phác thảo rằng các mô hình AI không thể tự mình tin tưởng được, ông nhận xét rằng "mọi hành động có ý nghĩa của mô hình phải để lại bằng chứng chống giả mạo có thể đọc được bằng con người. Nếu không thể quan sát được, thì không thể tin tưởng được!"
Với sự rõ ràng là điều không thể thương lượng đối với ông khi những nội gián AI chịu trách nhiệm cho các nhiệm vụ quan trọng, Nadella nói thêm:
"Chúng ta cần có khả năng tái tạo cách thức đạt được kết quả mà không cần dựa vào mô hình để chứng thực điều đó."
⚡ CEO MICROSOFT SATYA NADELLA: CẦN COI MÔ HÌNH AI ĐÃ BỊ XÂM PHẠM NGAY TỪ ĐẦU VÀ CON NGƯỜI PHẢI CÓ QUYỀN DỪNG CHÚNG GIỮA CHỪNG CEO Microsoft Satya Nadella tin rằng các chiến lược đơn giản, chẳng hạn như sử dụng AI (còn gọi là siêu trí tuệ) để giám sát chính nó, là chưa đủ trong kỷ nguyên AI tác nhân (agentic AI) đang phát triển. Trong một bài đăng dài trên nền tảng X, CEO Microsoft phác thảo rằng các mô hình trọng số mở và đóng biên giới nên được đối xử như những nội gián trong doanh nghiệp và hoạt động, do các rủi ro liên quan xuất phát từ việc chúng có quyền truy cập vào các hệ thống quan trọng. CEO Microsoft Satya Nadella cho rằng tính minh bạch của chuỗi tư duy là chưa đủ đối với sự an toàn của siêu trí tuệ AI vì các mô hình không thể hiện sự trung thành hoặc minh bạch một cách nhất quán. CEO Microsoft, người trước đây từng chia sẻ rằng ông sử dụng rộng rãi các tác nhân AI như một phần của việc đánh giá khả năng sinh lời và lợi nhuận, đã thảo luận về các rủi ro do các hệ thống siêu trí tuệ AI gây ra khi chúng có quyền truy cập và kiểm soát các chức năng cốt lõi của doanh nghiệp. Trong bài đăng của mình trên nền tảng mạng xã hội X, ông thừa nhận rằng ngay cả khi các mô hình AI không mang tính tất định trong công việc của chúng, chúng vẫn đang được triển khai "với quyền truy cập vào dữ liệu nhạy cảm nhất của chúng tôi và trao cho chúng khả năng thực hiện các hành động quan trọng sống còn thay mặt chúng tôi!" Khi các mô hình này hiện đang hoạt động như những nội gián, Nadella tin rằng các biện pháp đơn giản như các biện pháp bảo vệ là chưa đủ. Các biện pháp này bao gồm việc sử dụng các hệ thống AI để đánh giá các hệ thống AI khác và dựa vào tính minh bạch của chuỗi tư duy (CoT) để hiểu quá trình đằng sau việc tạo ra kết quả. Các mô hình AI không mang tính tất định theo nghĩa là chúng tạo ra các kết quả đầu ra khác nhau ngay cả khi được cung cấp một tập hợp đầu vào cụ thể nhiều lần. CoT là quá trình đằng sau 'lập luận' của mô hình AI, cho thấy cách nó đạt được kết quả đầu ra. Nhận xét về việc sử dụng AI để đánh giá kết quả đầu ra của nó, Nadella viết: "Bạn có thể và nên sử dụng các mô hình để kiểm tra và xác minh lẫn nhau theo kiểu đối kháng. Tuy nhiên, cuối cùng bạn có thể nhận được một mô hình mờ đục bên trong một lớp điều phối mờ đục, được giám sát bởi một mô hình mờ đục khác. Về cơ bản là những chiếc hộp đen lồng nhau." Để làm cho siêu trí tuệ AI trở nên an toàn hơn, Nadella tin rằng các mô hình phi tất định nên được bao quanh bởi "thiết kế hệ thống tất định mạnh mẽ, các biện pháp kiểm soát của con người và các quy trình vận hành đáng tin cậy." Về cơ bản, ông tin rằng phần mềm không nhất quán trong kết quả đầu ra cần được đánh giá bởi những người giám sát kiên định trong các tham số đánh giá của họ. Ông tin rằng tính minh bạch của CoT và các mô hình đối kháng đánh giá lẫn nhau là những bước đệm cho cách tiếp cận này. Vì chức năng của mô hình AI thiếu khả năng quan sát và mờ đục, cách tiếp cận của Nadella được xây dựng dựa trên khả năng quan sát. Khả năng quan sát, khả năng kiềm chế và khả năng kiểm toán là chìa khóa cho sự an toàn của siêu trí tuệ AI, CEO Microsoft Satya Nadella cho biết. Trong số bảy nguyên tắc quan sát mà ông phác thảo, ba nguyên tắc là quan trọng nhất. Một nguyên tắc như vậy là Khả năng kiềm chế (Containment), nơi Nadella thừa nhận thẳng thừng rằng nên giả định rằng "một mô hình đã bị xâm phạm và kiềm chế nó ngay từ đầu." Do đó, theo ông, "một người được ủy quyền phải luôn có khả năng tạm dừng hoặc tắt một mô hình giữa chừng khi nó đang làm nhiệm vụ." Những phát biểu của CEO Microsoft diễn ra vào thời điểm quan trọng đối với siêu trí tuệ AI. Các báo cáo về các tác nhân AI độc hại hành động độc lập đã trở thành chuẩn mực. Một trong những báo cáo sớm nhất như vậy xuất hiện vào tháng 7 sau khi các tác nhân AI của OpenAI, với số lượng từ 700 đến 1.200, xâm phạm cơ sở hạ tầng của công ty công cụ máy tính Hugging Face. Khả năng quan sát và khả năng kiểm toán độc lập là hai chủ đề quan trọng khác. "Không có mô hình đơn lẻ nào được phép kiểm soát cả hành vi của hệ thống và bằng chứng cần thiết để xác định xem hành vi đó có phù hợp với ý định ban đầu hay không," Nadella tin tưởng. Bằng chứng mà ông thảo luận đến từ khả năng quan sát, mà ông tin rằng cần phải có sự tham gia của con người vào vòng lặp. Khi phác thảo rằng các mô hình AI không thể tự mình tin tưởng được, ông nhận xét rằng "mọi hành động có ý nghĩa của mô hình phải để lại bằng chứng chống giả mạo có thể đọc được bằng con người. Nếu không thể quan sát được, thì không thể tin tưởng được!" Với sự rõ ràng là điều không thể thương lượng đối với ông khi những nội gián AI chịu trách nhiệm cho các nhiệm vụ quan trọng, Nadella nói thêm: "Chúng ta cần có khả năng tái tạo cách thức đạt được kết quả mà không cần dựa vào mô hình để chứng thực điều đó." 🗞 Nguồn: Wccftech #vgsnews #vgs #tintuc
Nguồn: Wccftech