Accenture trở thành bên đánh giá an toàn nhúng đầu tiên của Anthropic
Anthropic đã công bố đối tác đánh giá an toàn bên thứ ba đầu tiên là tập đoàn tư vấn công nghệ Accenture, với cam kết đầu tư ít nhất 1 tỷ USD trong 5 năm tới. Đội ngũ từ Faculty - công ty con của Accenture - sẽ trực tiếp làm việc bên trong Anthropic để kiểm tra và thử nghiệm các mô hình AI.
Kế hoạch của Dario Amodei nhằm đưa các bên đánh giá an toàn bên thứ ba vào bên trong các phòng thí nghiệm AI đang dần thành hình: Anthropic cho biết nhân viên từ tập đoàn tư vấn công nghệ khổng lồ Accenture sẽ bắt đầu làm việc tại công ty để giám sát các mô hình và nhân sự của họ. Trong một bài đăng trên blog, Anthropic cho biết Faculty - công ty mà Accenture đã mua lại vào tháng 1 để làm bộ phận AI của mình - sẽ bắt đầu "đánh giá và thử nghiệm đối kháng các mô hình, tiến hành đánh giá sự căn chỉnh và kiểm tra các biện pháp bảo vệ mô hình". Cả hai công ty kỳ vọng sẽ đầu tư ít nhất 1 tỷ USD vào dự án này trong 5 năm tới. Sự lựa chọn Accenture đã khiến nhiều nhà quan sát AI ngạc nhiên - cũng như thị trường tài chính, nơi cổ phiếu của công ty tư vấn này đã tăng vọt 8% sau giờ giao dịch. Các cuộc thảo luận xung quanh việc đánh giá viên nhúng xuất phát từ bài blog của Amodei trước đó vốn tập trung vào các tổ chức nghiên cứu an toàn AI như METR, Redwood Research và Apollo Research. Điều đó đặc biệt đúng tại Anthropic, nơi đặt vấn đề an toàn và căn chỉnh AI làm cốt lõi cho sứ mệnh của mình. Anthropic cho biết sẽ có thêm nhiều bên đánh giá được công bố trong những tuần tới và công ty đang thảo luận với METR cùng các tổ chức phi lợi nhuận khác về cách "thử nghiệm các yếu tố đánh giá nhúng bằng nguồn tài trợ của chính họ". Mặc dù Accenture không nổi tiếng với các công trình nghiên cứu tiên tiến về học sâu (deep learning), Anthropic lại chỉ ra kinh nghiệm thực tế của công ty này trong việc triển khai AI cho các tập đoàn lớn và cơ quan chính phủ là một lợi thế quan trọng. Là một công ty đại chúng lớn có lịch sử từ trước cuộc cách mạng AI, họ cũng có tính độc lập cao hơn về mặt chức năng đối với Anthropic và hệ sinh thái phức tạp xung quanh phòng thí nghiệm AI. Phòng thí nghiệm lưu ý rằng hiện chưa có tiêu chuẩn nào cho việc truy cập hoặc liên lạc của các bên đánh giá và họ kỳ vọng phương pháp này sẽ tiếniod theo thời gian. Mặc dù các đánh giá bên ngoài đã là một phần quan trọng trong quy trình phát hành các mô hình ngôn ngữ lớn mới, các sự cố gần đây đã đẩy mức độ rủi ro lên cao hơn: các tác nhân AI do OpenAI và Anthropic triển khai đã xâm nhập vào các trang web bên ngoài mà không kích hoạt cảnh báo bên trong các phòng thí nghiệm. Một số nhà phê bình kêu gọi cách tiếp cận có trách nhiệm hơn trong việc xây dựng trí tuệ nhân tạo coi kế hoạch tự quản lý ngành công nghiệp AI của Amodei là một chiến lược để trốn tránh trách nhiệm giải trình đối với hành vi sai trái của các mô hình AI. Anthropic khẳng định rằng các bên đánh giá này "không làm giảm trách nhiệm giải trình của chúng tôi, mà giúp nó trở nên dễ kiểm chứng hơn. Sự an toàn của các mô hình vẫn là trách nhiệm của chúng tôi."
🚀 ACCENTURE TRỞ THÀNH BÊN ĐÁNH GIÁ AN TOÀN NHÚNG ĐẦU TIÊN CỦA ANTHROPIC Kế hoạch của Dario Amodei nhằm đưa các bên đánh giá an toàn bên thứ ba vào bên trong các phòng thí nghiệm AI đang dần thành hình: Anthropic cho biết nhân viên từ tập đoàn tư vấn công nghệ khổng lồ Accenture sẽ bắt đầu làm việc tại công ty để giám sát các mô hình và nhân sự của họ. Trong một bài đăng trên blog, Anthropic cho biết Faculty - công ty mà Accenture đã mua lại vào tháng 1 để làm bộ phận AI của mình - sẽ bắt đầu "đánh giá và thử nghiệm đối kháng các mô hình, tiến hành đánh giá sự căn chỉnh và kiểm tra các biện pháp bảo vệ mô hình". Cả hai công ty kỳ vọng sẽ đầu tư ít nhất 1 tỷ USD vào dự án này trong 5 năm tới. Sự lựa chọn Accenture đã khiến nhiều nhà quan sát AI ngạc nhiên - cũng như thị trường tài chính, nơi cổ phiếu của công ty tư vấn này đã tăng vọt 8% sau giờ giao dịch. Các cuộc thảo luận xung quanh việc đánh giá viên nhúng xuất phát từ bài blog của Amodei trước đó vốn tập trung vào các tổ chức nghiên cứu an toàn AI như METR, Redwood Research và Apollo Research. Điều đó đặc biệt đúng tại Anthropic, nơi đặt vấn đề an toàn và căn chỉnh AI làm cốt lõi cho sứ mệnh của mình. Anthropic cho biết sẽ có thêm nhiều bên đánh giá được công bố trong những tuần tới và công ty đang thảo luận với METR cùng các tổ chức phi lợi nhuận khác về cách "thử nghiệm các yếu tố đánh giá nhúng bằng nguồn tài trợ của chính họ". Mặc dù Accenture không nổi tiếng với các công trình nghiên cứu tiên tiến về học sâu (deep learning), Anthropic lại chỉ ra kinh nghiệm thực tế của công ty này trong việc triển khai AI cho các tập đoàn lớn và cơ quan chính phủ là một lợi thế quan trọng. Là một công ty đại chúng lớn có lịch sử từ trước cuộc cách mạng AI, họ cũng có tính độc lập cao hơn về mặt chức năng đối với Anthropic và hệ sinh thái phức tạp xung quanh phòng thí nghiệm AI. Phòng thí nghiệm lưu ý rằng hiện chưa có tiêu chuẩn nào cho việc truy cập hoặc liên lạc của các bên đánh giá và họ kỳ vọng phương pháp này sẽ tiếniod theo thời gian. Mặc dù các đánh giá bên ngoài đã là một phần quan trọng trong quy trình phát hành các mô hình ngôn ngữ lớn mới, các sự cố gần đây đã đẩy mức độ rủi ro lên cao hơn: các tác nhân AI do OpenAI và Anthropic triển khai đã xâm nhập vào các trang web bên ngoài mà không kích hoạt cảnh báo bên trong các phòng thí nghiệm. Một số nhà phê bình kêu gọi cách tiếp cận có trách nhiệm hơn trong việc xây dựng trí tuệ nhân tạo coi kế hoạch tự quản lý ngành công nghiệp AI của Amodei là một chiến lược để trốn tránh trách nhiệm giải trình đối với hành vi sai trái của các mô hình AI. Anthropic khẳng định rằng các bên đánh giá này "không làm giảm trách nhiệm giải trình của chúng tôi, mà giúp nó trở nên dễ kiểm chứng hơn. Sự an toàn của các mô hình vẫn là trách nhiệm của chúng tôi." 🗞 Nguồn: TechCrunch #vgsnews #vgs #tintuc
Nguồn: TechCrunch