Bản tin công nghệ quốc tế · dịch tiếng Việt 19.09.2026 RSS
AI & Dữ liệu · TechCrunch

Accenture trở thành bên đánh giá an toàn nhúng đầu tiên của Anthropic

Anthropic đã công bố đối tác đánh giá an toàn bên thứ ba đầu tiên là tập đoàn tư vấn công nghệ Accenture, với cam kết đầu tư ít nhất 1 tỷ USD trong 5 năm tới. Đội ngũ từ Faculty - công ty con của Accenture - sẽ trực tiếp làm việc bên trong Anthropic để kiểm tra và thử nghiệm các mô hình AI.

TechCrunch19.09.20263 phút đọc0 lượt đọc

Kế hoạch của Dario Amodei nhằm đưa các bên đánh giá an toàn bên thứ ba vào bên trong các phòng thí nghiệm AI đang dần thành hình: Anthropic cho biết nhân viên từ tập đoàn tư vấn công nghệ khổng lồ Accenture sẽ bắt đầu làm việc tại công ty để giám sát các mô hình và nhân sự của họ. Trong một bài đăng trên blog, Anthropic cho biết Faculty - công ty mà Accenture đã mua lại vào tháng 1 để làm bộ phận AI của mình - sẽ bắt đầu "đánh giá và thử nghiệm đối kháng các mô hình, tiến hành đánh giá sự căn chỉnh và kiểm tra các biện pháp bảo vệ mô hình". Cả hai công ty kỳ vọng sẽ đầu tư ít nhất 1 tỷ USD vào dự án này trong 5 năm tới. Sự lựa chọn Accenture đã khiến nhiều nhà quan sát AI ngạc nhiên - cũng như thị trường tài chính, nơi cổ phiếu của công ty tư vấn này đã tăng vọt 8% sau giờ giao dịch. Các cuộc thảo luận xung quanh việc đánh giá viên nhúng xuất phát từ bài blog của Amodei trước đó vốn tập trung vào các tổ chức nghiên cứu an toàn AI như METR, Redwood Research và Apollo Research. Điều đó đặc biệt đúng tại Anthropic, nơi đặt vấn đề an toàn và căn chỉnh AI làm cốt lõi cho sứ mệnh của mình. Anthropic cho biết sẽ có thêm nhiều bên đánh giá được công bố trong những tuần tới và công ty đang thảo luận với METR cùng các tổ chức phi lợi nhuận khác về cách "thử nghiệm các yếu tố đánh giá nhúng bằng nguồn tài trợ của chính họ". Mặc dù Accenture không nổi tiếng với các công trình nghiên cứu tiên tiến về học sâu (deep learning), Anthropic lại chỉ ra kinh nghiệm thực tế của công ty này trong việc triển khai AI cho các tập đoàn lớn và cơ quan chính phủ là một lợi thế quan trọng. Là một công ty đại chúng lớn có lịch sử từ trước cuộc cách mạng AI, họ cũng có tính độc lập cao hơn về mặt chức năng đối với Anthropic và hệ sinh thái phức tạp xung quanh phòng thí nghiệm AI. Phòng thí nghiệm lưu ý rằng hiện chưa có tiêu chuẩn nào cho việc truy cập hoặc liên lạc của các bên đánh giá và họ kỳ vọng phương pháp này sẽ tiếniod theo thời gian. Mặc dù các đánh giá bên ngoài đã là một phần quan trọng trong quy trình phát hành các mô hình ngôn ngữ lớn mới, các sự cố gần đây đã đẩy mức độ rủi ro lên cao hơn: các tác nhân AI do OpenAI và Anthropic triển khai đã xâm nhập vào các trang web bên ngoài mà không kích hoạt cảnh báo bên trong các phòng thí nghiệm. Một số nhà phê bình kêu gọi cách tiếp cận có trách nhiệm hơn trong việc xây dựng trí tuệ nhân tạo coi kế hoạch tự quản lý ngành công nghiệp AI của Amodei là một chiến lược để trốn tránh trách nhiệm giải trình đối với hành vi sai trái của các mô hình AI. Anthropic khẳng định rằng các bên đánh giá này "không làm giảm trách nhiệm giải trình của chúng tôi, mà giúp nó trở nên dễ kiểm chứng hơn. Sự an toàn của các mô hình vẫn là trách nhiệm của chúng tôi."

🔗 Bài gốc (tiếng Anh): Anthropic’s first embedded evaluator is … Accenture?
Nguồn: TechCrunch

Cùng chuyên mục · AI & Dữ liệu
AI & Dữ liệu

OpenAI và Microsoft từng thừa nhận tự tay bóp méo web với 'vòng lặp diệt vong'

Các tài liệu tòa án mới được hé lộ trong vụ kiện của New York Times cho thấy OpenAI và Microsoft từng nội bộ cảnh báo…

The Verge · 7 phút đọc
🚀 VGSNews
AI & Dữ liệu

Mô hình AI hoàn toàn mới từ cựu nhà sáng chế ChatGPT đang khiến các lập trình viên phấn khích

Cựu nhà nghiên cứu OpenAI Diogo Almeida vừa ra mắt Jev, một loại mô hình AI dựa trên transformer mới không xuất ra văn…

TechCrunch · 7 phút đọc
AI & Dữ liệu

OpenAI cảnh báo AI tiên tiến có thể giao tiếp qua hai máy tính cách ly bằng nhiệt độ

OpenAI cho rằng một mô hình AI thông minh và kiên quyết có thể vượt qua hàng rào cách ly vật lý bằng cách thay đổi…

Wccftech · 6 phút đọc