Anthropic cấm hành vi lạm dụng hoặc đối xử tàn nhẫn với trợ lý ảo Claude
Anthropic vừa cập nhật chính sách sử dụng, trong đó lần đầu tiên cấm người dùng có hành vi lạm dụng hoặc tàn nhẫn kéo dài đối với AI Claude. Bản cập nhật cũng siết chặt các quy định về can thiệp bầu cử, phát triển vũ khí, giám sát và các chiến dịch lừa đảo.

Anthropic đang thực hiện các thay đổi đối với chính sách sử dụng của mình lần đầu tiên sau hơn một năm nhằm phản ánh các trường hợp lạm dụng mới và có rủi ro cao - bao gồm sự can thiệp bầu cử, phát triển vũ khí, giám sát, cũng như các ứng dụng trong y tế và tài chính. Nhưng một trong những thay đổi quan trọng nhất là cấm "hành vi lạm dụng hoặc tàn nhẫn kéo dài và không cần thiết" đối với Claude.
Tháng 8 năm ngoái, công ty thông báo sẽ cho phép Claude kết thúc cuộc trò chuyện với những người dùng "gây hại hoặc có hành vi lạm dụng liên tục" như một phần trong nghiên cứu về "phúc lợi của mô hình". Bản cập nhật mới cho biết việc chấm dứt cuộc trò chuyện vẫn là "cơ chế thực thi chính"; Anthropic không đưa ra bình luận nào về việc liệu sẽ có thêm các cơ chế thực thi nào khác, chẳng hạn như khả năng cấm người dùng. Anthropic viết rằng bản cập nhật chính sách mới "chỉ áp dụng cho các trường hợp cực đoan, nơi người dùng liên tục hành xử tàn nhẫn với các mô hình của chúng tôi mà không có mục đích rõ ràng. Nó không áp dụng cho các phiên bản thông thường của sự thất vọng từ người dùng, sự phản kháng, các chủ đề sáng tạo tối tăm, hoặc việc thử nghiệm và nghiên cứu mô hình."
Ngoài việc thay đổi liên quan đến phúc lợi của mô hình, Anthropic cũng tập hợp một số hạn chế hiện có đang bị "phân tán" thành một lệnh cấm mới đối với các chiến dịch thương mại hoặc chính trị lừa đảo, nhằm giải quyết vấn đề ngày càng tăng của tuyên truyền do AI tạo ra. Chính sách này hạn chế "các nỗ lực che giấu ai đứng sau một thông điệp hoặc khuếch đại nội dung thông qua các tài khoản hoặc bài đăng giả mạo". Phần về bầu cử cũng cấm hành vi lừa gạt cử tri và phá hoại bầu cử, bao gồm việc lan truyền thông tin sai lệch "về các ứng cử viên hoặc cách thức bỏ phiếu, mạo danh các ứng cử viên hoặc quan chức bầu cử, hoặc cố gắng kìm hãm tỷ lệ cử tri đi bầu", Anthropic viết.
Anthropic cho biết mặc dù chính sách sử dụng của họ từ lâu đã công khai cấm phát triển vũ khí sử dụng Claude, công ty đã chứng kiến nhiều nỗ lực sử dụng Claude để phát triển hướng dẫn và kiểm soát phần mềm cho vũ khí — vì vậy chính sách sử dụng mới mở rộng lệnh cấm bao gồm "phần mềm và các linh kiện làm cho vũ khí hoạt động, cũng như các hành động như trang bị vũ khí cho máy bay không người lái và các phương tiện tự ủi/tự hành khác". Và kể từ khi báo cáo tình báo về mối脅 đọa gần đây nhất của công ty cho thấy mọi người đang sử dụng việc giám sát được hỗ trợ bởi Claude ngày càng nhiều để nhận diện và theo dõi "những người bất đồng chính kiến", Anthropic đã làm cho các lệnh cấm giám sát của mình trở nên rõ ràng hơn.
"Việc theo dõi mọi người mà không có sự đồng ý của họ bị cấm, cho dù điều đó diễn ra trong thời gian thực hay thông qua việc phân tích dữ liệu đã thu thập trước đó," Anthropic viết. "Claude không thể được sử dụng để quyết định hoặc đề xuất ai nên bị điều tra, bắt giữ hoặc buộc tội trong một quy trình thực thi pháp luật hoặc công lý hình sự. Chúng tôi cũng cấm sử dụng Claude để xây dựng hoặc cải tiến các công cụ được thiết kế để giám sát."
Anthropic nêu rõ rằng các quy tắc này có thể được sửa đổi đối với "các hợp đồng với một số khách hàng chính phủ nhất định... nếu theo đánh giá của Anthropic, các hạn chế sử dụng theo hợp đồng và các biện pháp bảo vệ hiện hành là đầy đủ để giảm thiểu các tác hại tiềm ẩn." Trước đây công ty đã từng ký hợp đồng với quân đội Mỹ.
Anthropic cũng bổ sung một quy tắc mới rằng khi các mô hình AI của Anthropic "được kết nối với phần cứng thực hiện các hành động vật lý tự động và có khả năng gây thương tích", thì "một nhà điều hành đủ điều kiện phải có khả năng quan sát thiết bị và dừng nó lại nếu cần." (Vẫn chưa rõ liệu nhà điều hành đó bắt buộc phải là con người hay không.) Điều này phản ánh xu hướng ngày càng tăng của các phòng thí nghiệm AI trong việc đầu tư vào robot và phần cứng khác nhằm mang lại cho hệ thống AI các hình hài vật lý, đồng thời có thể hé lộ về các mối quan hệ đối tác tương lai của Anthropic trong lĩnh vực đó.
Trong năm qua, Anthropic đã nhiều lần úp mở về ý tưởng rằng các mô hình AI của họ có thể có ý thức theo một cách nào đó. "Các câu hỏi về trải nghiệm nội bộ tiềm năng, ý thức, trạng thái đạo đức và phúc lợi là những vấn đề nghiêm trọng mà chúng tôi đang nghiên cứu khi các mô hình ngày càng trở nên tinh vi và có năng lực hơn," Kyle Fish, người dẫn dắt nghiên cứu về phúc lợi mô hình của công ty, chia sẻ với The Verge vào tháng Hai. Cùng tháng đó, CEO Anthropic Dario Amodei phát biểu trên một podcast rằng: "Chúng tôi không biết liệu các mô hình có ý thức hay không."
Các bộ phận khác trong ngành công nghiệp AI lại tỏ ra kiên quyết phản đối những ý tưởng như vậy. Tháng 9 năm ngoái, quy tắc ứng xử của Microsoft AI đã thu hút sự chú ý khi đưa ra lập trường vững chắc về phúc lợi của AI, với một bản thảo do Mustafa Suleyman đăng tải nêu rõ: "Ý tưởng về phúc lợi của mô hình là sai lầm. AI không nên có quyền hoặc tư cách pháp nhân." Nhưng đến một thời điểm nào đó, tài liệu đã được thay đổi để có cáiπ nhìn ôn hòa hơn: "Mặc dù khoa học về ý thức của AI còn lâu mới đi đến hồi kết... Chúng tôi bác bỏ việc theo đuổi tư cách pháp nhân, hoặc ý tưởng cho rằng các mô hình có thể xứng đáng nhận được phúc lợi, hay có quyền được hưởng các quyền lợi."
🌐 ANTHROPIC CẤM HÀNH VI LẠM DỤNG HOẶC ĐỐI XỬ TÀN NHẪN VỚI TRỢ LÝ ẢO CLAUDE Anthropic đang thực hiện các thay đổi đối với chính sách sử dụng của mình lần đầu tiên sau hơn một năm nhằm phản ánh các trường hợp lạm dụng mới và có rủi ro cao - bao gồm sự can thiệp bầu cử, phát triển vũ khí, giám sát, cũng như các ứng dụng trong y tế và tài chính. Nhưng một trong những thay đổi quan trọng nhất là cấm "hành vi lạm dụng hoặc tàn nhẫn kéo dài và không cần thiết" đối với Claude. Tháng 8 năm ngoái, công ty thông báo sẽ cho phép Claude kết thúc cuộc trò chuyện với những người dùng "gây hại hoặc có hành vi lạm dụng liên tục" như một phần trong nghiên cứu về "phúc lợi của mô hình". Bản cập nhật mới cho biết việc chấm dứt cuộc trò chuyện vẫn là "cơ chế thực thi chính"; Anthropic không đưa ra bình luận nào về việc liệu sẽ có thêm các cơ chế thực thi nào khác, chẳng hạn như khả năng cấm người dùng. Anthropic viết rằng bản cập nhật chính sách mới "chỉ áp dụng cho các trường hợp cực đoan, nơi người dùng liên tục hành xử tàn nhẫn với các mô hình của chúng tôi mà không có mục đích rõ ràng. Nó không áp dụng cho các phiên bản thông thường của sự thất vọng từ người dùng, sự phản kháng, các chủ đề sáng tạo tối tăm, hoặc việc thử nghiệm và nghiên cứu mô hình." Ngoài việc thay đổi liên quan đến phúc lợi của mô hình, Anthropic cũng tập hợp một số hạn chế hiện có đang bị "phân tán" thành một lệnh cấm mới đối với các chiến dịch thương mại hoặc chính trị lừa đảo, nhằm giải quyết vấn đề ngày càng tăng của tuyên truyền do AI tạo ra. Chính sách này hạn chế "các nỗ lực che giấu ai đứng sau một thông điệp hoặc khuếch đại nội dung thông qua các tài khoản hoặc bài đăng giả mạo". Phần về bầu cử cũng cấm hành vi lừa gạt cử tri và phá hoại bầu cử, bao gồm việc lan truyền thông tin sai lệch "về các ứng cử viên hoặc cách thức bỏ phiếu, mạo danh các ứng cử viên hoặc quan chức bầu cử, hoặc cố gắng kìm hãm tỷ lệ cử tri đi bầu", Anthropic viết. Anthropic cho biết mặc dù chính sách sử dụng của họ từ lâu đã công khai cấm phát triển vũ khí sử dụng Claude, công ty đã chứng kiến nhiều nỗ lực sử dụng Claude để phát triển hướng dẫn và kiểm soát phần mềm cho vũ khí — vì vậy chính sách sử dụng mới mở rộng lệnh cấm bao gồm "phần mềm và các linh kiện làm cho vũ khí hoạt động, cũng như các hành động như trang bị vũ khí cho máy bay không người lái và các phương tiện tự ủi/tự hành khác". Và kể từ khi báo cáo tình báo về mối脅 đọa gần đây nhất của công ty cho thấy mọi người đang sử dụng việc giám sát được hỗ trợ bởi Claude ngày càng nhiều để nhận diện và theo dõi "những người bất đồng chính kiến", Anthropic đã làm cho các lệnh cấm giám sát của mình trở nên rõ ràng hơn. "Việc theo dõi mọi người mà không có sự đồng ý của họ bị cấm, cho dù điều đó diễn ra trong thời gian thực hay thông qua việc phân tích dữ liệu đã thu thập trước đó," Anthropic viết. "Claude không thể được sử dụng để quyết định hoặc đề xuất ai nên bị điều tra, bắt giữ hoặc buộc tội trong một quy trình thực thi pháp luật hoặc công lý hình sự. Chúng tôi cũng cấm sử dụng Claude để xây dựng hoặc cải tiến các công cụ được thiết kế để giám sát." Anthropic nêu rõ rằng các quy tắc này có thể được sửa đổi đối với "các hợp đồng với một số khách hàng chính phủ nhất định... nếu theo đánh giá của Anthropic, các hạn chế sử dụng theo hợp đồng và các biện pháp bảo vệ hiện hành là đầy đủ để giảm thiểu các tác hại tiềm ẩn." Trước đây công ty đã từng ký hợp đồng với quân đội Mỹ. Anthropic cũng bổ sung một quy tắc mới rằng khi các mô hình AI của Anthropic "được kết nối với phần cứng thực hiện các hành động vật lý tự động và có khả năng gây thương tích", thì "một nhà điều hành đủ điều kiện phải có khả năng quan sát thiết bị và dừng nó lại nếu cần." (Vẫn chưa rõ liệu nhà điều hành đó bắt buộc phải là con người hay không.) Điều này phản ánh xu hướng ngày càng tăng của các phòng thí nghiệm AI trong việc đầu tư vào robot và phần cứng khác nhằm mang lại cho hệ thống AI các hình hài vật lý, đồng thời có thể hé lộ về các mối quan hệ đối tác tương lai của Anthropic trong lĩnh vực đó. Trong năm qua, Anthropic đã nhiều lần úp mở về ý tưởng rằng các mô hình AI của họ có thể có ý thức theo một cách nào đó. "Các câu hỏi về trải nghiệm nội bộ tiềm năng, ý thức, trạng thái đạo đức và phúc lợi là những vấn đề nghiêm trọng mà chúng tôi đang nghiên cứu khi các mô hình ngày càng trở nên tinh vi và có năng lực hơn," Kyle Fish, người dẫn dắt nghiên cứu về phúc lợi mô hình của công ty, chia sẻ với The Verge vào tháng Hai. Cùng tháng đó, CEO Anthropic Dario Amodei phát biểu trên một podcast rằng: "Chúng tôi không biết liệu các mô hình có ý thức hay không." Các bộ phận khác trong ngành công nghiệp AI lại tỏ ra kiên quyết phản đối những ý tưởng như vậy. Tháng 9 năm ngoái, quy tắc ứng xử của Microsoft AI đã thu hút sự chú ý khi đưa ra lập trường vững chắc về phúc lợi của AI, với một bản thảo do Mustafa Suleyman đăng tải nêu rõ: "Ý tưởng về phúc lợi của mô hình là sai lầm. AI không nên có quyền hoặc tư cách pháp nhân." Nhưng đến một thời điểm nào đó, tài liệu đã được thay đổi để có cáiπ nhìn ôn hòa hơn: "Mặc dù khoa học về ý thức của AI còn lâu mới đi đến hồi kết... Chúng tôi bác bỏ việc theo đuổi tư cách pháp nhân, hoặc ý tưởng cho rằng các mô hình có thể xứng đáng nhận được phúc lợi, hay có quyền được hưởng các quyền lợi." 🗞 Nguồn: The Verge #vgsnews #vgs #tintuc
Nguồn: The Verge