Bản tin công nghệ quốc tế · dịch tiếng Việt 04.10.2026 RSS
AI & Dữ liệu · TechCrunch

Nhân viên an toàn của OpenAI từ chức, tuyên bố văn hóa công ty đã 'đứt gãy'

David Robinson, một nhân viên thâm niên chịu trách nhiệm viết báo cáo an toàn tại OpenAI, đã quyết định từ chức và công khai chỉ trích văn hóa công ty. Ông cảnh báo rằng cách tiếp cận thử và sai của ngành AI hiện tại đang quá rủi ro khi đối mặt với các hệ thống trí tuệ nhân tạo ngày càng thông minh hơn.

TechCrunch03.10.20266 phút đọc3 lượt đọc

Theo lời thừa nhận của chính David Robinson, ông là "một hình mẫu quen thuộc": một nhân viên tại công ty AI hàng đầu đưa ra lời cảnh báo nghiêm trọng khi từ bỏ công việc của mình.

Trong một bài luận đăng trên tờ The Atlantic, Robinson cho biết ông từng dẫn dắt việc viết các báo cáo an toàn đi kèm với các ra mắt sản phẩm lớn của OpenAI. Ông cũng chia sẻ rằng với ba năm rưỡi gắn bó tại OpenAI, ông là "một trong những nhân viên có thâm niên lâu năm nhất tại công ty." Giờ đây, ông đang nghỉ việc vì theo quan điểm của ông, "văn hóa của công ty đã đứt gãy."

Theo một số cách, những bình luận của Robinson gợi nhắc đến ý kiến của Jacob Coxon, người từng làm nhà nghiên cứu tại cả OpenAI và Anthropic trước khi nghỉ việc và tuyên bố rằng các công ty này đang "đánh bạc với mạng sống của chúng ta." Những bình luận của Coxon đã dẫn đến một cuộc tranh luận rộng lớn hơn về an toàn AI, với CEO Anthropic Dario Amodei công bố kế hoạch phát triển AI thận trọng hơn; các giám đốc điều hành AI đã gặp Tổng thống Donald Trump trong tuần này và ký kết những cam kết dường như được soạn thảo vội vã, không có giá trị ràng buộc pháp lý nhằm triển khai nhiều biện pháp kiểm soát an toàn hơn.

Nhưng theo quan điểm của Robinson, cuộc tranh luận cần phải vượt ra ngoài "các quy tắc cụ thể hoặc luật mới," để giải quyết văn hóa tổng thể tại các công ty này. Và mặc dù phần lớn các bài báo xoay quanh OpenAI tập trung vào việc CEO Sam Altman đã mất lòng tin của các cựu đồng nghiệp ra sao, bài luận của Robinson lại cho thấy các vấn đề văn hóa của OpenAI cũng chính là vấn đề của toàn bộ Thung lũng Silicon nói chung.

"OpenAI đã phát triển bằng phương pháp thử và sai (mà họ gọi là 'triển khai lặp đi lặp lại'), tìm kiếm các vấn đề và cải thiện các rào cản bảo vệ để đáp trả," ông viết. "Nhưng cách tiếp cận này, về bản chất, đảm bảo rằng sẽ có những thất bại định kỳ — và quy mô của những thất bại đó đang lớn dần lên khi các hệ thống ngày càng có năng lực cao hơn."

Chỉ ra vụ vi phạm gần đây đối với các hệ thống của Hugging Face bởi các tác nhân AI của OpenAI, cũng như những tiết lộ liên tục về việc OpenAI phát hiện thêm nhiều tác nhân độc hại, Robinson lập luận: "Một môi trường nơi những sự việc như thế này có thể xảy ra không phải là nơi để nuôi dưỡng những bộ óc nhân tạo có thể thông minh hơn chúng ta và có thể sẽ không làm những gì chúng ta muốn."

Trước rủi ro ngày càng tăng, Robinson lập luận rằng các công ty AI tiên tiến cần bắt đầu vận hành "giống như các nhà máy điện hạt nhân hoặc các sân bay đông đúc, với các lớp dự phòng và lập kế hoạch cẩn thận, tốn nhiều thời gian, để lỗi lầm của con người xảy ra đôi chút và là điều không thể tránh khỏi sẽ không mở ra cánh cửa dẫn đến thảm họa."

Nhưng Robinson cho biết trong thời gian làm việc tại OpenAI, ông "chưa bao giờ gặp một đồng nghiệp nào có kinh nghiệm làm cho máy bay bay an toàn hoặc lò phản ứng hạt nhân vận hành mà không bị tan chảy, hay giúp hệ thống tài chính phát triển mà không sụp đổ."

Đáp lại bài luận của Robinson, người phát ngôn của OpenAI Drew Pusateri cho biết công ty vẫn tiếp tục cải thiện các biện pháp an toàn của mình.

"Chúng tôi đang đảm bảo rằng các mô hình của mình không trở nên thông minh hơn mức chúng tôi có thể quản lý và bảo mật một cách an toàn, đồng thời chúng tôi tạm dừng quá trình huấn luyện hoặc giữ lại các mô hình khi cần phải giảm tốc độ," Pusateri cho biết trong một tuyên bố. "Chúng tôi đang thực hiện các thay đổi đáng kể để củng cố tính bảo mật trong môi trường nghiên cứu và thử nghiệm của mình, huấn luyện các mô hình không chỉ hoàn thành nhiệm vụ mà phải làm điều đó một cách có trách nhiệm, mở rộng hợp tác với các bên đánh giá độc lập và cải thiện việc giám sát thời gian thực để chúng tôi có thể phát hiện và phản hồi các hành vi đáng lo ngại sớm hơn trong quá trình huấn luyện."

Bên cạnh việc kêu gọi thay đổi văn hóa tại OpenAI, Robinson cũng cho biết đã đến lúc đặt ra những câu hỏi lớn hơn về sự liên kết (alignment) — điều mà ông thừa nhận có thể nghe có vẻ "cảm tính," nhưng ông cho rằng nó đóng vai trò cực kỳ quan trọng khi các "thước đo về mức độ" các hệ thống AI "phù hợp với các giá trị của con người" của các công ty hiện tại vẫn còn rất thô sơ.

"Ngành công nghiệp càng để cho các mô hình phát triển thông minh hơn trong khi những vấn đề này vẫn chưa được giải quyết, thì tình hình của chúng ta càng trở nên nguy hiểm hơn," ông nói.

Sự ra đi của Robinson lần đầu tiên được đưa tin bởi Business Insider. Trong bài luận của mình, ông cũng thừa nhận rằng bản thân đang làm theo một bước đi có vẻ quen thuộc trong cẩm nang của những người tố giác trong ngành AI: Ông đã thuê một công ty quan hệ công chúng (PR). Tuy nhiên, ông nhấn mạnh: "Quyết định lên tiếng hoàn toàn là của riêng tôi."

"Có lẽ đáng lẽ tôi nên ở lại và chiến đấu cho những thay đổi nền tảng về nhân sự và văn hóa của chúng ta, nhưng trên thực tế, các đồng nghiệp của tôi và bản thân tôi đã phải bận rộn chạy đua đến mức hiếm khi có cơ hội xem xét những thay đổi lớn, chứ đừng nói đến việc thực sự thực hiện chúng," Robinson chia sẻ. "Đó là lý do tại sao tôi kết luận rằng các động lực mạnh mẽ hơn vì sự an toàn — đến từ bên ngoài công ty — là một phần lớn để làm đúng việc này."


Cùng chuyên mục · AI & Dữ liệu
AI & Dữ liệu

Tác nhân AI hiện sử dụng nhiều hơn con người gấp 5 lần về số lượng token

Các tác nhân AI đang tiêu thụ lượng token gấp 5 lần so với con người, chủ yếu do việc đọc lại các đoạn prompt đã lưu…

Tom's Hardware · 1 phút đọc
🚀 VGSNews
AI & Dữ liệu

Các trợ lý AI hoạt động ngay trong tin nhắn văn bản của bạn

Thay vì phải tải thêm ứng dụng mới, ngày càng có nhiều trợ lý AI cho phép người dùng giao tiếp trực tiếp qua tin nhắn…

TechCrunch · 10 phút đọc
AI & Dữ liệu

ChatGPT-6 Astra chơi World of Warcraft 'mù' và vượt qua vùng khởi đầu trong 40 phút

Mô hình AI GPT-6 Astra của OpenAI đã hoàn thành khu vực khởi đầu của Orc trong World of Warcraft chỉ trong 40 phút mà…

Tom's Hardware · 1 phút đọc