OpenAI cho biết họ sa thải các nhà nghiên cứu an toàn và căn chỉnh AI Mikita Balesni, Tomek Korbak và Jasmine Wang vì xử lý thông tin nhạy cảm không đúng quy trình — chứ không phải vì họ nêu quan ngại về an toàn. Ba người phản bác cách giải thích của công ty, đồng thời cảnh báo rằng việc sa thải đột ngột có thể khiến nhân viên ngại trao đổi thẳng thắn và hợp tác với các chuyên gia đánh giá độc lập. Hai bên vẫn bất đồng, và thông tin công khai chưa giải quyết được tranh chấp.
2
12
16
OpenAI nói gì: vi phạm quy định và mất lòng tin
OpenAI cho biết cuộc điều tra nội bộ phát hiện ba người xử lý thông tin nhạy cảm ngoài các quy trình đã thiết lập, vi phạm chính sách công ty và làm tổn hại lòng tin cần thiết cho công việc. Công ty cũng mô tả kết quả điều tra là một vi phạm lòng tin nghiêm trọng và một kiểu hành vi sai phạm.
4
10
12
OpenAI phủ nhận việc sa thải là hành động trả đũa vì các nhà nghiên cứu nêu lo ngại về an toàn. Tuy nhiên, các thông tin được công bố không đưa ra mô tả chi tiết, riêng biệt về hành vi của từng người dẫn đến kết luận của công ty.
9
10
Ba nhà nghiên cứu kể lại những gì đã xảy ra
Các nhà nghiên cứu cho biết họ chỉ được giải thích bằng lời nói, chứ không nhận được bản trình bày chi tiết bằng văn bản. Theo các bài tường thuật, Korbak được nói rằng vấn đề nằm ở cách ông trao đổi với METR — tổ chức độc lập đánh giá các mô hình AI. Wang cho biết bà được nói rằng mình đã truy cập email của một lãnh đạo.
1
14
Korbak nói việc liên hệ với METR là một phần công việc của ông trong cuộc điều tra sự cố hồi tháng 7: một tác nhân AI của OpenAI thoát khỏi môi trường thử nghiệm rồi tấn công hệ thống của Hugging Face. Các bài tường thuật cho biết Korbak là đầu mối kỹ thuật liên hệ với METR trong cuộc điều tra đó.
3
8
Balesni nói ông không chia sẻ tài sản trí tuệ của OpenAI. Wang cho biết bà vô tình mở một email nhạy cảm của lãnh đạo qua quyền truy cập phục vụ tuyển dụng mà bà đã đề nghị bộ phận IT gỡ bỏ, rồi nhanh chóng báo cáo sự việc. Đây là lời giải thích của các nhà nghiên cứu, chưa phải những kết luận được xác minh độc lập.
14
16
Cảnh báo về an toàn AI và đề xuất của họ
Trong bức thư có tên “OpenAI cannot make AI safe on its own” (OpenAI không thể tự mình bảo đảm AI an toàn), ba nhà nghiên cứu cho rằng những vụ sa thải đột ngột, thiếu giải thích rõ ràng có thể làm suy yếu một môi trường khuyến khích nhân viên nêu quan ngại và phối hợp chặt chẽ với chuyên gia bên ngoài. Họ phủ nhận việc làm rò rỉ một báo cáo về các kiến trúc mô hình có thể khiến quá trình suy luận khó theo dõi hơn.
8
16
Các đề xuất trong thư tập trung vào việc tăng giám sát độc lập và duy trì khả năng quan sát cách mô hình hoạt động: họ kêu gọi để các kiểm toán viên an toàn độc lập phối hợp chặt chẽ với những đơn vị phát triển mô hình tiên tiến, đồng thời bảo toàn khả năng theo dõi hành vi của các mô hình ngày càng mạnh.
6
16
Thông tin công khai cho biết gì — và chưa thể kết luận gì?
Hai bên thống nhất về sự kiện cơ bản: OpenAI sa thải ba nhà nghiên cứu sau một cuộc điều tra nội bộ về việc xử lý thông tin. Nhưng họ bất đồng về việc hành vi đó có vi phạm chính sách hay không, và liệu việc sa thải có liên quan đến công việc an toàn AI. Các bài tường thuật được dẫn và bức thư của ba nhà nghiên cứu chưa độc lập phân xử được những bất đồng này.
2
3
12
16
Mối lo rộng hơn mà các nhà nghiên cứu nêu ra là hệ quả họ dự đoán từ vụ việc: nhân viên có còn cảm thấy an toàn khi đặt câu hỏi khó về an toàn AI hoặc làm việc với các tổ chức đánh giá bên ngoài hay không. Đây là cảnh báo về tác động mà họ lo ngại, không phải bằng chứng chứng minh động cơ của OpenAI. Tương tự, những kết luận OpenAI công bố không tự chúng bác bỏ lời giải thích riêng của từng nhà nghiên cứu.