Cảnh báo rằng AI có thể gây thảm họa cho nhân loại đặt ra một câu hỏi lớn. Nhưng với tổ chức đang cân nhắc đưa AI vào công việc, câu hỏi sát sườn hơn là: hệ thống đã được ai kiểm tra, và nó sẽ được quyền truy cập hay hành động đến đâu? Các tiếng nói trong ngành AI tại Singapore đang nhấn mạnh kiểm định độc lập, minh bạch về an toàn và giới hạn quyền của hệ thống được triển khai, thay vì chọn giữa phát triển không kiểm soát và dừng toàn bộ AI.
7
32
Cảnh báo gây tranh luận trong tháng 9
Jacob Coxon nghỉ việc tại Anthropic sau thời gian làm việc ở cả Anthropic lẫn OpenAI. Ông cáo buộc hai công ty chạy đua phát triển siêu trí tuệ có khả năng tự cải thiện mà thiếu trách nhiệm. Nhà nghiên cứu Evan Hubinger của Anthropic bày tỏ đồng tình và đưa ra ước tính cá nhân rằng khả năng AI gây tuyệt chủng cho loài người trong thập kỷ tới là trên 10%. Đây không phải xác suất được đo lường, cũng không phải bằng chứng cho thấy thảm họa sắp xảy ra.
3
4
Ngày 12/9, Tổng giám đốc Anthropic Dario Amodei kêu gọi giảm tốc phát triển AI. Đề xuất của ông còn bao gồm việc cho bên đánh giá thứ ba tiếp cận để xác minh các thực hành và thông tin trao đổi về an toàn, cũng như báo cáo sự cố. Trọng tâm vì thế chuyển từ mức độ lo ngại sang điều mà người ngoài có thể kiểm chứng.
13
32
Kiểm định được gì, và chưa chứng minh được gì?
Singapore đã có công cụ AI Verify, ra mắt năm 2022, hỗ trợ đánh giá kết quả AI có công bằng, ổn định trước biến động và có thể giải thích hay không. Chương trình công nhận người kiểm thử AI cũng được đề cập như một cách tăng năng lực kiểm định. Tuy nhiên, kiểm thử hệ thống hiện có không thể bảo đảm mọi hệ thống tương lai đều an toàn.
19
33
Kiểm định độc lập đòi hỏi nhiều hơn lời cam kết rằng nhà cung cấp đã tự kiểm tra mô hình. Bên đánh giá cần đủ quyền tiếp cận để đối chiếu thực hành an toàn được công bố và phát hiện sự cố. Trước khi kết nối AI với dữ liệu và quy trình làm việc, tổ chức triển khai cũng cần sự minh bạch và các biện pháp kiểm soát từ nhà cung cấp. Ngay cả quyền tiếp cận trọng số mô hình cũng không tự nó cho biết đầy đủ các quyết định huấn luyện, lỗi hay biện pháp bảo vệ.
32
34
Điều đó không có nghĩa mọi hoạt động phát triển đều phải tiếp tục. Một chuyên gia tại Singapore được dẫn lời trong cuộc tranh luận cho rằng nhà phát triển nên tạm dừng hoạt động cụ thể nếu không thể kiểm soát hệ thống đầy đủ hoặc giải thích cách quản lý rủi ro nghiêm trọng. Đây là điểm khác biệt giữa dừng vì rủi ro có căn cứ và tạm dừng đồng loạt mọi ứng dụng.
32
Đừng trao quyền cho AI tự hành động trước khi đặt giới hạn
Với AI có thể dùng công cụ và tự thực hiện nhiều bước công việc, việc kiểm soát quyền hạn trở nên cấp thiết. Tháng 1/2026, Cơ quan Phát triển Truyền thông và Thông tin Singapore (IMDA) công bố khung hướng dẫn quản trị loại AI này. Khung yêu cầu đánh giá rủi ro từ đầu, giới hạn mức tự chủ và quyền truy cập công cụ, dữ liệu; bản cập nhật nêu nguyên tắc chỉ cấp quyền tối thiểu cần thiết. Đây là hướng dẫn, không phải lệnh cấm triển khai trên diện rộng.
50
48
52
Ở cấp tổ chức, điều đó có nghĩa là xác định người chịu trách nhiệm cho từng AI, thu hẹp quyền truy cập, theo dõi hoạt động và bảo đảm hành động có thể truy vết, đảo ngược khi khả thi. Những biện pháp này cụ thể hơn lời bảo đảm chung chung rằng AI “an toàn”.
34 Bộ trưởng Josephine Teo từng so sánh vai trò tạo dựng niềm tin của các tiêu chuẩn và biện pháp an toàn AI với những thực hành trong ngành hàng không dân dụng.
17
Câu trả lời trước bất định là trách nhiệm có thể kiểm chứng: kiểm thử những gì kiểm thử được, mở đường cho giám sát độc lập và không trao quyền vượt quá khả năng kiểm soát. Cách tiếp cận ấy không khép lại tranh luận về rủi ro AI dài hạn, nhưng đặt ra việc cần làm ngay cho cả bên phát triển lẫn bên triển khai.
32
48